{"as_of":"2026-08-10T05:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8fb18e04b60bbd77197a589103908e62902fe5b6b7a5d952975bbc2e06d004a9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:23:08.655628Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T04:15:19.863525Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.12574","last_updated":"2025-02-18T06:26:05Z","snapshot_observed_at":"2026-08-07T18:10:05.234466Z","submitted_at":"2025-02-18T06:26:05Z","title":"HeadInfer: Memory-Efficient LLM Inference by Head-wise Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12574","snapshot_observed_at":"2026-08-06T20:23:08.655628Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03153","last_updated":"2025-07-03T20:20:33Z","snapshot_observed_at":"2026-08-09T07:52:41.549288Z","submitted_at":"2025-07-03T20:20:33Z","title":"HGCA: Hybrid GPU-CPU Attention for Long Context LLM Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:08.655628Z"},"links":{"cited_paper":"/paper/2502.12574","citing_paper":"/paper/2507.03153"},"observation_digest":"sha256:b5779687915ed39611253f91971725b9772e0332e7f779d4693b12096b063ee1","observation_id":"73b00083-ebe0-4ad6-b566-9c8e9e4d6279","resolution":{"observed_at":"2026-08-06T20:23:08.655628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12574","last_updated":"2025-02-18T06:26:05Z","snapshot_observed_at":"2026-08-07T18:10:05.234466Z","submitted_at":"2025-02-18T06:26:05Z","title":"HeadInfer: Memory-Efficient LLM Inference by Head-wise Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12574","snapshot_observed_at":"2026-07-13T23:49:35.266340Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16357","last_updated":"2026-06-17T18:29:29Z","snapshot_observed_at":"2026-07-31T10:42:11.124976Z","submitted_at":"2026-03-17T10:40:35Z","title":"Beyond Grading Accuracy: Exploring Alignment of TAs and LLMs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T23:49:35.266340Z"},"links":{"cited_paper":"/paper/2502.12574","citing_paper":"/paper/2603.16357"},"observation_digest":"sha256:dc327562d2887a46836c64c8597b99818eb6ac33a3620093d3e93385ca55945a","observation_id":"d906d757-0644-4a84-b9bb-0e41f73bdc2d","resolution":{"observed_at":"2026-07-13T23:49:35.266340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12574","last_updated":"2025-02-18T06:26:05Z","snapshot_observed_at":"2026-08-07T18:10:05.234466Z","submitted_at":"2025-02-18T06:26:05Z","title":"HeadInfer: Memory-Efficient LLM Inference by Head-wise Offloading","version":1},"cited_work":{"arxiv_id":"2502.12574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.12574","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Headinfer: Memory-efficient llm inference by head-wise offloading","venue":null,"work_id":"cc512f42-8c1a-43bd-8633-48ad0e20f9d4","year":2025},"citing_paper":{"arxiv_id":"2604.08584","last_updated":"2026-03-30T01:42:29Z","snapshot_observed_at":"2026-07-06T22:57:40.773778Z","submitted_at":"2026-03-30T01:42:29Z","title":"CSAttention: Centroid-Scoring Attention for Accelerating LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-14T21:52:25.148104Z"},"links":{"cited_paper":"/paper/2502.12574","citing_paper":"/paper/2604.08584"},"observation_digest":"sha256:b35acd1159b2df0957d94a76eba1cb365f16129a9be93c29d3ca05e4a83bd734","observation_id":"416a4a35-3e1e-4cfc-9481-b02eb2d554f5","resolution":{"observed_at":"2026-05-14T21:53:02.178203Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12574","last_updated":"2025-02-18T06:26:05Z","snapshot_observed_at":"2026-08-07T18:10:05.234466Z","submitted_at":"2025-02-18T06:26:05Z","title":"HeadInfer: Memory-Efficient LLM Inference by Head-wise Offloading","version":1},"cited_work":{"arxiv_id":"2502.12574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.12574","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Headinfer: Memory-efficient llm inference by head-wise offloading","venue":null,"work_id":"cc512f42-8c1a-43bd-8633-48ad0e20f9d4","year":2025},"citing_paper":{"arxiv_id":"2604.21026","last_updated":"2026-04-24T07:54:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-22T19:18:30Z","title":"MCAP: Deployment-Time Layer Profiling for Memory-Constrained LLM Inference","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T00:54:33.897112Z"},"links":{"cited_paper":"/paper/2502.12574","citing_paper":"/paper/2604.21026"},"observation_digest":"sha256:fe5cde5c258c0cfd9347e77760bb50ed1540650f9e403e06f703096e23984aeb","observation_id":"92ff89c6-6fb5-45d0-af7a-8a8d5b296d4e","resolution":{"observed_at":"2026-05-10T00:54:48.412506Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12574","last_updated":"2025-02-18T06:26:05Z","snapshot_observed_at":"2026-08-07T18:10:05.234466Z","submitted_at":"2025-02-18T06:26:05Z","title":"HeadInfer: Memory-Efficient LLM Inference by Head-wise Offloading","version":1},"cited_work":{"arxiv_id":"2502.12574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.12574","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Headinfer: Memory-efficient llm inference by head-wise offloading","venue":null,"work_id":"cc512f42-8c1a-43bd-8633-48ad0e20f9d4","year":2025},"citing_paper":{"arxiv_id":"2605.09490","last_updated":"2026-05-10T11:54:40Z","snapshot_observed_at":"2026-07-06T23:21:35.327066Z","submitted_at":"2026-05-10T11:54:40Z","title":"Not All Thoughts Need HBM: Semantics-Aware Memory Hierarchy for LLM Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-12T05:30:46.989747Z"},"links":{"cited_paper":"/paper/2502.12574","citing_paper":"/paper/2605.09490"},"observation_digest":"sha256:d41c14bb731f375c09ab574c923e5e281b4b10f46e8d8e36614b22a9341dd51c","observation_id":"c3615dea-185f-4c33-a72b-e2bac65e33f5","resolution":{"observed_at":"2026-05-12T05:31:23.445841Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12574","last_updated":"2025-02-18T06:26:05Z","snapshot_observed_at":"2026-08-07T18:10:05.234466Z","submitted_at":"2025-02-18T06:26:05Z","title":"HeadInfer: Memory-Efficient LLM Inference by Head-wise Offloading","version":1},"cited_work":{"arxiv_id":"2502.12574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.12574","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Headinfer: Memory-efficient llm inference by head-wise offloading","venue":null,"work_id":"cc512f42-8c1a-43bd-8633-48ad0e20f9d4","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2502.12574","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:cea07b5640877f705122e877370ecb5c27ae1cb7e3a66a26b1949cdb6d3aba64","observation_id":"ce3b0670-1ab6-40f6-a70b-f415b16f32d4","resolution":{"observed_at":"2026-05-25T04:15:19.866746Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.12574/citation-record","integrity":"/paper/2502.12574/integrity","json":"/paper/2502.12574/citation-record.json","paper":"/paper/2502.12574"},"outbound":[],"paper":{"arxiv_id":"2502.12574","last_updated":"2025-02-18T06:26:05Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T18:10:05.234466Z","submitted_at":"2025-02-18T06:26:05Z","title":"HeadInfer: Memory-Efficient LLM Inference by Head-wise Offloading"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2502.12574."}