{"as_of":"2026-08-07T01:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ebd82369446f9b0e7dbb7e7ad5a6f40e8253a7d1795682d6db949cbdb577e7c5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:18:46.625475Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-02T16:34:35.677937Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":"2412.12094","doi":"10.48550/arxiv.2412.12094","metadata_source":"pith","pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2412.12094 , year=","venue":"cs.CL","work_id":"3adec736-83c1-450a-b6cc-ec5317a29177","year":2024},"citing_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-16T23:46:29.975858Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2502.11089"},"observation_digest":"sha256:7a2f00c05cdda5dd0632cc107cdb95fcede003beb0be4d364e52b7c617919f35","observation_id":"dc318184-6f14-4f85-aeb2-b1463aee789f","resolution":{"observed_at":"2026-05-16T23:46:30.212281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-02T16:34:35.677937Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-06T21:18:46.625475Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:46.625475Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:c32abd7734a22372453ea4c82707b771d253bcbf18567d4137918c4e48ce111f","observation_id":"1a8464b1-0285-4290-bf96-5dec339b3a40","resolution":{"observed_at":"2026-08-06T21:18:46.625475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-02T16:34:35.677937Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-06T20:08:06.728594Z","title":"Sepllm: Accelerate large language models by compressing one segment into one separator","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-06T19:58:31.345730Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.728594Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:2cd5f5b7ce8b06bd079c68242448136946ec781aa04eb4f5cb4ac5f77106b497","observation_id":"7e3cbe33-ce91-4136-8db3-9c084ff0c855","resolution":{"observed_at":"2026-08-06T20:08:06.728594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-02T16:34:35.677937Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-06T13:57:15.675892Z","title":"Sepllm: Accelerate large language models by compressing one segment into one separator","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19906","last_updated":"2025-08-04T08:19:26Z","snapshot_observed_at":"2026-08-06T13:57:11.431220Z","submitted_at":"2025-07-26T10:34:53Z","title":"CaliDrop: KV Cache Compression with Calibration","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:57:15.675892Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2507.19906"},"observation_digest":"sha256:d60743bc677889b2a8060e8f7d639b1518b77c07912ec5d208bc96888b6ec1d5","observation_id":"57454bc2-d061-44aa-ae76-7f3e17e17fe3","resolution":{"observed_at":"2026-08-06T13:57:15.675892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-02T16:34:35.677937Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-04T14:43:00.999081Z","title":"Sepllm: Accelerate large language models by compressing one segment into one separator","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02361","last_updated":"2026-05-25T07:51:15Z","snapshot_observed_at":"2026-08-04T14:42:55.586487Z","submitted_at":"2025-09-28T11:04:00Z","title":"ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:00.999081Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2510.02361"},"observation_digest":"sha256:79b4e257844242976c3356891e6a751d33868042865b41630126dd80dcc34f97","observation_id":"97e2590e-7e60-4785-bac5-541b06db62e6","resolution":{"observed_at":"2026-08-04T14:43:00.999081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-02T16:34:35.677937Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":"2412.12094","doi":"10.48550/arxiv.2412.12094","metadata_source":"pith","pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2412.12094 , year=","venue":"cs.CL","work_id":"3adec736-83c1-450a-b6cc-ec5317a29177","year":2024},"citing_paper":{"arxiv_id":"2604.03679","last_updated":"2026-04-04T10:46:09Z","snapshot_observed_at":"2026-07-06T22:52:48.277339Z","submitted_at":"2026-04-04T10:46:09Z","title":"LightThinker++: From Reasoning Compression to Memory Management","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T17:25:28.432170Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2604.03679"},"observation_digest":"sha256:c5159f59ca23194efd130caf1e986f95f1f27581278e635058f3c342f424feeb","observation_id":"4761a781-8aaa-4876-8e24-731d6cab01ea","resolution":{"observed_at":"2026-05-13T17:28:01.786972Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-02T16:34:35.677937Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":"2412.12094","doi":"10.48550/arxiv.2412.12094","metadata_source":"pith","pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2412.12094 , year=","venue":"cs.CL","work_id":"3adec736-83c1-450a-b6cc-ec5317a29177","year":2024},"citing_paper":{"arxiv_id":"2604.15583","last_updated":"2026-04-24T15:54:27Z","snapshot_observed_at":"2026-07-06T23:03:07.228701Z","submitted_at":"2026-04-16T23:34:51Z","title":"SAGE: Selective Attention-Guided Extraction for Token-Efficient Document Indexing","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T08:32:02.222528Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2604.15583"},"observation_digest":"sha256:5ef642a876883e54b4b654f20bc15ef36b2b1838ba69d24fb9987c984c980ffd","observation_id":"8ac373e4-d79f-4568-91fd-1f58389d87dd","resolution":{"observed_at":"2026-05-10T08:32:52.129872Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-02T16:34:35.677937Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":"2412.12094","doi":"10.48550/arxiv.2412.12094","metadata_source":"pith","pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2412.12094 , year=","venue":"cs.CL","work_id":"3adec736-83c1-450a-b6cc-ec5317a29177","year":2024},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-02T16:38:21.894642Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:6d728a8b3d2066a28eb99295f4c70a7232e7556de0370c450bf82eec821526cc","observation_id":"8d5cab32-d60d-4afa-8d74-00ed049ff9fc","resolution":{"observed_at":"2026-07-10T01:36:44.291190Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-02T16:34:35.677937Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-07-31T07:30:05.476997Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28434","last_updated":"2026-07-30T16:12:13Z","snapshot_observed_at":"2026-08-06T13:29:41.971510Z","submitted_at":"2026-07-30T16:12:13Z","title":"Metaphor Tracer: A Theory-Informed Analysis of Hidden States","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-31T07:30:05.476997Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2607.28434"},"observation_digest":"sha256:72cbf5aa216635edd12121ac26623bdaaa3189cc5542f71faf520358be93b050","observation_id":"ce8edf70-bd41-4f56-8b59-cb6c2af227a6","resolution":{"observed_at":"2026-07-31T07:30:05.476997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.12094/citation-record","integrity":"/paper/2412.12094/integrity","json":"/paper/2412.12094/citation-record.json","paper":"/paper/2412.12094"},"outbound":[],"paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","latest_version":6,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T16:34:35.677937Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2412.12094."}