{"as_of":"2026-08-07T17:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e9a2a9ea7a578a0f7699a07daeb9460b1245aafc13a4dd1527f21b64cf864a35","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:39:05.601985Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.17422","last_updated":"2024-09-25T23:14:47Z","snapshot_observed_at":"2026-07-31T19:09:24.701982Z","submitted_at":"2024-09-25T23:14:47Z","title":"Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction","version":1},"cited_work":{"arxiv_id":"2409.17422","doi":"10.48550/arxiv.2409.17422","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.17422","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GemFilter: Discovering Gems in Early Layers for Accelerated Long-Context LLMs","venue":"arXiv (Cornell University)","work_id":"d0a9337a-d3d6-463e-ac0b-baf48c19347f","year":2024},"citing_paper":{"arxiv_id":"2502.01068","last_updated":"2026-04-20T06:24:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T05:25:09Z","title":"FastKV: Decoupling of Context Reduction and KV Cache Compression for Prefill-Decoding Acceleration","version":7},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-23T03:59:58.634512Z"},"links":{"cited_paper":"/paper/2409.17422","citing_paper":"/paper/2502.01068"},"observation_digest":"sha256:dcf6e0342ac2f955905c9ff61893af173b1d9cb23fb56ea40847c35122587977","observation_id":"7f7592e2-bbfe-468e-8737-9d5c95431b5b","resolution":{"observed_at":"2026-05-23T04:02:30.316490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17422","last_updated":"2024-09-25T23:14:47Z","snapshot_observed_at":"2026-07-31T19:09:24.701982Z","submitted_at":"2024-09-25T23:14:47Z","title":"Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17422","snapshot_observed_at":"2026-08-07T12:39:05.601985Z","title":"Discovering the gems in early layers: Accelerating long-context llms with 1000x input token reduction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24179","last_updated":"2025-05-30T03:40:24Z","snapshot_observed_at":"2026-08-07T12:28:26.705118Z","submitted_at":"2025-05-30T03:40:24Z","title":"SALE : Low-bit Estimation for Efficient Sparse Attention in Long-context LLM Prefilling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:05.601985Z"},"links":{"cited_paper":"/paper/2409.17422","citing_paper":"/paper/2505.24179"},"observation_digest":"sha256:73f8b032304faeffe4e28b02dbe86bbf71236f0f1b292aaf195302a15a2b310c","observation_id":"0e17897b-9f3b-4af4-bd78-0b15be0fe53d","resolution":{"observed_at":"2026-08-07T12:39:05.601985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17422","last_updated":"2024-09-25T23:14:47Z","snapshot_observed_at":"2026-07-31T19:09:24.701982Z","submitted_at":"2024-09-25T23:14:47Z","title":"Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17422","snapshot_observed_at":"2026-08-06T21:18:50.235479Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:50.235479Z"},"links":{"cited_paper":"/paper/2409.17422","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:7257dd7f6bbdbe326b3db2e000f61faf9412bbb9a285f9bc4c1532160724231a","observation_id":"88163e8c-8b7b-431e-85a9-a0678b69b679","resolution":{"observed_at":"2026-08-06T21:18:50.235479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17422","last_updated":"2024-09-25T23:14:47Z","snapshot_observed_at":"2026-07-31T19:09:24.701982Z","submitted_at":"2024-09-25T23:14:47Z","title":"Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17422","snapshot_observed_at":"2026-08-03T14:02:56.724087Z","title":"Discov- ering the gems in early layers: Accelerating long-context llms with 1000x input token reduction.arXiv preprint arXiv:2409.17422,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.22088","last_updated":"2026-06-10T15:31:41Z","snapshot_observed_at":"2026-08-07T01:41:09.207562Z","submitted_at":"2025-12-26T17:20:09Z","title":"Unifying Learning Dynamics and Generalization in Transformers Scaling Law","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T14:02:56.724087Z"},"links":{"cited_paper":"/paper/2409.17422","citing_paper":"/paper/2512.22088"},"observation_digest":"sha256:febff48b15c052ab71536972cff079fd65d596f4f96c596f0c74a0ffb3aa84a4","observation_id":"0de5561e-521a-48b1-9f0f-5b1ec5ea8bb5","resolution":{"observed_at":"2026-08-03T14:02:56.724087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17422","last_updated":"2024-09-25T23:14:47Z","snapshot_observed_at":"2026-07-31T19:09:24.701982Z","submitted_at":"2024-09-25T23:14:47Z","title":"Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17422","snapshot_observed_at":"2026-08-03T05:09:31.306514Z","title":"Discovering the gems in early layers: Accelerating long-context llms with 1000x input token reduction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.03216","last_updated":"2026-05-29T02:42:46Z","snapshot_observed_at":"2026-08-03T05:09:26.451185Z","submitted_at":"2026-02-03T07:31:14Z","title":"Token Sparse Attention: Efficient Long-Context Inference with Interleaved Token Selection","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-03T05:09:31.306514Z"},"links":{"cited_paper":"/paper/2409.17422","citing_paper":"/paper/2602.03216"},"observation_digest":"sha256:8e9775a31df60b1de62ec144ada391be2c01745679e792d1b64dd7e5142b2bc7","observation_id":"d7b80cdd-66bb-46ee-abcd-7fb5b0da0ecd","resolution":{"observed_at":"2026-08-03T05:09:31.306514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17422","last_updated":"2024-09-25T23:14:47Z","snapshot_observed_at":"2026-07-31T19:09:24.701982Z","submitted_at":"2024-09-25T23:14:47Z","title":"Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction","version":1},"cited_work":{"arxiv_id":"2409.17422","doi":"10.48550/arxiv.2409.17422","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.17422","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GemFilter: Discovering Gems in Early Layers for Accelerated Long-Context LLMs","venue":"arXiv (Cornell University)","work_id":"d0a9337a-d3d6-463e-ac0b-baf48c19347f","year":2024},"citing_paper":{"arxiv_id":"2604.06746","last_updated":"2026-04-08T07:10:35Z","snapshot_observed_at":"2026-07-06T22:55:11.560398Z","submitted_at":"2026-04-08T07:10:35Z","title":"StructKV: Preserving the Structural Skeleton for Scalable Long-Context Inference","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-10T18:37:10.526359Z"},"links":{"cited_paper":"/paper/2409.17422","citing_paper":"/paper/2604.06746"},"observation_digest":"sha256:316382c7579c91acb76e49c101456b0b5d303d995fead77f490fbc50b08550a8","observation_id":"5fab0228-081c-4279-93da-8661da3c3267","resolution":{"observed_at":"2026-05-10T18:40:44.112794Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17422","last_updated":"2024-09-25T23:14:47Z","snapshot_observed_at":"2026-07-31T19:09:24.701982Z","submitted_at":"2024-09-25T23:14:47Z","title":"Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction","version":1},"cited_work":{"arxiv_id":"2409.17422","doi":"10.48550/arxiv.2409.17422","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.17422","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GemFilter: Discovering Gems in Early Layers for Accelerated Long-Context LLMs","venue":"arXiv (Cornell University)","work_id":"d0a9337a-d3d6-463e-ac0b-baf48c19347f","year":2024},"citing_paper":{"arxiv_id":"2605.14362","last_updated":"2026-05-14T04:37:39Z","snapshot_observed_at":"2026-07-06T23:25:49.545418Z","submitted_at":"2026-05-14T04:37:39Z","title":"Correctness-Aware Repository Filtering Under Maximum Effective Context Window Constraints","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T02:37:57.481847Z"},"links":{"cited_paper":"/paper/2409.17422","citing_paper":"/paper/2605.14362"},"observation_digest":"sha256:586971dfa3a187b2de7d8763e796981af0cc1c4b3b1f5dea66b11bb686da11fe","observation_id":"a5846ad2-7d7f-4094-a949-38706c878d54","resolution":{"observed_at":"2026-05-15T02:38:34.603206Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17422","last_updated":"2024-09-25T23:14:47Z","snapshot_observed_at":"2026-07-31T19:09:24.701982Z","submitted_at":"2024-09-25T23:14:47Z","title":"Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction","version":1},"cited_work":{"arxiv_id":"2409.17422","doi":"10.48550/arxiv.2409.17422","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.17422","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GemFilter: Discovering Gems in Early Layers for Accelerated Long-Context LLMs","venue":"arXiv (Cornell University)","work_id":"d0a9337a-d3d6-463e-ac0b-baf48c19347f","year":2024},"citing_paper":{"arxiv_id":"2606.06337","last_updated":"2026-07-03T15:19:53Z","snapshot_observed_at":"2026-08-03T04:22:35.628559Z","submitted_at":"2026-06-04T16:12:28Z","title":"TokenMizer: Graph-Structured Session Memory for Long-Horizon LLM Context Management","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T01:35:01.565343Z"},"links":{"cited_paper":"/paper/2409.17422","citing_paper":"/paper/2606.06337"},"observation_digest":"sha256:935251d7ccc35a9b7bd6ef4cc0b0912869c18212f8cf78c4d0e9fa02b12e2925","observation_id":"012e4a30-cb49-4d45-8aa3-7b1cf9a6d113","resolution":{"observed_at":"2026-07-02T13:06:59.133394Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17422","last_updated":"2024-09-25T23:14:47Z","snapshot_observed_at":"2026-07-31T19:09:24.701982Z","submitted_at":"2024-09-25T23:14:47Z","title":"Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction","version":1},"cited_work":{"arxiv_id":"2409.17422","doi":"10.48550/arxiv.2409.17422","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.17422","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GemFilter: Discovering Gems in Early Layers for Accelerated Long-Context LLMs","venue":"arXiv (Cornell University)","work_id":"d0a9337a-d3d6-463e-ac0b-baf48c19347f","year":2024},"citing_paper":{"arxiv_id":"2606.29563","last_updated":"2026-06-28T19:04:47Z","snapshot_observed_at":"2026-08-02T13:11:07.991129Z","submitted_at":"2026-06-28T19:04:47Z","title":"Coverage-Driven KV Cache Eviction for Efficient and Improved Inference of LLM","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-06-30T07:19:48.530272Z"},"links":{"cited_paper":"/paper/2409.17422","citing_paper":"/paper/2606.29563"},"observation_digest":"sha256:ff1d3c5661e4f993dfef73fb220336e8dbd5c2e736dbcae18fe8c18c84a1463a","observation_id":"0828e6ad-9792-486b-b635-f8eed2672a5c","resolution":{"observed_at":"2026-06-30T07:24:21.357324Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2409.17422/citation-record","integrity":"/paper/2409.17422/integrity","json":"/paper/2409.17422/citation-record.json","paper":"/paper/2409.17422"},"outbound":[],"paper":{"arxiv_id":"2409.17422","last_updated":"2024-09-25T23:14:47Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-31T19:09:24.701982Z","submitted_at":"2024-09-25T23:14:47Z","title":"Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2409.17422."}