{"as_of":"2026-08-11T03:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ed0d4058c92b6bde09841d9834bd153f73fbe5a2811b9d5f22ce87e8a7b3ff6f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:11:48.941234Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.08879","last_updated":"2025-03-11T20:45:02Z","snapshot_observed_at":"2026-08-11T02:55:45.516067Z","submitted_at":"2025-03-11T20:45:02Z","title":"LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2503.08879","doi":"10.48550/arxiv.2503.08879","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08879","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wei, J., Wang, X., Schuurmans, D., Bosma, M., Ichter, B., Xia, F., Chi, E., Le, Q., and Zhou, D","venue":"ArXiv.org","work_id":"e12f679e-9f5f-4fd4-9160-306a9bb2d556","year":2025},"citing_paper":{"arxiv_id":"2511.03092","last_updated":"2026-04-08T21:56:44Z","snapshot_observed_at":"2026-08-02T21:39:50.543195Z","submitted_at":"2025-11-05T00:38:31Z","title":"SnapStream: Efficient Long Sequence Decoding on Dataflow Accelerators","version":6},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T01:59:30.583027Z"},"links":{"cited_paper":"/paper/2503.08879","citing_paper":"/paper/2511.03092"},"observation_digest":"sha256:290d3c337f73d410c28b90a11bf98cac1e8ab17b0b63761f6afc047724a5da17","observation_id":"04bf6933-e0ac-46ce-b63b-f50462c50b30","resolution":{"observed_at":"2026-05-18T02:00:39.392292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08879","last_updated":"2025-03-11T20:45:02Z","snapshot_observed_at":"2026-08-11T02:55:45.516067Z","submitted_at":"2025-03-11T20:45:02Z","title":"LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2503.08879","doi":"10.48550/arxiv.2503.08879","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08879","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wei, J., Wang, X., Schuurmans, D., Bosma, M., Ichter, B., Xia, F., Chi, E., Le, Q., and Zhou, D","venue":"ArXiv.org","work_id":"e12f679e-9f5f-4fd4-9160-306a9bb2d556","year":2025},"citing_paper":{"arxiv_id":"2604.10098","last_updated":"2026-04-11T08:41:33Z","snapshot_observed_at":"2026-08-10T21:29:26.126321Z","submitted_at":"2026-04-11T08:41:33Z","title":"Attention Sink in Transformers: A Survey on Utilization, Interpretation, and Mitigation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-10T16:17:09.834609Z"},"links":{"cited_paper":"/paper/2503.08879","citing_paper":"/paper/2604.10098"},"observation_digest":"sha256:a7a41f200bf71087233901971b485a932ac65662f69fd58b4c69b68f373bbcd0","observation_id":"603475af-914f-474d-a411-ae9f945955aa","resolution":{"observed_at":"2026-05-11T09:05:58.252809Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08879","last_updated":"2025-03-11T20:45:02Z","snapshot_observed_at":"2026-08-11T02:55:45.516067Z","submitted_at":"2025-03-11T20:45:02Z","title":"LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2503.08879","doi":"10.48550/arxiv.2503.08879","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08879","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wei, J., Wang, X., Schuurmans, D., Bosma, M., Ichter, B., Xia, F., Chi, E., Le, Q., and Zhou, D","venue":"ArXiv.org","work_id":"e12f679e-9f5f-4fd4-9160-306a9bb2d556","year":2025},"citing_paper":{"arxiv_id":"2604.22117","last_updated":"2026-04-28T07:34:34Z","snapshot_observed_at":"2026-08-10T22:18:33.738335Z","submitted_at":"2026-04-23T23:32:36Z","title":"PermaFrost-Attack: Stealth Pretraining Seeding(SPS) for planting Logic Landmines During LLM Training","version":2},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-05-09T21:42:16.848186Z"},"links":{"cited_paper":"/paper/2503.08879","citing_paper":"/paper/2604.22117"},"observation_digest":"sha256:50b45e7d6d2bb5d810a554d75e3402255013a53f8d6aa43e3faf07b3c664b319","observation_id":"4d07651c-4369-4567-b70a-ed50d58abea4","resolution":{"observed_at":"2026-05-09T21:43:30.241418Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08879","last_updated":"2025-03-11T20:45:02Z","snapshot_observed_at":"2026-08-11T02:55:45.516067Z","submitted_at":"2025-03-11T20:45:02Z","title":"LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2503.08879","doi":"10.48550/arxiv.2503.08879","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08879","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wei, J., Wang, X., Schuurmans, D., Bosma, M., Ichter, B., Xia, F., Chi, E., Le, Q., and Zhou, D","venue":"ArXiv.org","work_id":"e12f679e-9f5f-4fd4-9160-306a9bb2d556","year":2025},"citing_paper":{"arxiv_id":"2604.22312","last_updated":"2026-04-24T07:46:25Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T07:46:25Z","title":"Guess-Verify-Refine: Data-Aware Top-K for Sparse-Attention Decoding on Blackwell via Temporal Correlation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T09:58:45.903396Z"},"links":{"cited_paper":"/paper/2503.08879","citing_paper":"/paper/2604.22312"},"observation_digest":"sha256:69117da9e9f7effff89d1b6c239ca4e4d7cb76770d9c8f471f2353145718d63c","observation_id":"5e428e53-99e1-4415-9363-72407946a81a","resolution":{"observed_at":"2026-05-11T20:11:12.549021Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08879","last_updated":"2025-03-11T20:45:02Z","snapshot_observed_at":"2026-08-11T02:55:45.516067Z","submitted_at":"2025-03-11T20:45:02Z","title":"LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2503.08879","doi":"10.48550/arxiv.2503.08879","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08879","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wei, J., Wang, X., Schuurmans, D., Bosma, M., Ichter, B., Xia, F., Chi, E., Le, Q., and Zhou, D","venue":"ArXiv.org","work_id":"e12f679e-9f5f-4fd4-9160-306a9bb2d556","year":2025},"citing_paper":{"arxiv_id":"2605.09649","last_updated":"2026-05-10T16:47:50Z","snapshot_observed_at":"2026-07-06T23:21:44.900680Z","submitted_at":"2026-05-10T16:47:50Z","title":"Make Each Token Count: Towards Improving Long-Context Performance with KV Cache Eviction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T05:02:25.513351Z"},"links":{"cited_paper":"/paper/2503.08879","citing_paper":"/paper/2605.09649"},"observation_digest":"sha256:10fc6b6d3eed0d9af90f51750a688fba3a4edcb6664a1909e61fddbb147a99f1","observation_id":"bb7f7fc5-0671-4d8e-9eff-b6e8f15902a7","resolution":{"observed_at":"2026-05-12T05:41:26.626805Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08879","last_updated":"2025-03-11T20:45:02Z","snapshot_observed_at":"2026-08-11T02:55:45.516067Z","submitted_at":"2025-03-11T20:45:02Z","title":"LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2503.08879","doi":"10.48550/arxiv.2503.08879","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08879","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wei, J., Wang, X., Schuurmans, D., Bosma, M., Ichter, B., Xia, F., Chi, E., Le, Q., and Zhou, D","venue":"ArXiv.org","work_id":"e12f679e-9f5f-4fd4-9160-306a9bb2d556","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2503.08879","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:c513101746a2394fdc5f5d795db4a5c3a0c427a3d31186af29ec286b62d3d586","observation_id":"f3425303-f25c-4e0a-b991-7560c2f8ba62","resolution":{"observed_at":"2026-05-25T04:15:19.813677Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08879","last_updated":"2025-03-11T20:45:02Z","snapshot_observed_at":"2026-08-11T02:55:45.516067Z","submitted_at":"2025-03-11T20:45:02Z","title":"LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08879","snapshot_observed_at":"2026-07-11T09:24:44.453258Z","title":"doi:10.48550/arXiv.2503.08879 , abstract =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05061","last_updated":"2026-07-08T15:11:54Z","snapshot_observed_at":"2026-08-08T23:39:23.184514Z","submitted_at":"2026-07-06T13:32:34Z","title":"KVpop -- Key-Value Cache Compression with Predictive Online Pruning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-11T09:24:44.453258Z"},"links":{"cited_paper":"/paper/2503.08879","citing_paper":"/paper/2607.05061"},"observation_digest":"sha256:eb6ba08807d1d254b8def72705b672138241ac3900a969fce1b9560aeaf7ac34","observation_id":"4406306f-8c1a-40cb-8589-025a1708a645","resolution":{"observed_at":"2026-07-11T09:24:44.453258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08879","last_updated":"2025-03-11T20:45:02Z","snapshot_observed_at":"2026-08-11T02:55:45.516067Z","submitted_at":"2025-03-11T20:45:02Z","title":"LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08879","snapshot_observed_at":"2026-08-02T05:58:45.797448Z","title":"LLMs know what to drop: Self- attention guided KV cache eviction for efficient long- context inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13205","last_updated":"2026-07-14T18:55:20Z","snapshot_observed_at":"2026-08-07T14:57:47.896782Z","submitted_at":"2026-07-14T18:55:20Z","title":"Adaptive Filtering of the KV Cache: Diagnosing and Correcting Structural-Role Bias in LLM Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T05:58:45.797448Z"},"links":{"cited_paper":"/paper/2503.08879","citing_paper":"/paper/2607.13205"},"observation_digest":"sha256:c098b5c6c1e1960bc2e4930d827faa365b9c5048f66c54c8e77a28b87f811a9c","observation_id":"fe93245a-db3d-45e8-aaeb-9defb42edf5a","resolution":{"observed_at":"2026-08-02T05:58:45.797448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08879","last_updated":"2025-03-11T20:45:02Z","snapshot_observed_at":"2026-08-11T02:55:45.516067Z","submitted_at":"2025-03-11T20:45:02Z","title":"LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08879","snapshot_observed_at":"2026-08-04T13:43:53.889317Z","title":"arXiv preprint arXiv:2503.08879 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02150","last_updated":"2026-08-05T06:57:37Z","snapshot_observed_at":"2026-08-09T07:46:30.048448Z","submitted_at":"2026-08-03T12:34:31Z","title":"PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T13:43:53.889317Z"},"links":{"cited_paper":"/paper/2503.08879","citing_paper":"/paper/2608.02150"},"observation_digest":"sha256:044e6b6a174300dcc41bd091378d520e5c2de4656f654da1371a15276d808b97","observation_id":"6a029759-f192-4a38-914e-4db5cbbc1b11","resolution":{"observed_at":"2026-08-04T13:43:53.889317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08879","last_updated":"2025-03-11T20:45:02Z","snapshot_observed_at":"2026-08-11T02:55:45.516067Z","submitted_at":"2025-03-11T20:45:02Z","title":"LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08879","snapshot_observed_at":"2026-08-07T00:11:48.941234Z","title":"arXiv preprint arXiv:2503.08879 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02150","last_updated":"2026-08-05T06:57:37Z","snapshot_observed_at":"2026-08-09T07:46:30.048448Z","submitted_at":"2026-08-03T12:34:31Z","title":"PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T00:11:48.941234Z"},"links":{"cited_paper":"/paper/2503.08879","citing_paper":"/paper/2608.02150"},"observation_digest":"sha256:85c77142241d71038ae7e28fa25489658089e42b2569dba1a00ae6f6723fbbec","observation_id":"37373d5c-30a4-429b-82cb-e22d868e4768","resolution":{"observed_at":"2026-08-07T00:11:48.941234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.08879/citation-record","integrity":"/paper/2503.08879/integrity","json":"/paper/2503.08879/citation-record.json","paper":"/paper/2503.08879"},"outbound":[],"paper":{"arxiv_id":"2503.08879","last_updated":"2025-03-11T20:45:02Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T02:55:45.516067Z","submitted_at":"2025-03-11T20:45:02Z","title":"LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2503.08879."}