{"as_of":"2026-08-17T01:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:be5d85d285b89fefcfa4a4cea4140e7c48b5c43722ba285e1b4d0b96a0fcb710","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T17:52:00.853897Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09412/citation-record","integrity":"/paper/2608.09412/integrity","json":"/paper/2608.09412/citation-record.json","paper":"/paper/2608.09412"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.173244Z","title":null,"venue":null,"work_id":"c62f3414-58f2-4b44-8568-bd5ff17744ae","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.591998Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:33cea46e2730185c3fce660d135eff65fdbd3cd359da0e8f449c8b269fdda862","observation_id":"f6d9a7d5-758a-43e9-bec4-6a5a8346171e","resolution":{"observed_at":"2026-08-11T17:52:02.178979Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.597747Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.597747Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:75e7050a64f9d1615ea4aec07594537c18ee676edbc497d55e2381c560742993","observation_id":"39a06924-9fcc-4274-a33f-eef2fa3a84e4","resolution":{"observed_at":"2026-08-11T17:52:00.597747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-08-13T04:39:30.300015Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-11T17:52:00.602800Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.602800Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:74562614f5a4feb922dc8f011557bcf0f97c222b0c8db02c85a8c7b31b25b874","observation_id":"7ee61a46-2ccc-4785-86ac-c54d5c6a1878","resolution":{"observed_at":"2026-08-11T17:52:00.602800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.156090Z","title":"Abdelfattah, and Kai- Chiang Wu","venue":null,"work_id":"a2cbacc6-9407-469b-91f5-b6f820af2974","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.608578Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:c538927d13775d2a9ced777a9bc6dc7a39a8c00c14ae636961bd03fb07352850","observation_id":"21b5b955-6db3-42b5-882f-8ecd89b493ac","resolution":{"observed_at":"2026-08-11T17:52:02.161405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.acl-long.1926","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.255890Z","title":null,"venue":null,"work_id":"57885ad5-5f8c-4d05-8c4e-be9dafbee444","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.613526Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:d9a538aa8c66a111cc56ea56faebc34ff73ebb20181a91ff88640bbf94d35f53","observation_id":"8a2d07e9-aaa8-42f7-96ff-0ee031729318","resolution":{"observed_at":"2026-08-11T17:52:01.262026Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2602.05929","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.235614Z","title":null,"venue":null,"work_id":"e40e2ff8-ed67-46fe-87b3-da7fd84d99f6","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.618876Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:07d01089ce20c1202cedf62874f37b863264ade70825afe5bc57556dfb4da3a4","observation_id":"9d8b0e76-0b55-4917-bfe4-7d977e81b7ad","resolution":{"observed_at":"2026-08-11T17:52:01.243790Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.139931Z","title":"Smith, and Matt Gard- ner","venue":null,"work_id":"4bfd81c6-2883-4e34-9943-82f966dd6a0f","year":2021},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.624432Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:350b0b90c5c839cd5194e8a5c695689e07fed06137b612e13b0d4871e3ae762d","observation_id":"7686fdba-16ed-46da-b59e-936bf90d41a0","resolution":{"observed_at":"2026-08-11T17:52:02.145125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.629188Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.629188Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:05e4a100d5a8b7d1b140856409f74c1b8f1afc9f26dad79402dee5384ea2d5d0","observation_id":"5b5078d5-99b3-4997-b32d-dbae46ac4ef8","resolution":{"observed_at":"2026-08-11T17:52:00.629188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2606.15157","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.167976Z","title":null,"venue":null,"work_id":"d60e0e20-92da-4919-9177-4baad31d53d1","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.633932Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:cf3e56c28bb25435e63daf1f1622ddf5b1ea5a59517b14a20ee83ec95d6b8be0","observation_id":"60f11893-714a-4efd-9e6a-adb2b5d3a40c","resolution":{"observed_at":"2026-08-11T17:52:01.172892Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.20732","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.631141Z","title":null,"venue":null,"work_id":"536ca2f9-10ce-45e3-8c66-c7a71613b7d4","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.638825Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:9ec286cb0c1279218707502964efd134cd4a657393ae92dc3067d14acd14ec7e","observation_id":"f9de44c1-b5fc-4423-a18c-83da59d1b521","resolution":{"observed_at":"2026-08-11T17:52:01.640627Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.123255Z","title":null,"venue":null,"work_id":"d51fd9a3-cb72-4bb8-a6fa-87195f8aab51","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.643670Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:bdac45d9bb794e5dbf37c6219b6260fb5e3f64a5e87b52bc869a2b1193ecea2f","observation_id":"69b154ee-ce49-48c7-9b89-6aa06e59e4a5","resolution":{"observed_at":"2026-08-11T17:52:02.128387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.105433Z","title":null,"venue":null,"work_id":"5bb0d42b-b414-4798-8834-4f82762a56af","year":null},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.648755Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:fa3f688acaf439575befd25537d369c420fc9f18a9bf8005c7702a27ac936048","observation_id":"d4a27c5a-ca9b-45f7-ac66-36a29b08181f","resolution":{"observed_at":"2026-08-11T17:52:02.111065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.073292Z","title":null,"venue":null,"work_id":"71c90b43-7dec-477c-91d6-11db86ca863a","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.658852Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:699dab94b4b1cb99037e5f8fa81fc924abb46bb1620bbc7893d903c6b4dcd90d","observation_id":"214ddf50-703b-4ad0-bd55-b8bec102c4c5","resolution":{"observed_at":"2026-08-11T17:52:02.078320Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.057683Z","title":null,"venue":null,"work_id":"d31ffd03-f2fa-41d9-bbb9-8f0e6735963f","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.663686Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:5e3918fdc2cf76a43ac8d62e3bb732765c9950abe039b9cf924df5e4980f24ff","observation_id":"5b3a4406-4eec-4402-8296-24d70e33fe8b","resolution":{"observed_at":"2026-08-11T17:52:02.062449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.05971","last_updated":"2026-05-12T06:42:09Z","snapshot_observed_at":"2026-08-15T03:37:56.193816Z","submitted_at":"2026-05-07T10:17:55Z","title":"Training Transformers for KV Cache Compressibility","version":2},"cited_work":{"arxiv_id":"2605.05971","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.05971","snapshot_observed_at":"2026-08-11T17:52:01.544986Z","title":"Training Transformers for KV Cache Compressibility","venue":"cs.LG","work_id":"53d57f8a-8905-481e-b214-72ca0bc7ff11","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.668293Z"},"links":{"cited_paper":"/paper/2605.05971","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:11e3b49b624fbcb077c679ab6a0344382cef90b16bb132ff6cde314c6151f13f","observation_id":"09fc84c6-e45f-4a11-8b1e-aa4bcd7af639","resolution":{"observed_at":"2026-08-11T17:52:01.550202Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02812","last_updated":"2025-03-04T17:37:49Z","snapshot_observed_at":"2026-08-16T12:53:08.015543Z","submitted_at":"2025-03-04T17:37:49Z","title":"Q-Filters: Leveraging QK Geometry for Efficient KV Cache Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02812","snapshot_observed_at":"2026-08-11T17:52:00.673157Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.673157Z"},"links":{"cited_paper":"/paper/2503.02812","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:a2e72798958dc1139a7607c528702960164e3338569fbc31530c244338cbb931","observation_id":"32dafbc3-72d2-44ff-bf79-73d8ae30ff45","resolution":{"observed_at":"2026-08-11T17:52:00.673157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.041681Z","title":null,"venue":null,"work_id":"900b2974-e1b8-46a5-bde0-ad3afa9e52ed","year":null},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.682557Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:5190ef03eecc3bff69120361f8cfe8d5037a8c9d3e3bc87d78beac25e6b47e80","observation_id":"1015d19f-d30b-48fb-987e-5b420f2e80d7","resolution":{"observed_at":"2026-08-11T17:52:02.046638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.692014Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.692014Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:7cdde58a60298982b075e90257a04d3c113cc49f971a732fd71e432667feeb65","observation_id":"bb137bff-d39f-463e-9c0d-86c72e4d0c58","resolution":{"observed_at":"2026-08-11T17:52:00.692014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-08-15T18:01:46.669862Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-11T17:52:00.696471Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.696471Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:3b11d1f82617087371ab851bea68453f29a0605b1076b7acd81e3c628d266378","observation_id":"3215d4c3-c212-4ad1-9bfe-7ae360d8e8d5","resolution":{"observed_at":"2026-08-11T17:52:00.696471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.015144Z","title":null,"venue":null,"work_id":"e980937b-4fb4-4b27-99b9-5cdf32a09c34","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.701492Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:9855f7614748766378b2f0a8625c042058a3399334be5eb6d679127319f1b8d9","observation_id":"7911ba13-0e3d-4f50-a790-77e3cefaa519","resolution":{"observed_at":"2026-08-11T17:52:02.020089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.706070Z","title":"Chen, Xu Yuan, Ye Jia, Jiancheng Tu, Chen Li, Peter H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.706070Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:75f392b887289c6f33bee7cb9894f6ddaf76d8a066c932f32bfd2caf03272b8f","observation_id":"336f42a1-9b0b-4695-8ea0-2ffa1a81c9b5","resolution":{"observed_at":"2026-08-11T17:52:00.706070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.999170Z","title":null,"venue":null,"work_id":"6760b1df-b2d3-4f03-87d1-bdced41d3d8e","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.710682Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:af000b43053f230adf980918d6f8df453aef98b98e6eb6e8e19f7fb7a81f0c15","observation_id":"7749c6b9-f664-4d8a-9fa7-d5f82cb30657","resolution":{"observed_at":"2026-08-11T17:52:02.004432Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.983206Z","title":null,"venue":null,"work_id":"beac098e-df5e-478e-8dd2-7b611bb3c5d4","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.715122Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:32094296fc5502deb6ec58d409c3ca3121b44e7f922503d69e41c5bfc72fc9b4","observation_id":"fe32416e-5fc2-4c28-b105-721bba83c045","resolution":{"observed_at":"2026-08-11T17:52:01.988164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19442","last_updated":"2025-07-30T05:24:46Z","snapshot_observed_at":"2026-08-15T13:24:51.697670Z","submitted_at":"2024-12-27T04:17:57Z","title":"A Survey on Large Language Model Acceleration based on KV Cache Management","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19442","snapshot_observed_at":"2026-08-11T17:52:00.719577Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.719577Z"},"links":{"cited_paper":"/paper/2412.19442","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:eacaeac3d022c6d33a720322ef4a112b14170a46dad15aea582d91d982a4f239","observation_id":"f4dda250-f2ae-49df-91ed-478f5276c0c8","resolution":{"observed_at":"2026-08-11T17:52:00.719577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.967469Z","title":null,"venue":null,"work_id":"79560173-dab5-423a-a483-6546e7aa43c9","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.724717Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:25a9973b134adb71f2ce0f5b0c026f94feeb7c8536e52b95123e7acad7f7b035","observation_id":"ebd34dea-cb6f-491b-a923-1a740c145c59","resolution":{"observed_at":"2026-08-11T17:52:01.972153Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.729147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.729147Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:ffaafb5efa094ebc56c8b3dd29acf7c50c3c0e58791feaf5bdbd66099d084144","observation_id":"e9a0b598-acf4-490e-9e9f-696d089044e8","resolution":{"observed_at":"2026-08-11T17:52:00.729147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.941423Z","title":"Abdi, Dongsheng Li, Jianfeng Gao, Yuqing Yang, and Lili Qiu","venue":null,"work_id":"978d9c01-0f99-4139-8725-bdac63cf30ac","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.733662Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:5fad092a8a1ba05b206b831f780a4847e8961a38487596b66e13821b573e31c6","observation_id":"99f9ccab-2c6d-4331-aba3-97cfeaa11f87","resolution":{"observed_at":"2026-08-11T17:52:01.946410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.737885Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.737885Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:64aad0d50ac58fee5175e2466838e95c57270fe9d25164934a76a97adb643223","observation_id":"3264191e-8390-4b4c-9542-9872bc4da201","resolution":{"observed_at":"2026-08-11T17:52:00.737885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.742196Z","title":"Liu, Kevin Lin, John Hewitt, Ashwin Paranjape, Michele Bevilacqua, Fabio Petroni, and Percy Liang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.742196Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:edb03664278e201cb58ce328df5acd6b2162528d827e6d4fb63dbc404554122d","observation_id":"385cb84a-50cf-4462-a3ff-bf5f10eb0813","resolution":{"observed_at":"2026-08-11T17:52:00.742196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.925341Z","title":null,"venue":null,"work_id":"b2068c41-c146-4d50-a763-2a764adabc02","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.746552Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:7a0d56899428467be24f02ac73f7bcff671c77e4c3f0e0fe135444519333c703","observation_id":"e6a2c16b-6a3e-457a-b269-8a212c70f3ec","resolution":{"observed_at":"2026-08-11T17:52:01.930185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.751071Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.751071Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:b5d3daf9d4e782c7d0ecb2391c94a0af802df41a83ea29c35e6c76f9ab7e46d6","observation_id":"2fb0ec03-a93b-448f-95eb-7bcc642d504c","resolution":{"observed_at":"2026-08-11T17:52:00.751071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.755719Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.755719Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:c66ac54708b06f47e6033e9fa70ef51ecd8de1e58319acd66436573ed6c33300","observation_id":"2a89d93a-118d-4654-a627-33378b431fb0","resolution":{"observed_at":"2026-08-11T17:52:00.755719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.898417Z","title":null,"venue":null,"work_id":"6e6dbc74-1177-4e85-8233-ffca6bf70ef1","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.760572Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:de103d49693c3b63cb58997719d4981b19a76ed4d2267eb96a249dca1d6472fc","observation_id":"ff4a6c3c-f10e-4e03-8140-11176d46aa03","resolution":{"observed_at":"2026-08-11T17:52:01.903589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.882527Z","title":null,"venue":null,"work_id":"fc608d16-50dc-4b78-a67b-75ef137dd2e4","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.765260Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:987febb1ab74e81672bbc7e32729215f379bb7a42c594a62da9938c3898c3345","observation_id":"d2a9eb06-7a27-4450-a67c-2528fe7e4574","resolution":{"observed_at":"2026-08-11T17:52:01.887832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.866098Z","title":null,"venue":null,"work_id":"ad97c503-3c77-47bd-babb-c091d8448f29","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.769737Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:d96b2b9cdee6e2a56d041c3200d00a4fff0e82a4b716f1400d4bc01397b99248","observation_id":"7b9f5e3b-3c1b-455d-bb6b-9b1a106abc1a","resolution":{"observed_at":"2026-08-11T17:52:01.870839Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.849835Z","title":null,"venue":null,"work_id":"62e88407-e92e-45b9-a14d-9c7762a370af","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.774730Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:55a85e30358d4388803e436a59227699dae4a34007d02cadc9f12fd272412ac0","observation_id":"e85d80fb-4907-4188-97a7-9da3c6498c7e","resolution":{"observed_at":"2026-08-11T17:52:01.854789Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.779497Z","title":"Morse, Raghavv Goel, Mingu Lee, and Chris Lott","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.779497Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:3d182f2a7201c382a6fc53abd6410a9d519b50726680e8f9f019008c8d022cc7","observation_id":"c7cbfa17-cb4a-4bbe-8255-102aaa859061","resolution":{"observed_at":"2026-08-11T17:52:00.779497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.00024","last_updated":"2026-06-15T19:01:17Z","snapshot_observed_at":"2026-08-01T17:09:48.094858Z","submitted_at":"2026-04-15T06:55:14Z","title":"ART: Attention Run-time Termination for Efficient Large Language Model Decoding","version":3},"cited_work":{"arxiv_id":"2606.00024","doi":"10.48550/arxiv.2606.00024","metadata_source":"pith","pith_arxiv_id":"2606.00024","snapshot_observed_at":"2026-08-11T18:16:15.004306Z","title":"ART: Attention Run-time Termination for Efficient Large Language Model Decoding","venue":"cs.CL","work_id":"2415bee6-c4de-4ada-ba48-79185d73f0ec","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.784007Z"},"links":{"cited_paper":"/paper/2606.00024","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:680d2bfc42359688047ac2fc5a2264d996fe98d75f794cbe20124399ede9246c","observation_id":"a5036285-a570-45d5-812d-d9309f67bd33","resolution":{"observed_at":"2026-08-11T17:52:00.952075Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-11T17:52:00.789323Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.789323Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:26f7ff0b5372931f4ed88c983c217f165aecfd95530677733f017ec3d5da374f","observation_id":"d06336bb-2546-4dcd-bc09-b78a920259cd","resolution":{"observed_at":"2026-08-11T17:52:00.789323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18003","last_updated":"2024-11-20T02:04:10Z","snapshot_observed_at":"2026-08-16T13:31:06.995791Z","submitted_at":"2024-07-25T12:56:22Z","title":"Keep the Cost Down: A Review on Methods to Optimize LLM' s KV-Cache Consumption","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18003","snapshot_observed_at":"2026-08-11T17:52:00.794462Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.794462Z"},"links":{"cited_paper":"/paper/2407.18003","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:027bd88b1a7e37d398279ef284d7f3739d0d8bda92eb70918ac5dbc8aaccc806","observation_id":"7f9d27ab-a6ec-4cb4-b4e3-a59308de6cc1","resolution":{"observed_at":"2026-08-11T17:52:00.794462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.833305Z","title":null,"venue":null,"work_id":"723090f3-a5cd-46bd-96e3-8b0ed8a1e67f","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.799907Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:94ed0d030fd18e56d14676e1143ccf538cc77c7bfd71f1f1d1b8b5d19a96569d","observation_id":"62a917c2-e99f-4a25-a52a-55cc9ff99cb9","resolution":{"observed_at":"2026-08-11T17:52:01.838218Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.804951Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.804951Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:82a6df226f08e0544b6810d12150d8d47cb11d9039e2918eb92d3dc8f83ae0dc","observation_id":"4b6f066d-c2d6-40cc-9913-782044485626","resolution":{"observed_at":"2026-08-11T17:52:00.804951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.817138Z","title":null,"venue":null,"work_id":"458d773c-f515-43d6-b920-935623ff62fb","year":null},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.809615Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:15dfc043054b608b548b42cff29512956bc0fa9d33e5d0967752f558229a6727","observation_id":"24d49b3b-a39b-415d-8f7d-7ab17348e3c3","resolution":{"observed_at":"2026-08-11T17:52:01.821987Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.784452Z","title":null,"venue":null,"work_id":"40931b39-46bd-4f64-b8af-f57e0c8b15e3","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.819288Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:f3f5c12294094796e023dae5b352f348a8fa14568bfd1dceeabdeab78835bf34","observation_id":"61a82812-6e7a-4328-97f0-7b35c4c9ec57","resolution":{"observed_at":"2026-08-11T17:52:01.789605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.768442Z","title":null,"venue":null,"work_id":"38d07e63-22d2-471f-9548-fec70f15894b","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.824210Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:19745b75e58ca420e246ecd038723227b3c43742b63aaa99010263fe95edd385","observation_id":"8458a00c-6d92-4100-a3d6-e37af2500a68","resolution":{"observed_at":"2026-08-11T17:52:01.773581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.800431Z","title":"InProceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":"6d5b35d0-29ad-4414-b5e7-c5bb890b8239","year":null},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.814430Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:3922973875037a5c76be3b4ad2f75346074a963de264c83de99758a561583591","observation_id":"d5c3beb0-2d98-42a6-bf15-b2c617a37287","resolution":{"observed_at":"2026-08-11T17:52:01.805727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.833700Z","title":"Cohen, Ruslan Salakhutdinov, and Christopher D","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.833700Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:c897e109cc4c2f26d709d0718b158a4ba9ab2bd1dea300db1845c4d44e7728bb","observation_id":"04791667-0b41-4b96-b68c-2b7a63f7565f","resolution":{"observed_at":"2026-08-11T17:52:00.833700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.838505Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.838505Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:0e7a69b64892bca174ff17ece52c282b1bca2ef2d4760e928eed973c732d0315","observation_id":"64803089-c290-42ef-93e3-2c25eead7c1d","resolution":{"observed_at":"2026-08-11T17:52:00.838505Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18096","last_updated":"2024-02-28T06:34:54Z","snapshot_observed_at":"2026-08-16T14:14:39.490675Z","submitted_at":"2024-02-28T06:34:54Z","title":"No Token Left Behind: Reliable KV Cache Compression via Importance-Aware Mixed Precision Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18096","snapshot_observed_at":"2026-08-11T17:52:00.828953Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.828953Z"},"links":{"cited_paper":"/paper/2402.18096","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:116918d8cb62df008bc7072d6d6868442b1837317090fdb80c41386826468fa6","observation_id":"612c7258-afb4-4260-998a-ac8de40bc375","resolution":{"observed_at":"2026-08-11T17:52:00.828953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.848881Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.848881Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:a4238a15919f8847652f8ede77a367dad55264109ba97165baa7c6f6c6fbb556","observation_id":"d9ec162f-6706-4f4c-8a22-2dc40b3583e8","resolution":{"observed_at":"2026-08-11T17:52:00.848881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.739428Z","title":null,"venue":null,"work_id":"aa4a3daa-3ab7-4ac9-959b-593e843878fa","year":2023},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.853897Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:fff8b065d5f0a0791c92d9de3973087fec60ce668001b433c9c95eeaa3468310","observation_id":"39bf2860-f209-48d0-9008-dc551e3f7e2b","resolution":{"observed_at":"2026-08-11T17:52:01.744592Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12820","last_updated":"2025-03-30T08:13:50Z","snapshot_observed_at":"2026-08-17T00:49:15.253403Z","submitted_at":"2024-07-01T13:05:42Z","title":"PQCache: Product Quantization-based KVCache for Long Context LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12820","snapshot_observed_at":"2026-08-11T17:52:00.843537Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.843537Z"},"links":{"cited_paper":"/paper/2407.12820","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:a1b5affc5f9b7c1a44eaaa0ffc11157e3fb7ad781130a6ae443440d354a3119d","observation_id":"f6ad7cb2-0fcd-4e4f-afbe-d48e76cc5981","resolution":{"observed_at":"2026-08-11T17:52:00.843537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-2181","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.094695Z","title":"https://doi.org/10.52202/079017-2181","venue":null,"work_id":"56725eef-9e64-45a6-bb0b-ebc83db050e8","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.687433Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:34105270e3aa0098be2f0e0d71b09042689efe7c96c3b0afee71b8d56c030ccf","observation_id":"47c75fc6-fd45-43e0-87cb-ccc0e7dc592a","resolution":{"observed_at":"2026-08-11T17:52:01.100081Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.088875Z","title":"InInternational Conference on Learning Representations","venue":null,"work_id":"b787a9c0-467b-495a-9ece-0ea55235f736","year":null},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.653874Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:0e4c8560754aeb25a3370799bdced6aefce8dc7a07fed894b4f1634140361dcc","observation_id":"a7913608-c8d7-4a10-a7ad-191f2595d70a","resolution":{"observed_at":"2026-08-11T17:52:02.093950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-16T05:29:15.490394Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":7,"verified_fuzzy":5},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2608.09412."}