{"as_of":"2026-08-19T13:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc5fd01643f608b11b7553db412c27b4322c0313d17febb05f5a28e1354a4a16","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T04:01:07.765689Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.29591/citation-record","integrity":"/paper/2607.29591/integrity","json":"/paper/2607.29591/citation-record.json","paper":"/paper/2607.29591"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:01:06.463399Z","title":"Zefan Cai, Yichi Zhang, Bofei Gao, Yuliang Liu, Yucheng Li, Tianyu Liu, Keming Lu, Wayne Xiong, Yue Dong, Jun- jie Hu, and Wen Xiao","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:06.463399Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:e8600f18698a953fae90c58e0666e6fed71d7604918b66dda48727097b9eee5a","observation_id":"6c8985d8-9433-454f-94cf-dd92124d3cf0","resolution":{"observed_at":"2026-08-03T04:01:06.463399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:01:06.604779Z","title":"Kevin Zhou","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:06.604779Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:e5b46c7f66202fd93ab3db4e75a844987b856019ba99c345a3590e5a54d57343","observation_id":"b5dde2d1-4d27-4350-a072-1ad2de81027b","resolution":{"observed_at":"2026-08-03T04:01:06.604779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-03T04:01:06.710817Z","title":"Yuzhe Gu, Xiyu Liang, Jiaojiao Zhao, and Enmao Diao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:06.710817Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:5ed027266e0e2c3d37b3fb05fb325a998bda3bf3c7faf32176376dda95b07b62","observation_id":"04250c7d-eb6a-406c-ae89-a7b5ae4902e8","resolution":{"observed_at":"2026-08-03T04:01:06.710817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:01:06.837765Z","title":"Yuhong Li, Yingbing Huang, Bowen Yang, Bharat Venkitesh, Acyr Locatelli, Hanchen Ye, Tianle Cai, Patrick Lewis, and Deming Chen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:06.837765Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:160e64b600104dfe1d1a5d4cb3fffd437285d3c0ef55cd18a7d17829cc5f4c32","observation_id":"7908712c-2f11-4d07-9811-f1231b6e1fd5","resolution":{"observed_at":"2026-08-03T04:01:06.837765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10516","last_updated":"2024-12-31T07:11:00Z","snapshot_observed_at":"2026-08-17T15:34:12.654681Z","submitted_at":"2024-09-16T17:59:52Z","title":"RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10516","snapshot_observed_at":"2026-08-03T04:01:06.893261Z","title":"URL https://arxiv.org/ abs/2409.10516","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:06.893261Z"},"links":{"cited_paper":"/paper/2409.10516","citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:6e4348b6f5db86d0737c1fab796c66cd93c15da6af61dd69080ecdc691774b85","observation_id":"5b8ca242-c574-4053-a4fd-bab8a61c873c","resolution":{"observed_at":"2026-08-03T04:01:06.893261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17118","last_updated":"2023-08-28T22:48:46Z","snapshot_observed_at":"2026-08-16T15:29:12.941440Z","submitted_at":"2023-05-26T17:39:58Z","title":"Scissorhands: Exploiting the Persistence of Importance Hypothesis for LLM KV Cache Compression at Test Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17118","snapshot_observed_at":"2026-08-03T04:01:06.957435Z","title":"Zirui Liu, Jiayi Yuan, Hongye Jin, Shaochen Zhong, Zhaozhuo Xu, Vladimir Braverman, Beidi Chen, and Xia Hu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:06.957435Z"},"links":{"cited_paper":"/paper/2305.17118","citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:c53091006f0044cc1b2e06e504ba0cfdea9018bb02742fdf235c1da8bfda91a5","observation_id":"17a8bfe0-40ed-42a5-ac19-8c2c133a793b","resolution":{"observed_at":"2026-08-03T04:01:06.957435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:01:07.159249Z","title":"Ying Sheng, Lianmin Zheng, Binhang Yuan, Zhuohan Li, Max Ryabinin, Beidi Chen, Percy Liang, Christopher Ré, Ion Stoica, and Ce Zhang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:07.159249Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:7dbc74fcf25f106501e04169dd20f20e66c56cf8457b5360b562ca5a5c0cfdc5","observation_id":"30da75b1-0d2b-43d5-8276-2d956b6b753b","resolution":{"observed_at":"2026-08-03T04:01:07.159249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:01:07.083650Z","title":"Akshat Sharma, Hangliang Ding, Jianping Li, Neel Dani, and Minjia Zhang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:07.083650Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:c0c38527c3fcc8f8395e1558f940e215589d4cb80a8463c44ad4519f3cc82d53","observation_id":"e499445a-af95-4146-8df9-3c5a19beaaea","resolution":{"observed_at":"2026-08-03T04:01:07.083650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v40i39.40611","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ashish Vaswani, Noam Shazeer, Niki Parmar, Jakob Uszko- reit, Llion Jones, Aidan N","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"fea94e3f-19db-4e19-80a4-34fc06b6e7eb","year":null},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:07.217247Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:dca95bd2318f3aa8a0a8db486ad8a748eb598bde15f073d0be1191a2c9223add","observation_id":"4b6237bd-db0e-41a9-8fe5-1249765a7bd2","resolution":{"observed_at":"2026-08-03T04:03:19.490892Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-10T21:08:10.963923+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T21:08:10.963923+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:01:07.361473Z","title":"Guangxuan Xiao, Yuandong Tian, Beidi Chen, Song Han, and Mike Lewis","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:07.361473Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:a17cc31cc336ba4c501ce38be48b16089a8a437856ececf74c2782dbb37bc7b6","observation_id":"319cb2bf-19f6-4458-acd3-27d049dae6ea","resolution":{"observed_at":"2026-08-03T04:01:07.361473Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-03T04:01:07.512531Z","title":"WeihaoYang,HaoHuang,NingkeLi,ShihaoWang,Darong Yang, Yanqi Pan, Wen Xia, Shiyi Li, and Xiangyu Zou","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:07.512531Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:da4a0bf06ed957c6c14bcb9c325067ccc7646ebbe8df7a9205d91ecdd782bc13","observation_id":"99a5cab0-db0d-4d82-a4e3-55ae5c4b7054","resolution":{"observed_at":"2026-08-03T04:01:07.512531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:01:07.606046Z","title":"Dy- namicKV: Task-aware adaptive KV cache compression for long context LLMs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:07.606046Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:dc26f087ca8df33d2abfe8aa1e7e7c2e3e6c3e39809bb9cb3b374bd9d454ff5a","observation_id":"a6a18f0d-309a-4115-8cb7-75c1f40e1755","resolution":{"observed_at":"2026-08-03T04:01:07.606046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:01:07.765689Z","title":"It does not refresh resid- ual entries during long generation","venue":null,"work_id":null,"year":2042},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:07.765689Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:ce744467e46c6e51610ed79b140c37b08508d8dccb7f18698a48b192c5b5c504","observation_id":"089b1635-ff3c-4b74-b5d0-6f31a7214040","resolution":{"observed_at":"2026-08-03T04:01:07.765689Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:01:07.021827Z","title":"Matanel Oren, Michael Hassid, Nir Yarden, Yossi Adi, and Roy Schwartz","venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":1982,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:07.021827Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:06c5f0f0f160044cfa497b40a7d68d5735a7b73ee9e964df54d127788cee7f85","observation_id":"59d00a57-fd3b-4ae2-9a3f-4f9ea748e506","resolution":{"observed_at":"2026-08-03T04:01:07.021827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08454","last_updated":"2024-07-21T02:37:11Z","snapshot_observed_at":"2026-08-18T15:25:17.604519Z","submitted_at":"2024-07-11T12:50:42Z","title":"Model Tells You Where to Merge: Adaptive KV Cache Merging for LLMs on Long-Context Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08454","snapshot_observed_at":"2026-08-03T04:01:07.281094Z","title":"Modeltellsyouwheretomerge:AdaptiveKVcachemerging forLLMsonlong-contexttasks,2024.URLhttps://arxiv.org/ abs/2407.08454","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:07.281094Z"},"links":{"cited_paper":"/paper/2407.08454","citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:88ae074a7ead94f65ff9672301adad4d681ba3c669724d6b86725f6d44e6e92f","observation_id":"661f7766-eea3-4edc-b1ba-88b393d8f8a2","resolution":{"observed_at":"2026-08-03T04:01:07.281094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:01:06.356986Z","title":"Yushi Bai, Xin Lv, Jiajie Zhang, Hongchang Lyu, Jiankai Tang,ZhidianHuang,ZhengxiaoDu,XiaoLiu,AohanZeng, LeiHou,YuxiaoDong,JieTang,andJuanziLi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:06.356986Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:49de5c88f7660de25f2f7e8a135473554df4d873e3e61f95a6303a9974928bdd","observation_id":"213a96d8-1977-4384-b902-6c268b182174","resolution":{"observed_at":"2026-08-03T04:01:06.356986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:01:06.252317Z","title":"GQA: Training generalized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:06.252317Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:b768d02eb0110908ffb7555ed392394a0e0fa16aadc4f235cf918fb6ee5bad2f","observation_id":"4903016c-aca1-458a-b298-a68e0b989d18","resolution":{"observed_at":"2026-08-03T04:01:06.252317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:01:06.772697Z","title":"Hao Kang, Qingru Zhang, Souvik Kundu, Geonhwa Jeong, Zaoxing Liu, Tushar Krishna, and Tuo Zhao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-03T04:01:06.772697Z"},"links":{"citing_paper":"/paper/2607.29591"},"observation_digest":"sha256:14f7be969e785e2a2cfa761b09d9d4d0396c171815a3eaa02818e414ad55287d","observation_id":"f42ac9e8-1ed4-4e64-bee0-3d06de7a349d","resolution":{"observed_at":"2026-08-03T04:01:06.772697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.29591","last_updated":"2026-07-31T16:16:45Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T19:50:31.491263Z","submitted_at":"2026-07-31T16:16:45Z","title":"ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2607.29591."}