{"as_of":"2026-08-08T08:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c3a3a0b9d1d35d9c0df0e21ec6788a74ebf4a4b7c0496b39f4fe99201148b963","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:02:06.917838Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T01:46:59.423533Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T07:51:42.929093Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.03762","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03762","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","venue":null,"work_id":"1e8eb8c2-9491-42eb-b824-cc4861d96798","year":2025},"citing_paper":{"arxiv_id":"2605.07234","last_updated":"2026-05-08T04:37:22Z","snapshot_observed_at":"2026-08-06T04:40:19.152385Z","submitted_at":"2026-05-08T04:37:22Z","title":"Reformulating KV Cache Eviction Problem for Long-Context LLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T02:37:52.545943Z"},"links":{"cited_paper":"/paper/2506.03762","citing_paper":"/paper/2605.07234"},"observation_digest":"sha256:346db3ba19daaa20d9b00908e26e0d2d9e6916461b4d031574fb8bf8d5230c8e","observation_id":"695d9391-85af-487c-bb26-f00175624c53","resolution":{"observed_at":"2026-05-11T03:10:53.504555Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.03762","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03762","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","venue":null,"work_id":"1e8eb8c2-9491-42eb-b824-cc4861d96798","year":2025},"citing_paper":{"arxiv_id":"2605.08234","last_updated":"2026-05-07T00:36:59Z","snapshot_observed_at":"2026-07-31T05:45:32.518785Z","submitted_at":"2026-05-07T00:36:59Z","title":"When Does Value-Aware KV Eviction Help? A Fixed-Contract Diagnostic for Non-Monotone Cache Compression","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T01:46:59.423533Z"},"links":{"cited_paper":"/paper/2506.03762","citing_paper":"/paper/2605.08234"},"observation_digest":"sha256:9fe389a1138a6a90a73065b28048acc2023ec0b1c75171f2aa2c6875e0f41cdc","observation_id":"686cfe32-69bb-4571-80c5-46fe8e039912","resolution":{"observed_at":"2026-05-12T07:51:42.940121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03762/citation-record","integrity":"/paper/2506.03762/integrity","json":"/paper/2506.03762/citation-record.json","paper":"/paper/2506.03762"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:02:04.003799Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.003799Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:296dead2692d7de8b8736eeb24e29765e8c45b0cbb530e8988e848ed6909f74a","observation_id":"69dd8e94-b4a0-4211-b58e-49f760feff90","resolution":{"observed_at":"2026-08-07T11:02:04.003799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:11.434817Z","title":null,"venue":null,"work_id":"b81adc1e-a3bb-407a-8995-de07380a273a","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.078300Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:bcdb25d0042e6ec736e05ffb04cb7fdfa9cc36ce53a8bcfddeced21ae06517cc","observation_id":"d8559f0b-88f4-4183-aa06-31c74ca1227d","resolution":{"observed_at":"2026-08-07T11:02:11.464740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:11.364646Z","title":null,"venue":null,"work_id":"821dfdfe-f443-43b9-b477-758da0c8a4b9","year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.119242Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:4736a5e943c4500e0f95cd9d522b44d2e58dd33890a2599a95d0abc50f789586","observation_id":"aabd83b3-cc7b-4e50-9f55-f8802def6024","resolution":{"observed_at":"2026-08-07T11:02:11.390738Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-07T11:02:04.187212Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.187212Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:9a272a8666a210b51553ed634320cd6845746e67f7609333f0e423966a8801b4","observation_id":"1eeb90a9-8fdb-4f11-87d6-34825ff3ebf0","resolution":{"observed_at":"2026-08-07T11:02:04.187212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:11.258969Z","title":null,"venue":null,"work_id":"77fb3123-c21a-4b1b-a1de-56c349062eeb","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.290634Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:7a50f73d25e768ffb04ae7b09784cd826051facffcaf3f45a9847a720371a0de","observation_id":"d83a85ce-42d4-40c1-822c-8ed43563f29f","resolution":{"observed_at":"2026-08-07T11:02:11.313927Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:11.063781Z","title":null,"venue":null,"work_id":"ab3eb925-be23-468c-9d6c-8172de4df245","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.344653Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:a930160f8a02eaca14cb52989c4d59aa296b41072d051be3dd5751327eee94a0","observation_id":"75173bb3-11c8-4430-9adb-a5f15cb29760","resolution":{"observed_at":"2026-08-07T11:02:11.153489Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:10.873696Z","title":null,"venue":null,"work_id":"f15edf64-ccad-4a93-98a8-271de064fbb0","year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.404947Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:aff11637fa9acf523a46dc1dabb8dc44f9cf921bb173bbebb17fea47a96bba56","observation_id":"e347d273-acc3-452f-8b09-474b9172bf9a","resolution":{"observed_at":"2026-08-07T11:02:10.962742Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T11:02:04.492749Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.492749Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:e4abdfcfec2b10d05b8e74f438530e013529d45903a669e5c4f0ab74e04e2ae2","observation_id":"3bfc0555-8c84-4e89-90c8-dd838e462077","resolution":{"observed_at":"2026-08-07T11:02:04.492749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:04.585736Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.585736Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:4332640fb4c44bf46fd6dca5d03575a0b671e17d7d6384ae73bd49e8e543095f","observation_id":"30a325a0-3b98-48b9-ae38-9429ab53e66f","resolution":{"observed_at":"2026-08-07T11:02:04.585736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:10.673541Z","title":null,"venue":null,"work_id":"1203dc71-709f-491c-9e52-111f78c37456","year":2022},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.661844Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:2eed3f80a85f34fcf3295c10ba638157ad04f5da5f7926f3316e7f789614bf78","observation_id":"45e95a16-f62c-443a-b878-f57d3227c1fe","resolution":{"observed_at":"2026-08-07T11:02:10.739655Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:10.382686Z","title":null,"venue":null,"work_id":"6d0d5bf0-f401-4110-b12a-9b3f098c6a5f","year":2019},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.696496Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:bf0d5450f7d694a068339c8841f7b6b9be2835a925dacb81ae250f08379b7a62","observation_id":"ca4ff56c-4d27-45b7-9b94-4a023b1abd88","resolution":{"observed_at":"2026-08-07T11:02:10.532130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:10.225253Z","title":null,"venue":null,"work_id":"3506180b-9ea2-4de8-bdc8-ea6de4cd6772","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.782255Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:62d94d92f7b4fe944c143dfdb0a67066599f0c19d311f75fab776e39e5a42f5e","observation_id":"6502974d-bbd1-4133-a642-7fab82bf8761","resolution":{"observed_at":"2026-08-07T11:02:10.280933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:10.028073Z","title":null,"venue":null,"work_id":"c7cd8267-f63d-49f0-9249-b015a9019a2a","year":2018},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.856867Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:8f704debe418ba1c870f6541a7b21a5395a3359c56fe32c41d436431fa3a682d","observation_id":"c1821fb4-92d2-48d9-9751-cdaba51e04b1","resolution":{"observed_at":"2026-08-07T11:02:10.135312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.876367Z","title":null,"venue":null,"work_id":"bbf755bc-364f-4cfe-a8ef-eed98d5c60f9","year":2021},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.932733Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:0f5f8eabb409cbf7b425504ad36e8c4772d09d93d8da944997f249e841605cda","observation_id":"647faa00-2921-46eb-93b7-bfc513b49462","resolution":{"observed_at":"2026-08-07T11:02:09.937719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.792677Z","title":null,"venue":null,"work_id":"f2a5d8e6-f379-410b-82e0-7f15b87fe5ff","year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.014068Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:923a222f49524bf4f28a2af9682fe9b0bcb4ef6f43a1f321ebcb1abf267a1ce1","observation_id":"dcbd14cb-276b-414b-b22b-170f1f54940a","resolution":{"observed_at":"2026-08-07T11:02:09.861146Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.677731Z","title":null,"venue":null,"work_id":"01dcca40-a23f-4bb6-9116-58eafc1416a7","year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.066980Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:e75d0a54d042ed34e00b71d56b659983e6868050d092a9cf78f7dc4225954704","observation_id":"d053e91e-710e-41bd-b870-1d1f76e48ccd","resolution":{"observed_at":"2026-08-07T11:02:09.737866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.595564Z","title":null,"venue":null,"work_id":"93d24def-0d1e-4c31-8b17-69d2e5134c38","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.127093Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:15e9df5bf9ba5cac4f8adc4f322f7f1b82b9c4c5f497e2819c57742c9413f5d2","observation_id":"9b743bcb-7f80-4ede-9bea-5abdae2d9e1f","resolution":{"observed_at":"2026-08-07T11:02:09.621684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.492613Z","title":null,"venue":null,"work_id":"0660550c-a820-42f4-9b71-ddd3b58ee71f","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.186003Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:bf9ff3ec6eb988487d8b2535c03db578a84520b5789bed419e8e8cd19a61a58a","observation_id":"a9a0313b-6712-4a20-9702-db0ec8c326eb","resolution":{"observed_at":"2026-08-07T11:02:09.538400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.394729Z","title":null,"venue":null,"work_id":"dfa85dc4-3280-4e5c-b9d7-813726b7c04e","year":2019},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.252028Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:88a0d806863076cdef4efb0d1d6fc9e9524fd26f2df9be7443ca931b09097c5c","observation_id":"bfa4c65c-cddd-4c25-b30c-97e4fd02fcd7","resolution":{"observed_at":"2026-08-07T11:02:09.416255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.252751Z","title":null,"venue":null,"work_id":"469744ae-1fd9-4e67-9b26-c9f8cabd2147","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.321429Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:436c870377f0dec86230d6edf8c40a154f10d2b635047f528221856674cde834","observation_id":"5598f046-e2d8-41ee-b20d-47ffd407645f","resolution":{"observed_at":"2026-08-07T11:02:09.297286Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.138300Z","title":null,"venue":null,"work_id":"ce744704-8064-47a4-9a71-2db860e98262","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.371954Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:cee6fadcd9f8cb33d966c7a29a8c8be498340196850a717c08b9b20057246357","observation_id":"9a72b31f-abb7-4d65-8b6a-4ad67e9ce1e8","resolution":{"observed_at":"2026-08-07T11:02:09.180353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08268","last_updated":"2025-02-03T21:47:31Z","snapshot_observed_at":"2026-08-05T16:01:06.026395Z","submitted_at":"2024-02-13T07:47:36Z","title":"World Model on Million-Length Video And Language With Blockwise RingAttention","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08268","snapshot_observed_at":"2026-08-07T11:02:05.405043Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.405043Z"},"links":{"cited_paper":"/paper/2402.08268","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:9f36646a429ae3f31ee9ccc5f4b7ac756e07983fe994f12d926e51e5b1201437","observation_id":"29bf034c-e1ac-4b9e-9c32-faac74261ea5","resolution":{"observed_at":"2026-08-07T11:02:05.405043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.043913Z","title":null,"venue":null,"work_id":"7f5adaec-5d87-4086-b15c-e62154e45898","year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.434756Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:7487651246bfca7c018d276ffe1d188357f115f3dc9cdfe8cd9610063d11a89a","observation_id":"6520c81b-c9da-4760-9f14-80f303bacd70","resolution":{"observed_at":"2026-08-07T11:02:09.103813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.922913Z","title":null,"venue":null,"work_id":"8149cce4-89dd-40cf-9dbc-18f28459d775","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.513189Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:8ad1ed4faf1fc54608fd22ea468e7972773a3ad8615914e14164d8fa1c5cce0a","observation_id":"7dae47b3-0bd9-4acf-8601-1f08fed57a05","resolution":{"observed_at":"2026-08-07T11:02:08.972313Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.847027Z","title":null,"venue":null,"work_id":"865969ea-21d0-4898-a42d-6cc1cc30f9ca","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.580709Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:1f42e38b9caa1e9e52f06e1b785265920dbf71fc9da47945472e36c004c38c3d","observation_id":"83ab0304-5ead-4d1d-b007-c5602ad0e0f8","resolution":{"observed_at":"2026-08-07T11:02:08.881021Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:05.627654Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.627654Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:c4f8781b239a36507f3662159190b910b5bc020c611efb3f9947a96e113a19b6","observation_id":"f5890b33-39d8-4e31-ac62-0e81b2ceced8","resolution":{"observed_at":"2026-08-07T11:02:05.627654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.716457Z","title":null,"venue":null,"work_id":"437bdb19-c23e-4b2f-bd6f-e29642ec92fb","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.692323Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:787cea3f893b247dbdc5deef343cc311f56863552a6372c7042e94f10cc1291c","observation_id":"553e2b68-acd7-44db-8d7d-1e93507fffe5","resolution":{"observed_at":"2026-08-07T11:02:08.761317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.643636Z","title":null,"venue":null,"work_id":"7a3d9ddd-18fe-4fac-b282-b6b6bdd4ad22","year":2018},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.736184Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:b221605dd3568b8ecdad10a9a95722bfd685f372d9884faeeaf37dbb9434f6c8","observation_id":"bd752377-9f6c-4ccc-a8b8-fcd8d0ddd16f","resolution":{"observed_at":"2026-08-07T11:02:08.678823Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06104","last_updated":"2024-06-18T09:16:14Z","snapshot_observed_at":"2026-08-07T11:50:21.011836Z","submitted_at":"2024-01-11T18:35:26Z","title":"Transformers are Multi-State RNNs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06104","snapshot_observed_at":"2026-08-07T11:02:05.812475Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.812475Z"},"links":{"cited_paper":"/paper/2401.06104","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:fd5930f641bc1c5e6d305d398c29ac7c2b46ddb18b6cc230d4f0f929bac0ddf5","observation_id":"c0e8cf90-f4e9-4d22-b575-2d56dd548708","resolution":{"observed_at":"2026-08-07T11:02:05.812475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.525657Z","title":null,"venue":null,"work_id":"c114c3fb-6810-44d3-9b93-ea8d1065d04e","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.888815Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:bc1b22ce1061890bc6849358a2591da374f28014813cfbee9434ba0e693261db","observation_id":"fa281451-1500-4aee-ae33-4f3ffc48bd67","resolution":{"observed_at":"2026-08-07T11:02:08.599149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.395466Z","title":null,"venue":null,"work_id":"6f1ef78d-30d7-4d8e-9a5a-4223450f5638","year":2019},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.944561Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:5566ddbb1d547a6b5336727af8b41e4967be9b01dc28ca0cb5493fd6d9260753","observation_id":"ed973358-054a-466a-8311-5d3d6b1cf73e","resolution":{"observed_at":"2026-08-07T11:02:08.471813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.261596Z","title":null,"venue":null,"work_id":"eefc3772-b5ec-47d9-97ef-1ba437a789a1","year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.965517Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:69b0821a79738e2eff1da9fb543eb7a271f66a9e5ff657f5fb2a5314e098de03","observation_id":"4f10922c-c04a-4c5a-a166-354b5f22962d","resolution":{"observed_at":"2026-08-07T11:02:08.325825Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.186626Z","title":null,"venue":null,"work_id":"eb404934-8e06-4319-87db-3eb7ce3faac6","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.027228Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:aee0c29d486d34e8ee32cef97bdc33c770609b4f6c0ba47387dc288cec8a7b00","observation_id":"c0c83452-0e22-4701-aad2-3330d6e10f76","resolution":{"observed_at":"2026-08-07T11:02:08.209876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:06.102270Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.102270Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:f3b89aa14e32104fd0b28e19c20182e9171297eb461766ffeed40be42ab5248a","observation_id":"374f3778-149e-4d28-a4f8-ba99f657bc62","resolution":{"observed_at":"2026-08-07T11:02:06.102270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.050067Z","title":null,"venue":null,"work_id":"4446530c-9e46-40a0-a341-492eebd1e024","year":2020},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.143858Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:fdeaf598e944bd3bc9ba73ec48e3b9ada4ca5e04286a539d650cf16d286321c9","observation_id":"5590e404-6aa1-4b4e-aded-816a2f228aa6","resolution":{"observed_at":"2026-08-07T11:02:08.103917Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:07.908392Z","title":null,"venue":null,"work_id":"09a67fa4-d9de-4b17-b342-2f69d4f24331","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.218074Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:2888621dc2c4701eb3ba87cdf18d4e878aef97aabbbff7acd3e02d6f68cf3aa2","observation_id":"4827288d-3213-4595-80f2-56837cc95424","resolution":{"observed_at":"2026-08-07T11:02:08.010386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T11:02:06.253737Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.253737Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:5439a1ea0021df5c6762d7f0d3de963b8401e7bb3e3cbb0efc56b902954f6989","observation_id":"021cd0f7-d840-47b3-8c66-3da4436da40f","resolution":{"observed_at":"2026-08-07T11:02:06.253737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T11:02:06.316628Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.316628Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:d02d5e35019e7bf68a5720bd13ae04778e65518f5d90873a665076ed32567a23","observation_id":"278d5873-5cb0-4a49-9743-51503a2c6db3","resolution":{"observed_at":"2026-08-07T11:02:06.316628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:07.802331Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"e25ae95f-ec74-473e-9cab-c37cf9719175","year":2017},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.418454Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:0b299a6058720b80f79dcc9a955eee400d75698120b1ab1e9d07dedac125f1fe","observation_id":"506c2480-27e3-4056-99c5-e9f62e8b0607","resolution":{"observed_at":"2026-08-07T11:02:07.849690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:07.667823Z","title":null,"venue":null,"work_id":"b583ea4f-0adc-4898-b3bc-ef4edfef463a","year":2021},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.439878Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:dc5c9c770dae4e7e2d34c24c4e559bc05ad2c6fe39ebb4d6853d0277248fe58c","observation_id":"1846d53c-b3b9-4f6c-9bc2-48c605c6bd6b","resolution":{"observed_at":"2026-08-07T11:02:07.720267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:07.489135Z","title":null,"venue":null,"work_id":"02a9ff4b-22a5-4bd2-ad03-08cd93f1ae4c","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.518607Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:e33a5accde25bfd26b6be370bf2e87dbd41d7b554de78a1322b1bfddb2680ffe","observation_id":"fe41da30-b4ae-4b58-9377-a0e081c01675","resolution":{"observed_at":"2026-08-07T11:02:07.544416Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:07.364109Z","title":null,"venue":null,"work_id":"a7a25b91-2d49-441c-bfa4-1bd73b3dfd46","year":2021},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.573293Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:075f76d0a59a333227a79a3eb0c88a83ed417027df9fc925ffa35adf147a2a39","observation_id":"ddc8d0ca-50c3-45ef-a434-20a8ff9bf490","resolution":{"observed_at":"2026-08-07T11:02:07.398972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:06.641375Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.641375Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:9a24f4eac84f8496b90345032abf34e2627ba00a6e7e4558676ec40c6d66e132","observation_id":"59ea2b8c-d92c-4212-a389-188e2193faa0","resolution":{"observed_at":"2026-08-07T11:02:06.641375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-07T11:02:06.724922Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.724922Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:25cb0e82cfd73a36bd081013ff58d1b91fe6e781034b7b1b0544dcca0b8f8156","observation_id":"6cda7c7b-bc8c-4d0d-ace8-78f47016516f","resolution":{"observed_at":"2026-08-07T11:02:06.724922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:07.229597Z","title":null,"venue":null,"work_id":"97aefcf4-5016-41f4-91cf-c2cfbce191b9","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.766845Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:30a55b8c6af190acc5c45236e061100056b1edaeaf63f73993de6f4e9bd22774","observation_id":"7774c5cb-9d47-42bb-b53c-feb9af6ff620","resolution":{"observed_at":"2026-08-07T11:02:07.281279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:06.827191Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.827191Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:257297edf942d69d5b465e0efd3df8afcac66debce240874ee84bfa957d64117","observation_id":"ed8a2307-3cca-41af-84fe-97dbe00d64fe","resolution":{"observed_at":"2026-08-07T11:02:06.827191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:06.917838Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.917838Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:ef21d9af62e925504f11f068e8679946c452bddf0014a67dcd31f21039124da3","observation_id":"be8b3cef-6f92-474b-91ab-dd542f32483d","resolution":{"observed_at":"2026-08-07T11:02:06.917838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T10:53:14.591753Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2506.03762."}