{"as_of":"2026-08-11T01:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:39d28c0cca0930e14ba401c582caf5007bd4807c12eebaeed038531e32b36d65","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:44:35.835963Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06849/citation-record","integrity":"/paper/2608.06849/integrity","json":"/paper/2608.06849/citation-record.json","paper":"/paper/2608.06849"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.642890Z","title":"arXiv preprint arXiv:2602.03560 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.642890Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:1d8d6a35c88de9b38a987cdba435df395f44721cb3defbe4424561568435269d","observation_id":"2baa8a96-9d7a-421d-846b-eb1b1f0ebc28","resolution":{"observed_at":"2026-08-10T19:44:35.642890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:36.865614Z","title":"DuoAttention: Efficient Long-Context LLM Inference with Retrieval and Streaming Heads , url =","venue":null,"work_id":"9f278237-ea5d-4ec5-b8de-e358a9db1038","year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.650022Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:143c48b90be961fbbacfd02df0d85d3070254e2a74de07aa02c2dc4ac70358a7","observation_id":"786adb56-7bab-40c8-acd0-077e75c335b8","resolution":{"observed_at":"2026-08-10T19:44:36.869167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.654506Z","title":"arXiv preprint arXiv:2602.04541 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.654506Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:481b27831ec40cfdfe04d5a59867e5767e426d75567ff452a47eef1a3120b80a","observation_id":"cda04c08-d434-4f83-8b1e-f790187b437e","resolution":{"observed_at":"2026-08-10T19:44:35.654506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.658664Z","title":"arXiv preprint arXiv:2512.16391 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.658664Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:d0c6040b4dc37c89d71a3663bea421151db8e6beb6fc1661be7a3b31b7844586","observation_id":"5377e7a1-0dae-4a69-a803-9f316acf1822","resolution":{"observed_at":"2026-08-10T19:44:35.658664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:36.852157Z","title":"TidalDecode: Fast and Accurate LLM Decoding with Position Persistent Sparse Attention , url =","venue":null,"work_id":"3d5a5a4f-0fed-408a-aa23-d666ec60799e","year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.663161Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:d4b478094fceb72787d15f7b22bd932897376cb30494b263b4e67fe0cbad619f","observation_id":"251ce26f-15bf-4f23-b341-74b4f142b2cc","resolution":{"observed_at":"2026-08-10T19:44:36.857109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.668007Z","title":"arXiv preprint arXiv:2603.12201 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.668007Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:0d00774dd3feab7fa47a3fe3d0f0eafc1175f2f1fbb5cc99bd3c56da63d2f208","observation_id":"34cb0297-2d70-4e6e-8930-d50cc24d0c26","resolution":{"observed_at":"2026-08-10T19:44:35.668007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-07-31T23:49:25.878472Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-10T19:44:35.672325Z","title":"2: Pushing the Frontier of Open Large Language Models , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.672325Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:e534773ec7b7ad75832f19717a45a698fd1e41923ee599df287f6b76056db2ca","observation_id":"fcc684d6-1fac-43a8-a417-ea18ce4da16a","resolution":{"observed_at":"2026-08-10T19:44:35.672325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.675906Z","title":"arXiv preprint arXiv:2603.13314 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.675906Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:e9484eb3c9dc74a4080dcfeb52b2986327989277b2071cd1c40211040aafb696","observation_id":"7bcf13e1-0960-4e5a-beec-6ceb664bb4a8","resolution":{"observed_at":"2026-08-10T19:44:35.675906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-10T19:44:35.679427Z","title":"arXiv preprint arXiv:2412.15115 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.679427Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:e1b1c5e1dcbf46979d39c5eb4dba80103198350434f2f7e414e526344187e5c0","observation_id":"5382df52-881f-4cc6-bf0d-ca7890dd6284","resolution":{"observed_at":"2026-08-10T19:44:35.679427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.26692","last_updated":"2025-11-01T12:05:18Z","snapshot_observed_at":"2026-08-07T19:30:34.681869Z","submitted_at":"2025-10-30T16:59:43Z","title":"Kimi Linear: An Expressive, Efficient Attention Architecture","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.26692","snapshot_observed_at":"2026-08-10T19:44:35.683757Z","title":"arXiv preprint arXiv:2510.26692 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.683757Z"},"links":{"cited_paper":"/paper/2510.26692","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:fe9961c4a53f3b52eb4c9ba23c0b61a0f0c6168f5ed435e9a3b949f9699d6564","observation_id":"f2e1a930-1fad-4aca-be04-64ecf0be25bd","resolution":{"observed_at":"2026-08-10T19:44:35.683757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:36.837133Z","title":"https://www.anthropic.com/engineering/building-effective-agents , year=","venue":null,"work_id":"833aedc4-f0d5-454a-a49a-c0a6aaff52fc","year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.687863Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:bc1a7cc410db331000c46a89e372a621329982f2a5549c4c6860a165fd4df6f8","observation_id":"60b204c8-0da1-43dd-96bf-10b2f72628a7","resolution":{"observed_at":"2026-08-10T19:44:36.842789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.691848Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.691848Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:eacc82d14c5e7efb911d36cfc78f0eefa3d4975f0de4feaacda6f2f7b2fda306","observation_id":"c589a056-3e06-4f5c-995c-4ac402fc9541","resolution":{"observed_at":"2026-08-10T19:44:35.691848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13035","last_updated":"2025-03-13T03:16:43Z","snapshot_observed_at":"2026-08-08T15:29:45.865074Z","submitted_at":"2024-06-18T20:01:51Z","title":"D2O: Dynamic Discriminative Operations for Efficient Long-Context Inference of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13035","snapshot_observed_at":"2026-08-10T19:44:35.695799Z","title":"arXiv preprint arXiv:2406.13035 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.695799Z"},"links":{"cited_paper":"/paper/2406.13035","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:f5d9f4ed6da432f6980caa0d01e1806c33491bf5740da1c6b825a6ab08d59fde","observation_id":"9503d981-62af-4a7d-b25c-49bd3461ac8a","resolution":{"observed_at":"2026-08-10T19:44:35.695799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18845","last_updated":"2025-06-04T08:36:19Z","snapshot_observed_at":"2026-08-07T17:48:09.868777Z","submitted_at":"2025-02-26T05:31:44Z","title":"Sliding Window Attention Training for Efficient Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18845","snapshot_observed_at":"2026-08-10T19:44:35.700092Z","title":"arXiv preprint arXiv:2502.18845 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.700092Z"},"links":{"cited_paper":"/paper/2502.18845","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:6eb04d68e4bd0d0daf83afea6b585ae6adb62d1994ec6e05fc03a6c2803ab048","observation_id":"2d61c39c-110e-49ec-bc3d-c7d85889c825","resolution":{"observed_at":"2026-08-10T19:44:35.700092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:36.814988Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"2fd677ef-1ff6-4c14-9cca-3687463c0da0","year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.704436Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:40bee8fc37f0cfbedd2a0e4cc73d4e8e4729b01b2d3224fcfc9b14dd43ba632a","observation_id":"2247790e-36a6-4e37-870c-b4a359832b3e","resolution":{"observed_at":"2026-08-10T19:44:36.819151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:36.802636Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"90995854-6fa9-425f-b1dc-50fdbc9c0e72","year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.708177Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:ddb095c8dff225c596b40e979e88b5f302bb2d050db9b7d1613eecf7ebcd8e6e","observation_id":"4863f428-27e8-49ec-90fb-936c60c6f781","resolution":{"observed_at":"2026-08-10T19:44:36.806555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T19:44:35.712318Z","title":"arXiv preprint arXiv:2407.21783 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.712318Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:239a1d86b8bdad2dabda47e4ad9e498482d7f76fc71e347bb5fb7d19bc65a0fd","observation_id":"2e44d7c7-b451-45d7-be05-66f9871912c0","resolution":{"observed_at":"2026-08-10T19:44:35.712318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.718471Z","title":"Proceedings of the 62nd annual meeting of the association for computational linguistics (volume 1: Long papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.718471Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:7d2654bb387295b1288be2b5800164f0d0227d7ea9172fb041ba32f9de38f2e5","observation_id":"5b22a25d-6072-4bd3-bae0-f3582aa00f59","resolution":{"observed_at":"2026-08-10T19:44:35.718471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.723367Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.723367Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:3470b2f83acdf0253311b451ea9654f34c9df373edf529208aa2697884d9c6a9","observation_id":"c5c55004-16dc-4732-b785-ccde5bfa676e","resolution":{"observed_at":"2026-08-10T19:44:35.723367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.00519","last_updated":"2015-03-02T13:31:08Z","snapshot_observed_at":"2026-07-06T04:10:44.995397Z","submitted_at":"2015-03-02T13:31:08Z","title":"Generalizations of Sylvester's determinantal identity","version":1},"cited_work":{"arxiv_id":"1503.00519","doi":null,"metadata_source":"pith","pith_arxiv_id":"1503.00519","snapshot_observed_at":"2026-08-10T19:44:35.981996Z","title":"Generalizations of Sylvester's determinantal identity","venue":"math.NA","work_id":"9f545a15-6818-4c78-96ef-b5f996ad5b78","year":2015},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.727416Z"},"links":{"cited_paper":"/paper/1503.00519","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:c222e333395459176bf6e862d29213598832c835dc7864fb4877f60bf9d01d52","observation_id":"be5f38f2-ed3d-4bd9-bdab-4e881a67a06b","resolution":{"observed_at":"2026-08-10T19:44:35.988602Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.732282Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.732282Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:1665ebeafee14323c4c60583351bb5ed4e3be694ed4833924cc9e722f66d6884","observation_id":"09e19945-f070-4d14-8a65-f47181b4d43e","resolution":{"observed_at":"2026-08-10T19:44:35.732282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-10T19:44:35.736618Z","title":"arXiv preprint arXiv:2004.05150 , year=","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.736618Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:ddfb44126bb079a7eaf3be1c8f332c2fc41ce4672a78a82664d3809de1bf5318","observation_id":"c3bee1a0-e987-4232-bb2c-c0e13bc61cfd","resolution":{"observed_at":"2026-08-10T19:44:35.736618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:36.759531Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"f8c0c28e-6734-4c57-a11e-03d4f6ccf07f","year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.741180Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:adddb223be162608b1ade495c07e95321d605d5051830af15ea18e99a09b882b","observation_id":"a8bd2e13-f82b-466d-9012-57f16914b3d5","resolution":{"observed_at":"2026-08-10T19:44:36.764310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.745592Z","title":"Efficient Streaming Language Models with Attention Sinks , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.745592Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:ace06aa767621945fb86db59296ef4a377fd131a0e204a2af276b4f0e63914ea","observation_id":"6d4a9e6c-ac44-48d2-ac33-64b3f8fc31e2","resolution":{"observed_at":"2026-08-10T19:44:35.745592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:36.739334Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"daf6b027-9e49-4266-9651-d9b8152c9eb6","year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.749658Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:0a2622507d70a891ae4de84b61a151925cd12c1f3aae2f1f906893f0999e122d","observation_id":"27b4b91e-6d33-4616-9439-31575493a62a","resolution":{"observed_at":"2026-08-10T19:44:36.743057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-08-10T19:44:35.753794Z","title":"arXiv preprint arXiv:2503.18893 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.753794Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:ee7bed89cb1914d9db9da12c970c0e5d7fe52c50dbe58249c8c0a6ff71068b7e","observation_id":"7221584d-8357-49d7-8281-3bca7ca1802a","resolution":{"observed_at":"2026-08-10T19:44:35.753794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.16134","last_updated":"2025-08-22T06:55:45Z","snapshot_observed_at":"2026-08-05T17:31:22.213692Z","submitted_at":"2025-08-22T06:55:45Z","title":"CommonKV: Compressing KV Cache with Cross-layer Parameter Sharing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.16134","snapshot_observed_at":"2026-08-10T19:44:35.760151Z","title":"arXiv preprint arXiv:2508.16134 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.760151Z"},"links":{"cited_paper":"/paper/2508.16134","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:2247bd6222230a97395706d23c20fefd1b20e00c2236b60ffb23590be32bf7ab","observation_id":"aaf438dc-bf41-43d0-9b1a-74b9aad4cbda","resolution":{"observed_at":"2026-08-10T19:44:35.760151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-10T19:44:35.764980Z","title":"arXiv preprint arXiv:2307.08691 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.764980Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:ebb5021ce8766751bc2b0d219d4745a28297d856bb0de6d9a3ee156251a30a32","observation_id":"86e16be4-d1e6-49c4-bbb6-2a91a7dfaadc","resolution":{"observed_at":"2026-08-10T19:44:35.764980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.770378Z","title":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.770378Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:2adc1beb95f0c4c8716c6f04d08b39ef12351a1b24c7fc77cf01807a9abc3160","observation_id":"3816af21-e8cb-4dcb-96ab-b59d43e47ad2","resolution":{"observed_at":"2026-08-10T19:44:35.770378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-10T19:44:35.774721Z","title":"arXiv preprint arXiv:2505.09388 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.774721Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:eaff62e93b2876687cad768a6f894afceb46838244730b09838e875cb6138c5d","observation_id":"e3c7146a-2b83-4ac1-a07b-b4bce6ebaf33","resolution":{"observed_at":"2026-08-10T19:44:35.774721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:36.717336Z","title":"2026 , howpublished=","venue":null,"work_id":"e46f22a1-38ef-4013-ae73-579462a47c69","year":2026},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.779114Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:5abcb52082c777531a75f88616f5b30040ca5101d0d6e5cfd85891fa6a4d8cc8","observation_id":"7ce472bd-9dcb-4ead-8cff-b1ba68562c9e","resolution":{"observed_at":"2026-08-10T19:44:36.721978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.784770Z","title":"Neurocomputing , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.784770Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:15e1fbf1cf7b74b1ff0e749cceaf4712cf0c3a66260a060874009c4d934f8402","observation_id":"3354449a-4964-40d9-b868-d039b6b55524","resolution":{"observed_at":"2026-08-10T19:44:35.784770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.790099Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.790099Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:073c4083e2b15828dde1abe6bd84e4e00b838ee38943acca22ee5c9494e67d92","observation_id":"6f4dc911-b628-4881-8b09-df5574e2651d","resolution":{"observed_at":"2026-08-10T19:44:35.790099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:36.692158Z","title":"2024 , cdate=","venue":null,"work_id":"d531e8af-363c-4175-839a-d966f9d0f340","year":2024},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.795282Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:db6cf5e19a885e459a541fa52522ecd9aa3ec4eec5cdb44cc3c9a415170ad65b","observation_id":"9b46b94c-f2a6-4420-aae1-f4c28c64570a","resolution":{"observed_at":"2026-08-10T19:44:36.697591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:36.675865Z","title":"RazorAttention: Efficient","venue":null,"work_id":"c3cca5c0-f7a0-4900-bf59-fb969b148e0e","year":2025},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.799719Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:9a993c886905fda7ee2dd026d3ec15f8fa9d5db59a177ba21c6d761263201fbf","observation_id":"56809ac4-a57f-435c-aa9e-4185a153817d","resolution":{"observed_at":"2026-08-10T19:44:36.680615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.804930Z","title":"NACL : A General and Effective KV Cache Eviction Framework for LLM at Inference Time","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.804930Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:36bb66b84f83f6d24008fd9bd307a4e83aafeec06dad7c807e3224f11c05a5a0","observation_id":"8f7f343c-c3d4-45b4-9c4f-3fb85facbc2a","resolution":{"observed_at":"2026-08-10T19:44:35.804930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16362","last_updated":"2021-05-20T14:48:30Z","snapshot_observed_at":"2026-08-09T06:13:20.021836Z","submitted_at":"2020-06-29T20:28:52Z","title":"Multi-Head Attention: Collaborate Instead of Concatenate","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16362","snapshot_observed_at":"2026-08-10T19:44:35.809431Z","title":"arXiv preprint arXiv:2006.16362 , year=","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.809431Z"},"links":{"cited_paper":"/paper/2006.16362","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:fff7d26b7830819dc36b256ce4d88663ed62444488dbae9f41fdd22fa62fb001","observation_id":"3db61237-7085-4db7-9169-06198db0242e","resolution":{"observed_at":"2026-08-10T19:44:35.809431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16369","last_updated":"2023-08-31T00:03:02Z","snapshot_observed_at":"2026-08-06T15:43:00.292272Z","submitted_at":"2023-08-31T00:03:02Z","title":"SARATHI: Efficient LLM Inference by Piggybacking Decodes with Chunked Prefills","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16369","snapshot_observed_at":"2026-08-10T19:44:35.815239Z","title":"arXiv preprint arXiv:2308.16369 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.815239Z"},"links":{"cited_paper":"/paper/2308.16369","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:c6b133a01bd64e660c1926abc31465232c1bc579b96b7d3c8f3e46dadd15af9d","observation_id":"c9f7353c-d3e2-4448-a8eb-c44e02803f13","resolution":{"observed_at":"2026-08-10T19:44:35.815239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.819645Z","title":"Proceedings of the 29th symposium on operating systems principles , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.819645Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:e1e956f6b7487bfd800f3f55b6ea7cea5b27ba88673a62f18681534eb92f5da0","observation_id":"785cf5ae-4205-405b-8700-e02012b15afa","resolution":{"observed_at":"2026-08-10T19:44:35.819645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.823398Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.823398Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:7526428fe8d4a28b2ea07334f9deb36bb4f40a35d387b3b74cd3e2a7dc019dac","observation_id":"4d489b36-26ea-463f-b372-ff4f19fd222d","resolution":{"observed_at":"2026-08-10T19:44:35.823398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.826661Z","title":"Transformers: State-of-the-Art Natural Language Processing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.826661Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:5c1f6bf58eceafabdfcf6ef0172137d25ed0cb79c283fd810395945b2c029881","observation_id":"84d18435-2480-4c67-bf33-9c529435f7d1","resolution":{"observed_at":"2026-08-10T19:44:35.826661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:35.831385Z","title":"2007 15th European signal processing conference , pages=","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.831385Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:bb220e96180c38198f0d79be77fd27cafb9f5ab0d6a6b1a18e24039287ec3e40","observation_id":"d4fed672-5e7e-405c-9867-b478d8e61a0e","resolution":{"observed_at":"2026-08-10T19:44:35.831385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:44:36.614362Z","title":"Journal of the ACM (JACM) , volume=","venue":null,"work_id":"156eb219-19ed-4a0b-87e4-60bd288b3a7e","year":2007},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.835963Z"},"links":{"citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:8700238208699641c0d39165f3c926c32200a176ec6f165055d5d42a1438cdf6","observation_id":"c1e67c36-c69e-4f7e-adbc-b562a825a4b4","resolution":{"observed_at":"2026-08-10T19:44:36.623124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T01:12:53.789097Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2608.06849."}