{"as_of":"2026-08-11T11:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2021c05d964e69003be6ccadb3f94f07f526b2736cb6e5c0fb2068d401ae5509","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":36,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:26:11.045710Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T01:36:44.065347Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-10T20:26:11.045710Z","title":"Seerattention: Learning intrinsic sparse attention in your llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09767","last_updated":"2025-01-15T05:17:12Z","snapshot_observed_at":"2026-08-11T03:26:12.880949Z","submitted_at":"2025-01-15T05:17:12Z","title":"LeMo: Enabling LEss Token Involvement for MOre Context Fine-tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T20:26:11.045710Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2501.09767"},"observation_digest":"sha256:092255959c371dae51e4024d8dc0235484ee5123fb66380497c1ac3b43bfcb6c","observation_id":"ff755549-e753-46ec-a8f5-c7441ae408c9","resolution":{"observed_at":"2026-08-10T20:26:11.045710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-10T00:43:28.887469Z","title":"K.-H., Cao, T., Yang, F., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18107","last_updated":"2025-06-07T00:03:08Z","snapshot_observed_at":"2026-08-10T09:14:26.425079Z","submitted_at":"2025-01-30T03:16:44Z","title":"Scaling Inference-Efficient Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T00:43:28.887469Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2501.18107"},"observation_digest":"sha256:8d7360cd80710d64797b5420ead8a6068bad4820a7e3132fe840c1c2b8a5a062","observation_id":"8a484819-c134-4763-9cce-a00b0300d799","resolution":{"observed_at":"2026-08-10T00:43:28.887469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-08-07T14:17:15.942844Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-16T23:46:29.975858Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2502.11089"},"observation_digest":"sha256:13ed1b30fcb891edb8d8f40d324e14011b727969343d4d091273c48c7e3d5a3c","observation_id":"325cc7c1-0fd6-4a0e-9ba5-1a011bf2c497","resolution":{"observed_at":"2026-05-16T23:46:30.062261Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2502.13189","last_updated":"2025-02-18T14:06:05Z","snapshot_observed_at":"2026-07-06T20:38:48.725605Z","submitted_at":"2025-02-18T14:06:05Z","title":"MoBA: Mixture of Block Attention for Long-Context LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-16T06:15:46.085555Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2502.13189"},"observation_digest":"sha256:148a8d1b0d500763375bb062ee26fa8cbf912bcc10c229efc43dd6795d71bd4d","observation_id":"4bfcbe89-ca11-47ad-ac6f-e8349a2c8a76","resolution":{"observed_at":"2026-05-16T06:15:46.260047Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2505.02922","last_updated":"2026-04-27T10:13:35Z","snapshot_observed_at":"2026-08-02T06:23:14.961990Z","submitted_at":"2025-05-05T18:01:17Z","title":"RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:04.724780Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2505.02922"},"observation_digest":"sha256:457cf598144823fec7aec93a90d473d8d7f9e5482c99b5d919605772c9b3f713","observation_id":"3e802f0b-f9c6-49af-99d5-3c8fb50e2ff9","resolution":{"observed_at":"2026-05-09T06:35:25.149555Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-07T14:16:38.982877Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19578","last_updated":"2025-05-26T06:48:53Z","snapshot_observed_at":"2026-08-07T14:09:15.089848Z","submitted_at":"2025-05-26T06:48:53Z","title":"Accelerating Prefilling for Long-Context LLMs via Sparse Pattern Sharing","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:38.982877Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2505.19578"},"observation_digest":"sha256:7165d2513bab65c44dbcd0913cf49ee348339ac22b5868541a1b9910fd1484a4","observation_id":"1338f882-ee10-40dc-8718-847d1628ef14","resolution":{"observed_at":"2026-08-07T14:16:38.982877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-07T13:44:50.090294Z","title":"K.-H., Cao, T., Yang, F., and Yang, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-10T06:09:22.229605Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.090294Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:c9eef56993c87f7e37fa4d6139ff77bdba8d363196ff1f71d240f1c0df5e596f","observation_id":"705ad1c9-c08b-4c17-98bf-479d91723f4e","resolution":{"observed_at":"2026-08-07T13:44:50.090294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-07T12:39:06.471625Z","title":"Seerattention: Learning intrinsic sparse attention in your llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24179","last_updated":"2025-05-30T03:40:24Z","snapshot_observed_at":"2026-08-09T00:29:42.217756Z","submitted_at":"2025-05-30T03:40:24Z","title":"SALE : Low-bit Estimation for Efficient Sparse Attention in Long-context LLM Prefilling","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:06.471625Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2505.24179"},"observation_digest":"sha256:4c492b5df185c918887d49dea40d3d471bf7fb0d7d8b20a1e04a073c907e2dee","observation_id":"783534c0-5b4b-49b8-bff0-f2b48d7627f8","resolution":{"observed_at":"2026-08-07T12:39:06.471625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-07T10:52:48.764869Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04108","last_updated":"2025-06-05T05:39:48Z","snapshot_observed_at":"2026-08-10T12:09:42.684962Z","submitted_at":"2025-06-04T16:01:48Z","title":"Rectified Sparse Attention","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:52:48.764869Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2506.04108"},"observation_digest":"sha256:25c61492dbc767910c0366bf317cb7f2cb7f03dddd10de247721efee13959943","observation_id":"e892edf0-045c-41f9-81e0-73dd74f82b7f","resolution":{"observed_at":"2026-08-07T10:52:48.764869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-07T05:06:32.599244Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08889","last_updated":"2025-06-10T15:17:26Z","snapshot_observed_at":"2026-08-07T11:00:03.513055Z","submitted_at":"2025-06-10T15:17:26Z","title":"SeerAttention-R: Sparse Attention Adaptation for Long Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:32.599244Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2506.08889"},"observation_digest":"sha256:717888f15793854f0d355ef0360da5f23727425ffa6883455ea86a5b3146b54a","observation_id":"59d96b03-d758-480d-8dea-c50af189e0f7","resolution":{"observed_at":"2026-08-07T05:06:32.599244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-06T23:51:05.539269Z","title":"Seerattention: Learning intrinsic sparse attention in your llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16054","last_updated":"2025-06-19T06:25:02Z","snapshot_observed_at":"2026-08-07T13:41:59.610268Z","submitted_at":"2025-06-19T06:25:02Z","title":"PAROAttention: Pattern-Aware ReOrdering for Efficient Sparse and Quantized Attention in Visual Generation Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:05.539269Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2506.16054"},"observation_digest":"sha256:8e44117b2c130a079034524e6c04479d235fed8333ee9d3a5d1c3e108d292036","observation_id":"2a90d210-1879-4f2c-afd9-77c390433939","resolution":{"observed_at":"2026-08-06T23:51:05.539269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-06T05:13:24.097732Z","title":"Seerattention: Learning intrinsic sparse attention in your llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02122","last_updated":"2025-08-04T07:03:35Z","snapshot_observed_at":"2026-08-09T16:03:00.284372Z","submitted_at":"2025-08-04T07:03:35Z","title":"An Overview of Algorithms for Contactless Cardiac Feature Extraction from Radar Signals: Advances and Challenges","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:13:24.097732Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2508.02122"},"observation_digest":"sha256:86f08386de030a0d569cb2cd45b3ec52cf8b99886ca6e2e23c740da53061554d","observation_id":"ef11391c-7019-46e6-a8d8-305f5bda71af","resolution":{"observed_at":"2026-08-06T05:13:24.097732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2509.07120","last_updated":"2026-05-20T17:17:47Z","snapshot_observed_at":"2026-07-06T22:26:08.072526Z","submitted_at":"2025-09-08T18:16:09Z","title":"Block-Sparse Global Attention for Efficient Multi-View Geometry Transformers","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T22:22:23.320347Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2509.07120"},"observation_digest":"sha256:e2e98c23b4b7c673ef36a14477bcd9877fd6b391fd84cf35c9c629abf7dc0e3b","observation_id":"618ac735-b1bf-44b0-85db-18f1bfa0b23f","resolution":{"observed_at":"2026-05-21T22:24:23.580415Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-03T05:09:29.138780Z","title":"K.-H., Cao, T., Yang, F., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.03216","last_updated":"2026-05-29T02:42:46Z","snapshot_observed_at":"2026-08-03T05:09:26.451185Z","submitted_at":"2026-02-03T07:31:14Z","title":"Token Sparse Attention: Efficient Long-Context Inference with Interleaved Token Selection","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-03T05:09:29.138780Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2602.03216"},"observation_digest":"sha256:7f7edecfbdd2a6daccba2e84329d61b6e51425499c21b306b1de3dc50d624ff6","observation_id":"3650dda3-5536-4229-ab83-f04c82bf9653","resolution":{"observed_at":"2026-08-03T05:09:29.138780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-03T03:37:50.111339Z","title":"K.-H., Cao, T., Yang, F., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.07721","last_updated":"2026-05-28T23:34:23Z","snapshot_observed_at":"2026-08-10T11:58:57.897836Z","submitted_at":"2026-02-07T22:26:45Z","title":"ParisKV: Fast and Drift-Robust KV-Cache Retrieval for Long-Context LLMs","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T03:37:50.111339Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2602.07721"},"observation_digest":"sha256:dc709a9f2fee439c245eca0deb7560f9c426f7af40662900cb326109487b377e","observation_id":"3e8d83cb-4c6a-45ac-92b9-0551ae36fb72","resolution":{"observed_at":"2026-08-03T03:37:50.111339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-03T02:39:28.359337Z","title":"K.-H., Cao, T., Yang, F., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.06274","last_updated":"2026-07-31T10:15:33Z","snapshot_observed_at":"2026-08-08T03:34:36.285584Z","submitted_at":"2026-03-06T13:33:29Z","title":"Stem: Rethinking Causal Information Flow in Sparse Attention","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T02:39:28.359337Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2603.06274"},"observation_digest":"sha256:47e398591c11f3a62ee9672a146583efc5d4f851f4b8d338000ae6dcb0aa541a","observation_id":"5f8d8ca4-0e8b-46fe-aa0c-79fdac5fc477","resolution":{"observed_at":"2026-08-03T02:39:28.359337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2603.29002","last_updated":"2026-05-30T00:45:53Z","snapshot_observed_at":"2026-08-11T01:56:08.452383Z","submitted_at":"2026-03-30T21:03:39Z","title":"Understand and Accelerate Memory Processing Pipeline for Large Language Model Inference","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-14T00:25:49.807277Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2603.29002"},"observation_digest":"sha256:c33b2e3d1adb1d6fb73bdefd4b0c27f128eb299d533ca68e9f785b19d0a80373","observation_id":"88fc869f-1d05-4729-8e22-07725221432e","resolution":{"observed_at":"2026-05-14T00:28:29.905861Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2604.07394","last_updated":"2026-04-08T07:36:17Z","snapshot_observed_at":"2026-08-08T11:13:09.867023Z","submitted_at":"2026-04-08T07:36:17Z","title":"Flux Attention: Context-Aware Hybrid Attention for Efficient LLMs Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T17:39:18.387881Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2604.07394"},"observation_digest":"sha256:76cc063c4ed69d01cd0bd503a2a5d1644da14be99c5e8d07a838e145003e4980","observation_id":"c2a97b0c-22a3-4ac4-abe3-e6cbe9525d68","resolution":{"observed_at":"2026-05-11T06:25:58.263476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2604.14925","last_updated":"2026-04-16T12:10:08Z","snapshot_observed_at":"2026-07-06T23:02:36.062162Z","submitted_at":"2026-04-16T12:10:08Z","title":"Improving Sparse Autoencoder with Dynamic Attention","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T11:07:24.389139Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2604.14925"},"observation_digest":"sha256:ad324390f625df5198bff0a253d8edec851fcce2eb306043d57b8bd1f82259a7","observation_id":"840c3b2b-53d0-4d41-8606-7051d70dfe1a","resolution":{"observed_at":"2026-05-10T11:10:09.005188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2604.24820","last_updated":"2026-04-27T14:06:21Z","snapshot_observed_at":"2026-07-31T06:39:38.066325Z","submitted_at":"2026-04-27T14:06:21Z","title":"Salca: A Sparsity-Aware Hardware Accelerator for Efficient Long-Context Attention Decoding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-07T17:56:39.124969Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2604.24820"},"observation_digest":"sha256:ac5ae1f1d3fb48c2c09075b04c21fa0d8cccc838fe61e910ce8315f82b9e9480","observation_id":"e629aa06-b8b9-4394-98d8-09b019f22e4c","resolution":{"observed_at":"2026-05-11T23:11:18.796344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2605.07363","last_updated":"2026-05-08T07:19:34Z","snapshot_observed_at":"2026-08-11T07:37:17.920560Z","submitted_at":"2026-05-08T07:19:34Z","title":"MISA: Mixture of Indexer Sparse Attention for Long-Context LLM Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T02:27:55.991919Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2605.07363"},"observation_digest":"sha256:366f2e37f6328446e084daa0ab43d63976e274b2bb62039b95624cadf32b552b","observation_id":"e91831c1-8e6e-4b27-b64d-7763b5db5d4b","resolution":{"observed_at":"2026-05-11T03:30:56.540017Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2605.07719","last_updated":"2026-05-08T13:24:39Z","snapshot_observed_at":"2026-07-31T02:35:55.019423Z","submitted_at":"2026-05-08T13:24:39Z","title":"An Efficient Hybrid Sparse Attention with CPU-GPU Parallelism for Long-Context Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T02:56:28.828593Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2605.07719"},"observation_digest":"sha256:e933ff5812e1372162a58035388c989d0e21f718e78d2366e439fa8c9a5a6f1f","observation_id":"3de099d1-a128-4e36-bace-ecf757c8e4dc","resolution":{"observed_at":"2026-05-11T03:05:54.179460Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2605.13080","last_updated":"2026-05-13T06:54:09Z","snapshot_observed_at":"2026-08-02T12:36:41.415898Z","submitted_at":"2026-05-13T06:54:09Z","title":"Learning to See What You Need: Gaze Attention for Multimodal Large Language Models","version":1},"reference_index":183,"source":"arxiv_source","source_observed_at":"2026-05-14T20:13:18.813131Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2605.13080"},"observation_digest":"sha256:06a0f1dfea9779c9f238b5205163a5ff82130e4cd4ac11e4c848f1f59559a895","observation_id":"1e1d00e9-0c61-43c6-8a98-86eea300b0fa","resolution":{"observed_at":"2026-05-14T20:19:28.545227Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2605.16839","last_updated":"2026-05-16T06:47:41Z","snapshot_observed_at":"2026-07-06T23:27:57.805018Z","submitted_at":"2026-05-16T06:47:41Z","title":"CompactAttention: Accelerating Chunked Prefill with Block-Union KV Selection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T21:19:31.263068Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2605.16839"},"observation_digest":"sha256:bb68c04b6dc017954fb9b41beaffbb6dfb3693f3e00504d825d00737aad1bc2b","observation_id":"05a6764b-b7de-422a-8305-57fc48fa1474","resolution":{"observed_at":"2026-05-19T21:22:47.994012Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2605.18753","last_updated":"2026-05-18T17:59:52Z","snapshot_observed_at":"2026-08-02T11:52:59.734226Z","submitted_at":"2026-05-18T17:59:52Z","title":"DashAttention: Differentiable and Adaptive Sparse Hierarchical Attention","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-20T10:50:12.926232Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2605.18753"},"observation_digest":"sha256:7242ae16cb0edaee457e4f158af2d18f0c59aa8d523674c4b64e8d949570eacd","observation_id":"22512576-7a2a-4be3-8518-2108e49e5c76","resolution":{"observed_at":"2026-05-20T10:53:13.535272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2605.30325","last_updated":"2026-05-28T17:57:07Z","snapshot_observed_at":"2026-07-06T23:39:38.845840Z","submitted_at":"2026-05-28T17:57:07Z","title":"Veda: Scalable Video Diffusion via Distilled Sparse Attention","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T07:54:13.390911Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2605.30325"},"observation_digest":"sha256:6307cf572679a12bf99cee2d94b26eef966fc76cb4a1ef61cbbd720f12e225c0","observation_id":"7c54c9b3-e913-4a01-bda1-e04c2e128d79","resolution":{"observed_at":"2026-06-29T08:03:14.700175Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2606.06467","last_updated":"2026-06-04T17:54:04Z","snapshot_observed_at":"2026-08-08T09:09:14.963315Z","submitted_at":"2026-06-04T17:54:04Z","title":"You Only Index Once: Cross-Layer Sparse Attention with Shared Routing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T01:06:04.896501Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2606.06467"},"observation_digest":"sha256:ef37f5f540a143bdac3472baf1db0af7c04e7aa1bcb992d47becb1f98b336bf9","observation_id":"cc64822d-c3cc-4b61-bd68-4034171f3293","resolution":{"observed_at":"2026-07-02T13:36:59.522839Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-12T05:40:56.557646Z","title":"Seerattention: Learning intrinsic sparse attention in your llms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02980","last_updated":"2026-07-03T05:39:00Z","snapshot_observed_at":"2026-08-06T12:25:06.959262Z","submitted_at":"2026-07-03T05:39:00Z","title":"Hierarchical Sparse Attention Done Right: Toward Infinite Context Modeling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-12T05:40:56.557646Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2607.02980"},"observation_digest":"sha256:7cde07b8907090a0e9843d103b03e607c669268e1491df9b76f7dde54f882b72","observation_id":"b285cdf4-9467-4eef-a267-1ec0c423dd1d","resolution":{"observed_at":"2026-07-12T05:40:56.557646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":"2410.13276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-10T01:36:44.065347Z","title":"Seerattention: Learning intrinsic sparse attention in your llms.arXiv preprint arXiv:2410.13276","venue":"cs.CL","work_id":"7e69f9a0-9472-4c02-8f79-806ba81f8531","year":2024},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-02T16:38:21.894642Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:ba8197054dc0113c87120717bcaeae9562bcf8be378119cad5fc201c7f14b11d","observation_id":"2d42468b-c629-4372-92b4-0b7e7e6e27a3","resolution":{"observed_at":"2026-07-10T01:36:44.066529Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-01T07:14:36.433018Z","title":"Seerattention: Learning intrinsic sparse attention in your llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21692","last_updated":"2026-08-04T19:02:58Z","snapshot_observed_at":"2026-08-08T23:10:29.982886Z","submitted_at":"2026-07-23T17:11:34Z","title":"Learning What Matters: Supervising Global Context Pruning with Causal Evidence Sets","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T07:14:36.433018Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2607.21692"},"observation_digest":"sha256:be676e3e5be5af4487be439e547236eafa88444bd0d31cfeb3259568b225f526","observation_id":"fb53bf35-9ed6-4b62-a55e-de6a8f697145","resolution":{"observed_at":"2026-08-01T07:14:36.433018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-31T11:49:11.646757Z","title":"SeerAttention: Learning intrinsic sparse attention in your LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24555","last_updated":"2026-07-27T15:28:52Z","snapshot_observed_at":"2026-08-02T06:50:39.173138Z","submitted_at":"2026-07-27T15:28:52Z","title":"LOCKS: Page-Local Compact Key Summaries for Efficient Long-Context Decoding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T11:49:11.646757Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2607.24555"},"observation_digest":"sha256:4afd3e6abbe347b8f18a98df1e51ddbe2c123c7c54939875fd2d7a3c4b4878bd","observation_id":"5f24662f-4ecb-4e8a-8539-5011aac93f39","resolution":{"observed_at":"2026-07-31T11:49:11.646757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-07-31T11:04:04.579723Z","title":"arXiv preprint arXiv:2410.13276 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24593","last_updated":"2026-07-27T15:58:07Z","snapshot_observed_at":"2026-08-04T16:51:01.691381Z","submitted_at":"2026-07-27T15:58:07Z","title":"PIVOT: Efficient Query-Group Indexing for Token-Level Sparse Attention","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-31T11:04:04.579723Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2607.24593"},"observation_digest":"sha256:c3bf6f394aa9e91c3636aeb00f5c347c46194c2481f9ec7aec618f7e52149ab6","observation_id":"fb9c76ae-c1f1-4464-b8aa-2b608a2e0421","resolution":{"observed_at":"2026-07-31T11:04:04.579723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-01T02:55:46.085046Z","title":"arXiv preprint arXiv:2410.13276 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25291","last_updated":"2026-08-07T08:55:53Z","snapshot_observed_at":"2026-08-11T11:10:08.647734Z","submitted_at":"2026-07-28T04:57:19Z","title":"CoSA: Accelerating Long-Context Inference via Proxy-Kernel Co-Designed Sparse Attention","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T02:55:46.085046Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2607.25291"},"observation_digest":"sha256:8cdd2fe05c071f09429d9fd6b398b2caef6b89a5e87cd8b39aaa21e69087068d","observation_id":"57b10020-c421-416a-b7fc-22318a361253","resolution":{"observed_at":"2026-08-01T02:55:46.085046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-04T13:43:52.392419Z","title":"arXiv preprint arXiv:2410.13276 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02150","last_updated":"2026-08-05T06:57:37Z","snapshot_observed_at":"2026-08-09T07:46:30.048448Z","submitted_at":"2026-08-03T12:34:31Z","title":"PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T13:43:52.392419Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2608.02150"},"observation_digest":"sha256:d6d3aa3b8ef47de11aea0fc835bf4a254bcbb616c0fc711c50db0109c24ededb","observation_id":"22658ed4-4cf8-47d1-b9ed-cd537f32227c","resolution":{"observed_at":"2026-08-04T13:43:52.392419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-07T00:11:48.830415Z","title":"arXiv preprint arXiv:2410.13276 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02150","last_updated":"2026-08-05T06:57:37Z","snapshot_observed_at":"2026-08-09T07:46:30.048448Z","submitted_at":"2026-08-03T12:34:31Z","title":"PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T00:11:48.830415Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2608.02150"},"observation_digest":"sha256:1934f06b6ea6d56a6e671f6b286861176d030c98164968dd88a10442ca48deb6","observation_id":"0cba3d3f-205f-4cf8-9676-ecd70fbf4bc8","resolution":{"observed_at":"2026-08-07T00:11:48.830415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-05T20:50:03.966623Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03335","last_updated":"2026-08-04T08:47:57Z","snapshot_observed_at":"2026-08-10T19:46:53.843588Z","submitted_at":"2026-08-04T08:47:57Z","title":"SPADE: An Input-Adaptive Sparse Attention Engine for Fast Video Diffusion Models Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T20:50:03.966623Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2608.03335"},"observation_digest":"sha256:6dacbc6677e1def1492dec48caa5ef636ce9057584b204064b908ead23312d3d","observation_id":"e2078dfc-c574-44de-bfdb-7e0cd65c37d2","resolution":{"observed_at":"2026-08-05T20:50:03.966623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.13276/citation-record","integrity":"/paper/2410.13276/integrity","json":"/paper/2410.13276/citation-record.json","paper":"/paper/2410.13276"},"outbound":[],"paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-05T05:19:17.395325Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 36 inbound Pith citation observations for arXiv:2410.13276."}