{"as_of":"2026-08-07T09:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:123b25f08c62c6d056fc3225edc8981f5c156da37dc2766b797ad3c9d98d3da2","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:45:48.555417Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04405/citation-record","integrity":"/paper/2608.04405/integrity","json":"/paper/2608.04405/citation-record.json","paper":"/paper/2608.04405"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.562012Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":"911ddc57-73b0-47f0-9558-3ce17c665d00","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:44.502013Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:402ee1264a396f18a23e6cabdacdc2e5fb27ffded83ff1250ca0302060b38c79","observation_id":"98bd1211-0457-40bf-8c2d-bd5821c1b941","resolution":{"observed_at":"2026-08-07T00:45:49.566385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:44.671883Z","title":"Claude-3 Model Card , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:44.671883Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:a2e6b1058e9326f5c7bc03edf006e9ce2c636f3ea92257400a247373ae265518","observation_id":"3e34aa05-262a-4fff-b25f-0ed524695119","resolution":{"observed_at":"2026-08-07T00:45:44.671883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:44.838100Z","title":"Proceedings of machine learning and systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:44.838100Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:56e5c006fd732e14ac997977a231a11606eafaa635ec475684c43ef6aa443ee1","observation_id":"1329a8a8-27d4-4f34-913e-85536512e153","resolution":{"observed_at":"2026-08-07T00:45:44.838100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:45.019470Z","title":"Model Tells You What to Discard: Adaptive","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.019470Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:c55881df94f9f08b6441eda3ce98c1a6eb47ec619943d7ea894c854eb67bafe3","observation_id":"6f68cde1-2560-4273-8b87-52d868cac273","resolution":{"observed_at":"2026-08-07T00:45:45.019470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.520710Z","title":null,"venue":null,"work_id":"5ae9e9b2-410f-4d63-a3e0-7e95f218755f","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.080091Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:088b34b4d99595199701b9dc26107328e196033e2db6c6f5e48d89c736397244","observation_id":"dac62c12-18bc-4900-9fd3-b24fa6d62178","resolution":{"observed_at":"2026-08-07T00:45:49.524891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.505500Z","title":null,"venue":null,"work_id":"2b770d6c-1834-4b7e-9b57-3d7539c47e64","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.126296Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:109da3cbffe3cde96d6941321b1d61e0694e166d17b1f59bb230c5e822ee70b1","observation_id":"ae09cead-d01e-4dde-b7df-fe84a405500a","resolution":{"observed_at":"2026-08-07T00:45:49.510510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.485564Z","title":null,"venue":null,"work_id":"14ec73fe-f7ce-4832-8cc7-c3880c0d5051","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.199502Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:82861f33ae2614fbe6ba2281124898727f6f79ec94c05dfc693848d72f53b78d","observation_id":"87db65a8-a421-4b90-b996-bdee82f935d2","resolution":{"observed_at":"2026-08-07T00:45:49.489837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:45.340059Z","title":"Thirty-seventh Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.340059Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:9ea049343c4b017b4beb9b2a471e23099842653b6189d79a4d7e0e765b2e729d","observation_id":"3e43558a-cc1c-4f6e-8fdd-6ded987c46b0","resolution":{"observed_at":"2026-08-07T00:45:45.340059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:45.509378Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.509378Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:b3fe7135b6b0f2acdc52333b0739d713ebaf0dad70d50d7bd641a424412b772a","observation_id":"5eb4dbe8-d238-4a5c-b6ef-387b04cc12a6","resolution":{"observed_at":"2026-08-07T00:45:45.509378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.452110Z","title":"Proceedings of Machine Learning and Systems , volume=","venue":null,"work_id":"428338e8-6b88-4835-a62a-dd5baf822c0a","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.549797Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:504c361e19903b56798bea9f685874ab2ea17bee797cd2c83028d8d289a5795a","observation_id":"d64bcbe5-ad45-470b-a8a0-ebfd482cd988","resolution":{"observed_at":"2026-08-07T00:45:49.456470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.438360Z","title":null,"venue":null,"work_id":"0a87d1fb-0bf2-4684-b328-99d9ddb5ed56","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.636469Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:5903b533850d27ce8a1a959c2dc778b8f3bb22b6ab0b33247479430ba164d07e","observation_id":"a983a3d5-76b3-4114-a28d-332c51f31587","resolution":{"observed_at":"2026-08-07T00:45:49.442209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.425457Z","title":null,"venue":null,"work_id":"7069fcd5-4a79-454c-9be5-be6b8fd70d01","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.692223Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:5f2762b424dc9a1674847abd9364bcbac2ed4e0c100619efac8f160ab32e9d15","observation_id":"b36d195e-eb79-44ea-b867-9c4b4a0b61b1","resolution":{"observed_at":"2026-08-07T00:45:49.429414Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.411748Z","title":"Spotlight Attention: Towards Efficient","venue":null,"work_id":"80027f11-9f00-4b41-9499-712745fac7ef","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.754602Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:135e0d6c2a78def26c506830d26a978e118ffe7a1bc956a6ace79402472ad9c7","observation_id":"bef283cd-a4c6-4a8d-a680-4c2923e4a5e5","resolution":{"observed_at":"2026-08-07T00:45:49.416295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:45.836639Z","title":"FlashAttention: Fast and Memory-Efficient Exact Attention with","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.836639Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:9bb965ee53b26f7d31586e132ebc9763c8413d48406c87e7fe4255935832ca0a","observation_id":"cef7a563-2c41-4001-b4ec-366481c6ce39","resolution":{"observed_at":"2026-08-07T00:45:45.836639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:45.931473Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.931473Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:cce4934334ba266a5c4428f1d987a3dd8825cfc93a9ee0a8febc7bde70311282","observation_id":"4bb71fa0-ea82-451e-a745-8b98a46e61e7","resolution":{"observed_at":"2026-08-07T00:45:45.931473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:45.999066Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.999066Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:c57200b372e915e4f57a6b2445f3c6c814c0a9fa4d9732a1079de0c162450137","observation_id":"492a6cd4-c8a6-4357-92c8-d9c51657d321","resolution":{"observed_at":"2026-08-07T00:45:45.999066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:46.124148Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.124148Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:4e8f763198da0d90f455493f2830e55ff9fa825f2daccd1bc887aa99da9d7b2c","observation_id":"e9771ca1-8f7a-447a-b98e-8ef91035aa19","resolution":{"observed_at":"2026-08-07T00:45:46.124148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:46.352439Z","title":"Proceedings of the 62nd annual meeting of the association for computational linguistics (volume 1: Long papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.352439Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:104518ff2904aa9feb233a48dc307620fe06e3a82bf0634006743b02c04458f1","observation_id":"1f2597f7-6c5f-4a31-8fa9-67b54193540a","resolution":{"observed_at":"2026-08-07T00:45:46.352439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:46.426634Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.426634Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:1fc58102a12635b9fdaecc83422727e3994abf22a89a0dfb94469310e5ccbae8","observation_id":"bd6ef8b9-09e9-45a3-aeec-89fc978e05f0","resolution":{"observed_at":"2026-08-07T00:45:46.426634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:46.532884Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.532884Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:2cab63eb8167f8f9f00e40ccdd3b8c93a263cb3b6ec0a2baafbefccdd984c60c","observation_id":"702c9da4-8052-40ea-a6db-2a3c05463a4a","resolution":{"observed_at":"2026-08-07T00:45:46.532884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:46.601006Z","title":"Transactions of the Association for Computational Linguistics , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.601006Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:df55f7d3249198decda6fcc53657bd71fd679d8033be001ea6f51f09fd234e82","observation_id":"d0b8689c-2a56-412b-9596-6032009fe2c4","resolution":{"observed_at":"2026-08-07T00:45:46.601006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.322688Z","title":null,"venue":null,"work_id":"afa54206-b031-4fea-8096-c21a4d33f58b","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.740905Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:5cd7452b1da646f7ed9398c7a1b8738b49e085edc02c1447bdf9cac15f5a0c11","observation_id":"d373459a-e353-4141-9c04-78f0841c5c15","resolution":{"observed_at":"2026-08-07T00:45:49.326839Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:46.848913Z","title":"Forty-second International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.848913Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:3bc744434359b4a3e30be976bd8b0e0283d070785b7ab1f463ddb06bf13b51f3","observation_id":"f53e6ef9-51b0-4d9c-ac96-765af8e13b58","resolution":{"observed_at":"2026-08-07T00:45:46.848913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.298550Z","title":"Github repository: hoskison-center/proof-pile","venue":null,"work_id":"f6f2a9b3-f8d9-43a6-b446-904d2121d37a","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.047920Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:5da949e58c5804d163778ac967517189176ff8d7a7590e057c26dca8c3afead1","observation_id":"d0429fe5-2587-461a-8efb-c96b9c003402","resolution":{"observed_at":"2026-08-07T00:45:49.303081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.284782Z","title":"Huggingface dataset: namespace-pt/long-llm-data","venue":null,"work_id":"87995cd0-9707-4e71-9b6b-2b2d336a57e9","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.103533Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:ad1a82b7d1b1e2b7446a63c7e9ff85e12cf0b1b8760865f30879f2697a9703e0","observation_id":"2ab00192-8e2d-46c0-b242-74b42dcc2205","resolution":{"observed_at":"2026-08-07T00:45:49.289011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:47.235596Z","title":"doi:10.5281/zenodo.12608602 , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.235596Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:da710c4e6d593b8355153dc3f04be74e2d6b8013d7df25148c8762d7c0f40a69","observation_id":"62f3b984-ea25-4934-bb55-47ea276c57c6","resolution":{"observed_at":"2026-08-07T00:45:47.235596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.270849Z","title":"Needle In A Haystack - Pressure Testing LLMs","venue":null,"work_id":"d706195d-8d26-4022-bad6-4982a7be92ab","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.343303Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:bfbb4e97578aac99d7e1df1f19940770e3f9dbe474c8c7a2061c612eb1b7256e","observation_id":"82347311-c9ee-4eb5-adc6-c99fd737f4a9","resolution":{"observed_at":"2026-08-07T00:45:49.275138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T00:45:47.445113Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.445113Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:597c9c6fdad9636a1c1e05329a597d8368ab9e9b9d3a69498bd5ae20f2bf9e39","observation_id":"ca7ac0a0-b7a3-4214-8ef9-16af23f6ba61","resolution":{"observed_at":"2026-08-07T00:45:47.445113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.257656Z","title":"J., Soloveychik, I., and Kamath, P","venue":null,"work_id":"7b6b83e4-e273-4656-a27a-a73b3736586c","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.542976Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:3f63aaea2adf2a8b4171a36c71c2bd1181b6b8729bf1021d8d9c625efae76ee4","observation_id":"5de07a54-a4da-4290-8108-891ec18b6d44","resolution":{"observed_at":"2026-08-07T00:45:49.261734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.242904Z","title":"The claude 3 model family: Opus, sonnet, haiku","venue":null,"work_id":"e1d516ec-0a34-418b-8c25-d00128980a34","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.631915Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:e3e61c6e7acbf41cda9fb68f5445175046b6facde951b3adda503ea0cdc565df","observation_id":"487b2b72-6cff-4e2c-9f99-534e5777f3da","resolution":{"observed_at":"2026-08-07T00:45:49.247793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:47.723353Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.723353Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:ae88bddbf9442ba009f7d6c00ba13e71c3dd3acbf08b13a9a259e720a1a87595","observation_id":"0c80b8ad-8250-4faf-a108-1d1451c2b132","resolution":{"observed_at":"2026-08-07T00:45:47.723353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:47.847487Z","title":"Longbench v2: Towards deeper understanding and reasoning on realistic long-context multitasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.847487Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:099ac416b3d120164119af7b0078936f1a50cb66c04d79931754b98d8e6c74ce","observation_id":"e3c744f0-b0f9-480e-bcf0-c39315548fc2","resolution":{"observed_at":"2026-08-07T00:45:47.847487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.208954Z","title":"Pyramid KV : Dynamic KV cache compression based on pyramidal information funneling","venue":null,"work_id":"d2604dd4-414d-435f-83ef-4d86ffa5d7b3","year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.923378Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:1568ae955cbe8cc1dcbaaeff8259089e699de47074ab2ae5d1ddf5e517daca33","observation_id":"1bb237ad-973d-452e-9a08-e2fbb38702ed","resolution":{"observed_at":"2026-08-07T00:45:49.213802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.194324Z","title":"Magic PIG : LSH sampling for efficient LLM generation","venue":null,"work_id":"d2a08aa8-0299-4dc0-aa11-17cdcb00a6ca","year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.091500Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:5683e436ebbf94dc219de1eed9e6ef6becd671fd3331598b84ab21b9ad060fd4","observation_id":"2eabe147-6e65-4048-8950-a6f1379915e2","resolution":{"observed_at":"2026-08-07T00:45:49.198514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T00:45:48.223022Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.223022Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:bd30794833ba67fc4b5d4a52dfc861552eefb90f1ef1347e6d479a1bb66024d8","observation_id":"081e11f3-47ef-4eed-8037-03d30156e423","resolution":{"observed_at":"2026-08-07T00:45:48.223022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.180970Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":"74c7b67e-793b-45b1-973c-9de2ae2cf2cf","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.386943Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:cef196936e2a2ffc826bdc3f047989586ce683fdcdad59a28a664cf1eeed05b0","observation_id":"2a4b8387-d5da-4c51-afe2-882926edbced","resolution":{"observed_at":"2026-08-07T00:45:49.185400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.166972Z","title":"Y., Ermon, S., Rudra, A., and Re, C","venue":null,"work_id":"30478628-3379-43ee-a5d2-fe2396bf1a16","year":2022},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.440388Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:2d01c938a6c0577d46b67b0b1b0b6a173c7bf0c835355c85ed98184552f52874","observation_id":"b48affb5-10e3-47a4-87b4-0c3cc6309661","resolution":{"observed_at":"2026-08-07T00:45:49.171609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.152221Z","title":"E., and Stoica, I","venue":null,"work_id":"bf80d6c2-9104-4b47-b75c-e06b49d1fc68","year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.444491Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:c545c8303ae713bb0624a981329a9f413e339a079590be48307ce76f2ff74777","observation_id":"80239adc-7d65-4ef2-a647-7b0d7c13390a","resolution":{"observed_at":"2026-08-07T00:45:49.156512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.448707Z","title":"The language model evaluation harness, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.448707Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:eddc3dfc8f5bcc1a77e67178a1eb07e4728bba36496e70751406b78a715be3ad","observation_id":"5a18a2d2-dc12-4945-946f-2c00ee6ca851","resolution":{"observed_at":"2026-08-07T00:45:48.448707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.138122Z","title":"Model tells you what to discard: Adaptive KV cache compression for LLM s","venue":null,"work_id":"5497c218-a911-47b8-8a18-ca400bbbae4d","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.454453Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:329c0a10463a464c41f965a9f73d1758d384524ab4cc2878efb16f84a2bcfcfa","observation_id":"58c60a82-6cd4-4d20-94f8-7afa6c2ec18c","resolution":{"observed_at":"2026-08-07T00:45:49.142226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02572","last_updated":"2025-06-03T07:53:32Z","snapshot_observed_at":"2026-07-06T21:35:36.836386Z","submitted_at":"2025-06-03T07:53:32Z","title":"HATA: Trainable and Hardware-Efficient Hash-Aware Top-k Attention for Scalable Large Model Inference","version":1},"cited_work":{"arxiv_id":"2506.02572","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02572","snapshot_observed_at":"2026-08-07T00:45:48.747511Z","title":"HATA: Trainable and Hardware-Efficient Hash-Aware Top-k Attention for Scalable Large Model Inference","venue":"cs.LG","work_id":"b281805c-434b-4b6f-8e01-cbc075af3219","year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.458849Z"},"links":{"cited_paper":"/paper/2506.02572","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:49e84ff680e4b7894ed2085c6ed9a5fc4a68319f5f728c4aa30194becf998956","observation_id":"8a1c847a-d352-4183-97c4-ee08663a825b","resolution":{"observed_at":"2026-08-07T00:45:48.754100Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T00:45:48.463249Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.463249Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:d23c1e4f0fda2cd65bc617a971c4634003997f71ba67ba2f0dfd6d4d6231f249","observation_id":"ecb4448e-00e0-4300-b69f-cffade0e387f","resolution":{"observed_at":"2026-08-07T00:45:48.463249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11421","last_updated":"2024-03-18T02:30:23Z","snapshot_observed_at":"2026-08-06T20:15:05.193939Z","submitted_at":"2024-03-18T02:30:23Z","title":"FastDecode: High-Throughput GPU-Efficient LLM Serving using Heterogeneous Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11421","snapshot_observed_at":"2026-08-07T00:45:48.467163Z","title":"and Zhai, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.467163Z"},"links":{"cited_paper":"/paper/2403.11421","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:2c547accee678ef1cb49574610d335b102cca3b78642034420899bfb22bd668a","observation_id":"e3cec5c8-1849-4e2e-89b7-01434f9dcc5b","resolution":{"observed_at":"2026-08-07T00:45:48.467163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.471650Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.471650Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:f61b669326952ed3ba203432c1f32dc2eceb5c4fd7bfc71756eecf787d5007aa","observation_id":"78a83260-f28a-49ce-9f21-f6a2dc2b3004","resolution":{"observed_at":"2026-08-07T00:45:48.471650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.113655Z","title":"RULER : What s the real context size of your long-context language models? In First Conference on Language Modeling, 2024","venue":null,"work_id":"e991ee98-fdc1-4369-9677-9818b3816d76","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.476537Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:412e4891ba619c3742867830dfda063a2b07f0daf32239fd7907f5acaaaca7ba","observation_id":"af515b52-0466-49a6-8ffc-be5556a2a259","resolution":{"observed_at":"2026-08-07T00:45:49.118630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T00:45:48.481136Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.481136Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:e0456694a0e9366829e613256ad98e46001c96dddebd17fa4f4a474dc9e7195a","observation_id":"58a95e18-6567-4c32-a3be-aeea0733e726","resolution":{"observed_at":"2026-08-07T00:45:48.481136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.098778Z","title":"Needle in a haystack - pressure testing llms, 2023","venue":null,"work_id":"b38d3120-97cd-4377-a642-5a66caa7fc53","year":2023},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.485518Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:1fa2869b1b6e2c8f7cb0614361015c1e5ba312e65cbc60847d6c1f8f174f2d47","observation_id":"a7402952-de9f-4da5-8708-0afa1115235f","resolution":{"observed_at":"2026-08-07T00:45:49.103843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.083851Z","title":"Spotlight attention: Towards efficient LLM generation via non-linear hashing-based KV cache retrieval","venue":null,"work_id":"c5000b1c-4995-42de-a72d-be7439fd6270","year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.489508Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:f115f6af68918d3422581c25f726a12d6901bd4a926825b761365643c14380be","observation_id":"0fa777ee-833e-484c-9c35-80b797d84d9b","resolution":{"observed_at":"2026-08-07T00:45:49.088165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.070382Z","title":"Snap KV : LLM knows what you are looking for before generation","venue":null,"work_id":"2f4782c7-b262-46f7-bdc5-c2f1a6658228","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.493989Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:2ff7e33a59b937cb8b55c9e689fafc9601d0b8284d3f8045411831a9c24622e5","observation_id":"82e90470-43f2-4d55-bff8-d3af616edfb5","resolution":{"observed_at":"2026-08-07T00:45:49.074517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-08-07T00:45:48.497849Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.497849Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:da85419bc5c25702f4b7f120b26ec58d7e2cb9188afde10ca101eab78dd5978b","observation_id":"5cbfbc9c-57d0-48b7-a240-4400d564416c","resolution":{"observed_at":"2026-08-07T00:45:48.497849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06104","last_updated":"2024-06-18T09:16:14Z","snapshot_observed_at":"2026-08-06T09:56:35.532756Z","submitted_at":"2024-01-11T18:35:26Z","title":"Transformers are Multi-State RNNs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06104","snapshot_observed_at":"2026-08-07T00:45:48.501586Z","title":"Transformers are multi-state rnns","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.501586Z"},"links":{"cited_paper":"/paper/2401.06104","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:7af580501d276959e861d6cf54d9c471aba655d55604ae821a3057a2a1cfc2ed","observation_id":"21c45e05-256e-4f45-aed1-31751a9dd61c","resolution":{"observed_at":"2026-08-07T00:45:48.501586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.056269Z","title":"Efficiently scaling transformer inference","venue":null,"work_id":"3723d25a-b24e-4343-b36f-be2932e7c8d8","year":2023},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.505287Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:0855b2115abf546d17f7c233fb1337203f8068a0e946fe70aa480fefffd3966c","observation_id":"a1364e24-a837-4295-bdfd-bf2b475f3031","resolution":{"observed_at":"2026-08-07T00:45:49.061315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.043092Z","title":"CAKE : Cascading and adaptive KV cache eviction with layer preferences","venue":null,"work_id":"d9c30182-d312-4234-9d59-e14184ec168e","year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.509196Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:2b536865434563b5da0e692715a729eec7446e1a121c21445291f0d89023c986","observation_id":"2b8a0f5d-41b5-492c-bf41-e9545623b29b","resolution":{"observed_at":"2026-08-07T00:45:49.047179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.030336Z","title":"W., Potapenko, A., Jayakumar, S","venue":null,"work_id":"b0d92e59-23ef-43f1-a196-67559700370e","year":2020},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.513305Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:58828b351912798ac4c6bba4e0eaf030429f58ebc0ed8144f5990bac56d435d3","observation_id":"6e7fe64e-838a-4376-a26f-6baea2f56420","resolution":{"observed_at":"2026-08-07T00:45:49.034216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.518314Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.518314Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:70e89e4279de2c05242f70717e2854cdc12394801ecbb242fc7e301332ba0cbe","observation_id":"a8de4fdf-ea70-4e67-9314-c46683f0b3df","resolution":{"observed_at":"2026-08-07T00:45:48.518314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.004761Z","title":"QUEST : Query-aware sparsity for efficient long-context LLM inference","venue":null,"work_id":"89b28335-ba48-463d-8a1a-74673f767c5f","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.522252Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:8f63b5f30ec05d914242a49fa83d650f744671e0fade1de0cc0d728d659f26a4","observation_id":"5c3d5672-c45b-439e-9be5-eb4d52a46fb3","resolution":{"observed_at":"2026-08-07T00:45:49.009542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.958826Z","title":"Leave no document behind: Benchmarking long-context llms with extended multi-doc qa","venue":null,"work_id":"51cbd65a-ec21-4502-9be5-a0d9d64940a9","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.526633Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:301cec6c8e153d92bc779ef9d37ec628d8690a52a8a7080d8db6df7d0a2484a4","observation_id":"e2ff1f98-d88e-4d4a-9fbe-e8888981a4f5","resolution":{"observed_at":"2026-08-07T00:45:48.980227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.944477Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"df82f5c8-e1c1-420c-bfff-2e9946f49d0f","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.530814Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:474b9ef7fd41021df557c40be23a1ba492c5ef9a08e8fa717edd5ad88738ea8b","observation_id":"b29bbc48-98eb-4259-93d1-198f95f2a2c9","resolution":{"observed_at":"2026-08-07T00:45:48.948921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T00:45:48.534839Z","title":"Qwen3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.534839Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:dfff9c0b21fda905b2f0be0ecc1ad53423b3306e242815f587b51addde6fdfff","observation_id":"b4faa074-20e7-49af-8243-627b6f5d711d","resolution":{"observed_at":"2026-08-07T00:45:48.534839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15383","last_updated":"2025-01-26T03:47:25Z","snapshot_observed_at":"2026-07-31T01:49:29.562668Z","submitted_at":"2025-01-26T03:47:25Z","title":"Qwen2.5-1M Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15383","snapshot_observed_at":"2026-08-07T00:45:48.538584Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.538584Z"},"links":{"cited_paper":"/paper/2501.15383","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:1aedc383ba3e60a1ea8c77ac12131c6b1fb33432266c31fe40bc73cbbe9204bf","observation_id":"de6a2277-4edb-46d0-8692-8e3ee5b02e44","resolution":{"observed_at":"2026-08-07T00:45:48.538584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.930380Z","title":"Huggingface dataset: namespace-pt/long-llm-data, 2024","venue":null,"work_id":"527d0069-7ce9-4f13-89c6-53c4c2fad428","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.542875Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:aca9bb32b2710f9f2903557505036721aabf981c397bb32486679f8bf3e0126c","observation_id":"3f30f609-ae21-4631-9c75-dde604bf68b6","resolution":{"observed_at":"2026-08-07T00:45:48.934585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-07T00:45:48.547366Z","title":"K., Han, X., Thai, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.547366Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:46dc66ecc1a356a1f7d9df65c7f818b8a0b50c2bbfca914c5ea6d4cfca8aeb5d","observation_id":"b76b7076-7ac9-4a03-9408-1683c1071703","resolution":{"observed_at":"2026-08-07T00:45:48.547366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.916651Z","title":"H2o: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":"0a3175b5-1807-4680-8e03-6a666fa77473","year":2023},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.551437Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:2e7f1d623dd8443b0e4903da71d07c69156c2b45f1d8f43f5a21724e26e50654","observation_id":"5d79c0a7-586d-448d-9c59-dd60a5a3eb40","resolution":{"observed_at":"2026-08-07T00:45:48.921189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.902994Z","title":null,"venue":null,"work_id":"0902a876-c4c0-4ce6-9974-25a11854408b","year":2022},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.555417Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:e011ca99ae58ff2179270e90462a492efe37377064476ff59ea4513d17a2e62d","observation_id":"774a348e-c6a2-43f5-a710-fe32e610019e","resolution":{"observed_at":"2026-08-07T00:45:48.907002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T08:33:02.366874Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":1,"verified_fuzzy":26},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 0 inbound Pith citation observations for arXiv:2608.04405."}