{"as_of":"2026-08-05T18:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fa258500f3c59ee208740bf43fedc663a2d2a800745c97a93e954aa38a939c82","coverage":[{"denominator":121,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T06:11:23.742632Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.29844/citation-record","integrity":"/paper/2606.29844/integrity","json":"/paper/2606.29844/citation-record.json","paper":"/paper/2606.29844"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Aho and Jeffrey D","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:6f16e70cb42a2fde4a6581a2d613e052e561e15b984c8a4b950d47f584fc671d","observation_id":"2c7db823-2ac2-46bf-82e5-2f2bd89baf50","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:5086f5a18dbd353e2777d81cbdbb2d97eeb17964e5ec55a55f3137c3c8ff470b","observation_id":"9597c9ab-99bd-4738-a625-1106be5c58b8","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2234.322243","doi":"10.1145/322234.322243","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chandra and Dexter C","venue":"Journal of the ACM","work_id":"c3270592-bd69-4213-95e1-4aaf8312be9b","year":1981},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:c4dfef8598c577a095cc11d7f97efef0b8ac8d7d031874d078087445e5749b0f","observation_id":"95aaf830-d30c-4a9d-9a07-c8386a686148","resolution":{"observed_at":"2026-06-30T06:14:17.875753Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:12.175602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:12.175602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Scalable training of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:42a2f914067d4c8889ec5c6cc50fef484abcd555a6ef7b5f7d57082f2b124d45","observation_id":"60163078-9721-46d3-bf5b-1daa8e430882","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:769c34ce6513684b117e381f58835516a183e4371b729bfa7edd81a3e122ea65","observation_id":"c06eef3f-ace7-40ea-83a6-275f08ad055a","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Tetreault , title =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:77970412c44175d99e6b57d9a597c50fad095a6f0e3c72e9819f2b5ffdada4ee","observation_id":"12c862bf-8ec2-40ff-9d8e-fbaf00f61ec7","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"A Framework for Learning Predictive Structures from Multiple Tasks and Unlabeled Data , Volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:a6ad275307aa90b197b1037ebc3127ea7f228b22a5bce083732362ca17faada5","observation_id":"dad94685-5906-4974-a813-cb51cc025620","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.naacl-long.222","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/2024.naacl-long.222","venue":null,"work_id":"166e45d8-45ae-45df-96e8-0c7238bb375e","year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:47fa3eb9f36ebac10194b094be4e795cf91071e7ad66df150364cd29c3670a26","observation_id":"1edf4214-72f8-40da-9e04-884d3a418145","resolution":{"observed_at":"2026-06-30T06:14:17.872577Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Thirty-seventh Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:2ff87d865d75a45f8789f94203083a5088c323c6366fc12b4c5aebebf26d34e7","observation_id":"a2be1a3b-20de-46e8-93f8-6cd30e5d1e1e","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:d775742d02048667e50f888fce4928c34623bb832503cf6229a54963b6cc9664","observation_id":"c4d62b43-7e09-4742-be90-0594335f4d05","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:dcb4e7c563864dac38efe8594660688a3f4f62d1fe64008414d717c8f1ca2bd0","observation_id":"7c99f72f-c111-4903-ba5e-6de28bceefe1","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:0ad5c14ad4055730ac1eaa050eb4e5a00f58b1469eaa9bae09f036c1acc1518d","observation_id":"f6e7e82e-402e-4c13-8082-53323d551a11","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:889688fac1148566f6ce7623a0823196e2def67cb3e39a4e33ad3096a2c4f428","observation_id":"68dd57f0-804d-4657-9314-619aa1ea163a","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Random-Access Infinite Context Length for Transformers , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:15d543daa4e751ffe0ffe9aade5c36c8bb55ab16b49f9bd12d193cbdb3c65764","observation_id":"f6405706-ecc3-4731-9701-7163cc48649f","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"SparQ Attention: Bandwidth-Efficient","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:57e0dbbb4825ec1801641239fb95799b24d992b4c100b14bd1569b5bad280d7f","observation_id":"ec11c593-c292-4780-9add-15f8bb8f0254","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Fast Attention Over Long Sequences With Dynamic Sparse Flash Attention , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:27ce733b40cc900433cfb63e1c649b757257249a182a8c0694509d0395184445","observation_id":"7421224d-98b8-4e4b-8801-c4c5dd21a121","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v37i7.26055","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"On the Expressive Flexibility of Self-Attention Matrices , booktitle =","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"cf6df74d-f6ac-409b-8ac9-c2b7dd2a99f0","year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:2707341777383cc19f1f05bd94d16c24829cebecca86065fae3364f94f583925","observation_id":"844c28f3-0ecf-4362-93ab-04702525e53e","resolution":{"observed_at":"2026-06-30T06:14:17.869292Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:4a2c22eb7dcf4aa27e24991a32823ffa3e85165a38195ae880c259611c389210","observation_id":"e1ab6e38-f84d-4729-8ada-a8755f797485","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:a0a2919618b860bb7a1082331b65a371042854bd8efc7bf5ff1b0465e288d1b3","observation_id":"5fbe02ea-38a0-4640-9f51-582e21401076","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:b254bf2aed4fa5f1b81d716652f2e52d4af104401af0717c224570b9b447f2e0","observation_id":"9f14ec0f-52ff-42cd-840a-3e481f696a61","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:d757694ab587c0338cd2dd21d3d620dd71cb3081ae6ea7a777ddb0d0b6eab036","observation_id":"7f838db1-b62e-4b19-84e8-1e5d0bb4213a","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13189","last_updated":"2025-02-18T14:06:05Z","snapshot_observed_at":"2026-07-06T20:38:48.725605Z","submitted_at":"2025-02-18T14:06:05Z","title":"MoBA: Mixture of Block Attention for Long-Context LLMs","version":1},"cited_work":{"arxiv_id":"2502.13189","doi":"10.48550/arxiv.2502.13189","metadata_source":"pith","pith_arxiv_id":"2502.13189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MoBA: Mixture of Block Attention for Long-Context LLMs","venue":"cs.LG","work_id":"de16df2d-eb7f-429d-82c7-8e4bf5183193","year":2025},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2502.13189","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:81c9a002a483ab29ec3c28864c7305b4d409d21de47876701318c619f1bd9184","observation_id":"cb04915f-b1b4-434e-950a-ce400a613889","resolution":{"observed_at":"2026-06-30T06:14:17.946951Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Improving Language Models by Retrieving from Trillions of Tokens , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:f9c5677a5a5474bd051152f525dec21520681d601b735dbcb01f3f46f49be3ee","observation_id":"4855b6b6-2b36-4214-bbdb-25d6ff1558ef","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:268969bed73d5adb631aa1b872977627ebc52088953add389a7a78b0f4a081e1","observation_id":"3ef57985-5db9-48b6-b17e-b656ef8167c2","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"gov/9377276","doi":"10.1162/neco.1997.9.8.1735","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Long short -term memory","venue":"Neural Computation","work_id":"c3b0bfa7-6764-45f1-a40d-45baaee9d22c","year":1997},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:c7f4144222c98a6bc64b6e307aa81f80d3ea0dbf79c639fc75b6575e2ed8fd5d","observation_id":"e432ccd8-e5b3-42d8-9a23-d5b320ae794d","resolution":{"observed_at":"2026-06-30T06:14:17.944605Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T06:49:14.059619+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T06:49:14.059619+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3115/v1/d14-1179","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Moschitti, A., Pang, B., Daelemans, W","venue":null,"work_id":"938a9ac5-57f8-472b-baa1-4fbb755371fb","year":2014},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:fa6847d2570f12f9420dc074ba4e2874b903612212cc9d02f5fc29b05fb12672","observation_id":"84cfae08-823c-4577-b98e-889b3dae0be5","resolution":{"observed_at":"2026-06-30T06:14:17.962196Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T13:38:16.047867+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T13:38:16.047867+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"3rd International Conference on Learning Representations,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:2783caeb6bd5205b6c44131afffbc71672d76e14e17a630bccd7ee149e000766","observation_id":"6bf33005-34fc-4450-92b6-9a11112a9177","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Advances in Neural Information Processing Systems 30: Annual Conference on Neural Information Processing Systems 2017, December 4-9, 2017, Long Beach, CA,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:1dc2870cb62339b32f03b46a0c2a819cdf384a234fac8f1014c3e3260d8b703c","observation_id":"9ec2e8cd-8dd7-408f-9db0-a0dc519fd829","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/p17-1147","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T12:46:14.489252Z","title":"TriviaQA: A large scale distantly supervised challenge dataset for reading comprehension","venue":"Proceedings of the 55th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"d05a9c57-9d88-473a-aa65-efb13f9dee25","year":2017},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:474209aefeafe6e4dc6683831b3fdc859a191193d05f74a0ef98c9de4197a4a0","observation_id":"77c809a8-12a3-46f2-8aff-345bf477d7e5","resolution":{"observed_at":"2026-06-30T06:14:17.981768Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T09:08:04.800216+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T09:08:04.800216+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/p18-1027","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the 56th Annual Meeting of the Association for Computational Linguistics,","venue":null,"work_id":"875e5b62-65ee-477f-a46f-c58d1d3e45cd","year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:6edd098e4bca78d853f223c91699454688d08743f5fe39326aea10e08a32e46f","observation_id":"5620a8f4-f0ec-4221-bec2-a8407c6722eb","resolution":{"observed_at":"2026-06-30T06:14:17.959869Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":"2001.08361","doi":"10.1145/3616855.3635845","metadata_source":"pith","pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Laws for Neural Language Models","venue":"cs.LG","work_id":"b7dd8749-9c45-4977-ab9b-64478dce1ae8","year":2020},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:50cf53944586ee7040b679a8ded54875d7709df6feec6099dd6d144aade01e62","observation_id":"ad3df5c0-0d48-4e9c-b25f-258c4223f06d","resolution":{"observed_at":"2026-06-30T06:14:19.035573Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:2ba4bf8534dab71246250fe94efe14c599d96a771160d60715a3211f2f7d36e3","observation_id":"530b7474-78b7-4c25-a5c2-993fc1431583","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Advances in Neural Information Processing Systems 33: Annual Conference on Neural Information Processing Systems 2020, NeurIPS 2020, December 6-12, 2020, virtual , url =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:2f815be4d669c7abf42520d4846cfa0e64ed0a09fe9addb47e29a16e0c6b0431","observation_id":"db15e7b2-039e-4c18-aefb-210f5bc9f296","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.emnlp-main.437","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the 2020 Conference on Empirical Methods in Natural Language Processing , year =","venue":null,"work_id":"879e871b-83fa-484d-ba3f-13d5672efd87","year":2020},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:16f60164ad6f574a4e5691a7298c11920e8284757bda8c9b5a9f45642fffbb97","observation_id":"b2d54160-a9c3-4a3d-ac6a-031c8582194b","resolution":{"observed_at":"2026-06-30T06:14:17.975326Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T11:52:56.197193+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T11:52:56.197193+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Proceedings of the 37th International Conference on Machine Learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:ab8b7aad838481e1f7fb02f2a7000e23c5ea533afca512f29bc53ee6e7b29e98","observation_id":"fa1f50d1-03bf-453c-9c22-2a8ad28448d2","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":"2209.11895","doi":"10.1145/3411763.3451760","metadata_source":"pith","pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In-context Learning and Induction Heads","venue":"cs.LG","work_id":"db2b0911-2758-4a2a-99dc-15b14b91bd5e","year":2022},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:fd23061bdf4e267124eff6e2c5b94026a060b9b39afa90cf41a628cc4839cc1f","observation_id":"d23aead0-df9a-454e-84ee-5ad3b1f062e6","resolution":{"observed_at":"2026-06-30T06:14:19.024861Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-23T02:23:10.795052+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T02:23:10.795052+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:2ad340d158bd10dd9bc33981dabbedc29823468a9bd346745ba299b1bf69f6a6","observation_id":"072931ce-069a-4d23-8bfa-4c4c644b9c55","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Tenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:269957384111e997bcffe4e5c48deea2354d5dad2383b9500ef380a2d0680ae3","observation_id":"617a95fc-f283-40bb-ad32-c14117d02e07","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Tenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:117d1ca61c44c8134462c964c0d60fbebf7b20505eef2a0c75c570edb37809b5","observation_id":"b79a50a5-cd4c-4059-aabf-2516408e9279","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:af13b7f6096a2fc2cb314ce5f58ca2ffb35726980ce26291ff3fd963cf4a4548","observation_id":"6658e978-a9cf-46e7-9249-6860984ee25b","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.467","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating verifiability in generative search engines","venue":null,"work_id":"c00bf84a-14c5-4f95-8f35-fbf3a59de0e3","year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:90fc9fc716fdd40e8c00ad8b2a6ca5b4cd35a28667ca51f757d4043d2cdd9cf5","observation_id":"2414cd1a-b8be-4d72-b1f2-80a45c6d93e4","resolution":{"observed_at":"2026-06-30T06:14:17.907745Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-30T09:56:17.689512+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-30T09:56:17.689512+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"International Conference on Machine Learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:39a0a4f4cb3ceb51340426034fd2d22b35202814b4f364d82eabcdff90c3cbb3","observation_id":"a3a5e2e7-fd65-4617-9c23-616c5ca2a916","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"International Conference on Machine Learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:372b100b0c212bf6d67f3cae32c1cefcb81f3da86912b88e3593f74e4fbdf6b9","observation_id":"bb11a349-a66a-44c5-86b7-48c6aebc58ef","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.398","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Enabling large language models to generate text with citations","venue":null,"work_id":"82161955-b4a2-4e2b-bfcb-28c30b81f3d9","year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:eff2b82515958efcd395bf08e5842f210f5fef017fb008c9a3d59d4ee4e223b5","observation_id":"3e125952-45ed-4321-b149-c93a964746d1","resolution":{"observed_at":"2026-06-30T06:14:17.966179Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:20:39.16888+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:20:39.16888+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-long.546","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When Not to Trust Language Models: Investigating Effectiveness of Parametric and Non-Parametric Memories","venue":null,"work_id":"29f5140a-4d58-413f-8205-4e2d6e7cab77","year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:8c1fac90aca722d93fbba5cd40f53b741d002fec1c3eda02aff9089cd42c9a59","observation_id":"8c4d7934-d9ef-408c-9c44-ee2575e2acc7","resolution":{"observed_at":"2026-06-30T06:14:17.935621Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T09:08:05.185105+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T09:08:05.185105+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":"2404.14219","doi":"10.48550/arxiv.2404.14219","metadata_source":"pith","pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","venue":"cs.CL","work_id":"feef9556-a016-493c-abd2-0c97a23a7ebf","year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:7e40d326177b0afe250a574d5ab4e1f54181895b37f0ff1ca1e4f029f6028047","observation_id":"d94f1102-1ed9-4d1f-8b58-6c765fe6e640","resolution":{"observed_at":"2026-06-30T06:14:17.896880Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":"2408.00118","doi":"10.48550/arxiv.2408.00118","metadata_source":"pith","pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","venue":"cs.CL","work_id":"4dd94e2f-2b27-4cbf-88a0-4910f0772a57","year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:d5f9d3c1f77fec54c991372968fbfa6ab34e198d49f3d483002b59ccfd29fcb9","observation_id":"a95aabf5-3bc0-4d16-ac36-6148ba30704a","resolution":{"observed_at":"2026-06-30T06:14:19.019157Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.183082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:9ea1b82d35a9c01f4ae69995ab61da0b67c083272cd0fd2946ddaa87cf1bdc87","observation_id":"3f7bf0de-5d66-4c76-adf6-8ad6a3bebbb6","resolution":{"observed_at":"2026-06-30T06:14:19.039494Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:dfb421a9d61ebd242f64c3e38a26d34d78aa07eeac77d1ff4baaf47e5541556c","observation_id":"f583b4d6-1128-437d-8587-7cbe14e5b2d5","resolution":{"observed_at":"2026-06-30T06:14:19.034810Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19887","last_updated":"2024-07-03T14:30:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-28T23:55:06Z","title":"Jamba: A Hybrid Transformer-Mamba Language Model","version":2},"cited_work":{"arxiv_id":"2403.19887","doi":"10.48550/arxiv.2403.19887","metadata_source":"pith","pith_arxiv_id":"2403.19887","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jamba: A Hybrid Transformer-Mamba Language Model","venue":"cs.CL","work_id":"129df0fe-8a66-4077-8991-3557cfa38274","year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2403.19887","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:9605801ec216184cbf50ebf2daeb8c23a2b3cd9713524c49d5868a245a94cbe7","observation_id":"390d967e-00ab-4d7b-998d-6a98a969ac33","resolution":{"observed_at":"2026-06-30T06:14:19.015937Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-02T13:11:16.882565Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":"2401.02954","doi":"10.48550/arxiv.2401.02954","metadata_source":"pith","pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","venue":"cs.CL","work_id":"01b10587-025b-499d-8ba3-7a538d24c2d6","year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:de6479cb417e906b275367b0907129f6974e8631975ead0d9f53c47852170291","observation_id":"459754d1-a9fb-4fed-880d-6754bd8533f7","resolution":{"observed_at":"2026-06-30T06:14:19.018738Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":"2401.04088","doi":"10.48550/arxiv.2401.04088","metadata_source":"pith","pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixtral of Experts","venue":"cs.LG","work_id":"0de8c352-9daa-4e1e-8c7b-3d0dec69f369","year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:3de53c20228ddb2549c1d0774e3382f1dc0e691c33537e1df1ad0adaa8baac4d","observation_id":"69231bdf-0594-4da1-990f-722434ee76a3","resolution":{"observed_at":"2026-06-30T06:14:19.022068Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Journal on Machine Learning Research , volume = 25, pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:c1982359a158b6284a2c7d3265d86ce56b68e0eade62f3227b8627f3ab074c39","observation_id":"a0a12c70-926e-4d7e-9657-bebd358191a4","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"First Conference on Language Modeling,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:63a64cc90841641cf03432165fa702f3ca749cf92401c03092bfa0da2ca6834e","observation_id":"c50007fb-2614-4f4f-8b88-588620925eaa","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Forty-first International Conference on Machine Learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:0670796f94ed7af8440d6cbc1aa64f52fdd7f874bfab2ae99d6b0dd2eb97eb57","observation_id":"0736ff25-d907-46f3-aa54-addb5a5bf80f","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Forty-first International Conference on Machine Learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:2968824e93880a9cb26891409689eabfb88a57c888fcc540748866219da21c6c","observation_id":"1ca3baea-abe3-4d30-8914-5a057f161710","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Can Mamba Learn How To Learn?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:e799947f45083960658156b35f174b2e8384a6684c0ecc96d2bf2c3cc037e18a","observation_id":"8ed6e034-5516-4ac6-ac3c-610a67bac9e0","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Forty-first International Conference on Machine Learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:e0d8f466df5ed64f9c77365cb061fa9fe350dcfacba11ad858a8c5ce21696b62","observation_id":"930ba89f-79c4-4cd2-8ad8-b6fd3fb2df94","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Forty-first International Conference on Machine Learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:d721e1f1a9e393ad2773c43904e47943d9ba02ae88373d833f6c06a4a87880fb","observation_id":"138568a2-e541-4917-bd1e-4f31687d4283","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Forty-first International Conference on Machine Learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:804ea00f3a2fda16c401aefebcc9ff30d3eb721b6850c6ccaf12a527647b8c1f","observation_id":"febca6fc-66b3-4106-985f-ff4d1ee9013d","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:36a9811c2bfdb835d0ca16c7cbbf9d068a780fffa37323a462d541e9ccb74c1e","observation_id":"7859ad6d-f450-4825-918e-9459f2c0b01a","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:d82c229a5f81323576cfc7db3f305eecdf5572dab5281987f60ef05d38a71a49","observation_id":"daeaa7b9-3a87-4375-9e89-f80970353f3d","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:676fb1d134af64c7cbfc53b1eb7ff89a20740ff2512b22c6a9a5d7e08c7bcb69","observation_id":"0530269c-426f-41a3-a2b9-73ec326e7b70","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:6043b7d4897534cdbde4210b7579cfb8e4462b1fc4854c9f040432cb57dfa42d","observation_id":"ec299efd-16d5-4f7e-bf8f-a4733b05e2f6","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:3bff4e4cca8e9d87bb5a2879cf377e067d11ea4e2e817e34268313b22ff49dec","observation_id":"b3000106-9e08-4f98-87b3-f18bb09635de","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"International Conference on Computational Linguistics,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:19cfbcf1bdbb3ca97853ca2c0e3695e56c57ada25c8bc51bcc4498b2c9df6076","observation_id":"5ac0ef00-58d6-4776-8f30-27da912ee8a4","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:3313e64c27c777d2bbba1abc37f3c06dcb51706bf31dbc1a907049a0925c9db4","observation_id":"e9a85cac-36fa-45f5-87d2-f06e0ec9fc3f","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Proceedings of the Workshop on Intrinsic and Extrinsic Evaluation Measures for Machine Translation and/or Summarization@ACL 2005, Ann Arbor, Michigan, USA, June 29, 2005 , pages =","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:9996c1aeb7f292c8be05490b13bc6393efec1cdb567bfbb9d71e6d4b2f06f6d5","observation_id":"3ce1307d-fa80-43e3-b6c8-b0f0fc850615","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:09f77f8245a7d1153b1b2946908fc2731ba7dbb29841031887d4ee12375b7196","observation_id":"45fd213f-58d2-4b4f-bdc8-ef9bb28fcf08","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:1061fcb208b33b398ade994a9680e2bae28dc3dcf189a32b2cf016b7523e47b3","observation_id":"c70324fb-e046-4423-86e3-5bef259e5e93","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.172","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongBench","venue":null,"work_id":"334e52dd-5eee-49da-94cd-26c0028afe5c","year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:8bf8223b67716744c53b466b2df2ef54498beb7e9c33b2febadc07137fdf4ece","observation_id":"17067d21-2b84-46aa-8e4d-57e247ccbe5d","resolution":{"observed_at":"2026-06-30T06:14:17.910456Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:49:42.194817+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:49:42.194817+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:bfc24f812b9f0ffe83efbc1e60043b502057012fe2b7ff7a6e2f770c9254d822","observation_id":"4d2c6405-ca41-4ea8-985a-14bb5fd84f8f","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.404","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient Classification of Long Documents via State-Space Models , booktitle =","venue":null,"work_id":"85b660c6-8154-4763-8cfb-815c853d66d1","year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:24ebee6e9b3b5152e57ba137327a56a87dd8e89fba58789a250f075c805feab2","observation_id":"11948054-e5ef-412a-a477-cd7d4219700c","resolution":{"observed_at":"2026-06-30T06:14:17.949283Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.naacl-long.147","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReGLA: Refining Gated Linear Attention , booktitle =","venue":null,"work_id":"2acb08f5-10bf-46ff-808c-46ef88a13e42","year":2025},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:0afd60264b1e67913831d346a304ff3b3fee9fe3e8109b25e88f26f6dfe23250","observation_id":"cda2ee8c-19ca-45f6-8501-72ac2884b987","resolution":{"observed_at":"2026-06-30T06:14:17.927912Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21526","last_updated":"2026-04-21T03:10:04Z","snapshot_observed_at":"2026-07-06T22:04:20.800847Z","submitted_at":"2025-07-29T06:28:23Z","title":"Accelerating Prefilling via Decoding-time Contribution Sparsity","version":4},"cited_work":{"arxiv_id":"2507.21526","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.21526","snapshot_observed_at":"2026-06-30T06:14:19.020219Z","title":"Accelerating Prefilling via Decoding-time Contribution Sparsity","venue":"cs.CL","work_id":"e2d52e1f-056c-415e-af4a-8b3dfe4d0817","year":2025},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2507.21526","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:8738b8bab080495502f8b25adc6b547c45bd1a15c8e1abb5114c51e4d2c66fb0","observation_id":"f3f8182f-2bde-423a-92d5-304f40faf09e","resolution":{"observed_at":"2026-06-30T06:14:19.022993Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0006.361316","doi":"10.1145/3600006.3613163","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention , booktitle =","venue":null,"work_id":"1b10f2a9-a178-4d23-97fb-8db2354c7e6c","year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:b572292bd9ea38cf1b99c7d196479a0942f1ec35591a158d48bf4fccf134254e","observation_id":"4919f65a-153b-44dc-ba30-f67b74b6cf6e","resolution":{"observed_at":"2026-06-30T06:14:17.925153Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:ac281625f13ad233a34f34ecf6b1b362ef71cdd024aea3d2fa78ca10557d7ea4","observation_id":"f1378b9f-fa3e-4aa6-baab-3bb0db8318f5","resolution":{"observed_at":"2026-06-30T06:14:17.964219Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:4da1a63872e4c9f78409da7d1ec3d0fe0120a189eae31c045fdeddcfeb346ed6","observation_id":"ea2ff44d-9616-498c-a0ae-369747185a57","resolution":{"observed_at":"2026-06-30T06:14:17.904552Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T11:08:05.851253+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T11:08:05.851253+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:4dec524054d04a8a7535466090ade47346eada1e8c246b6dcbcb9652c6f8d052","observation_id":"88874431-241c-4dbd-be1f-8800f66ff501","resolution":{"observed_at":"2026-06-30T06:14:17.968813Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:664ac78aa2a7b4474efb3788aa394de1d29d71f9ced8ca2bba562058fd816fdf","observation_id":"fbf78d4f-36d4-4c84-b400-a1ca3fd9a5c6","resolution":{"observed_at":"2026-06-30T06:14:17.956953Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":"2004.05150","doi":"10.48550/arxiv.2004.05150","metadata_source":"pith","pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Longformer: The Long-Document Transformer","venue":"cs.CL","work_id":"abea7a44-6668-4de7-aab6-f53a6e5aa088","year":2020},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:f09d86baebff55605ce5620c1e1c05592b2efb3c714b198a82ff2baa2a184271","observation_id":"0fd509a2-17eb-4091-8b26-dd77a6bb43e6","resolution":{"observed_at":"2026-06-30T06:14:19.028909Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":"1911.02150","doi":"10.48550/arxiv.1911.02150","metadata_source":"pith","pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","venue":"cs.NE","work_id":"160ea164-b1d4-4adb-8ccb-a4655d8a0bb4","year":2019},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:07bd1cb0e2b22f1610b02e11ccb816513daa0aa615de5476b075db6bda7de66c","observation_id":"d6b54d65-c204-46f8-905a-ec391b0162f4","resolution":{"observed_at":"2026-06-30T06:14:19.015154Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.298","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GQA : Training generalized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":"eadb5933-87f2-4102-94c8-52fe2ccbc1e2","year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:f17c2b1ceb854292c8d455ef9b980dac428c1dc4e0fe130bd4718554ac49cd8a","observation_id":"2733dc2e-24fd-4ca1-a428-7372dfe3ef78","resolution":{"observed_at":"2026-06-30T06:14:17.943663Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-13T23:49:40.00604+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T23:49:40.00604+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.11412","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:00:07.959480Z","title":"Under review","venue":null,"work_id":"1319e5c0-845f-4557-99c6-528dcfca5d46","year":2026},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:ced895e924bb972984f34f2886b8f94afc6553aa4575b4c5606b5d55a27e8344","observation_id":"fe18fa74-5313-4e88-a221-90f354625107","resolution":{"observed_at":"2026-06-30T06:14:19.025990Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.967","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Are Decoder-Only Language Models Better than Encoder-Only Language Models in Understanding Word Meaning?","venue":null,"work_id":"4140ae73-3c3d-47b7-bcbb-fef38b6b93a3","year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:b70143fac3911829098bad7daf95a0803e3f4002ec215a13a5200b7b4bcbda48","observation_id":"fb2f665e-b249-4dbd-a6d4-eb53e9909cd7","resolution":{"observed_at":"2026-06-30T06:14:17.930409Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"DeTriever: Decoder-representation-based Retriever for Improving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:c56891fadad5451d9f27f813dd739116d3940d67d51a7aecfe4faa6736ff3465","observation_id":"6e6a2150-7a3c-4755-9f5d-22f4453f34c8","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"NeurIPS 2023 Workshop on Instruction Tuning and Instruction Following , year=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:1c50484941d51481a824154f2d00decf4bd834789546b5784c43a76953680f2b","observation_id":"b4cf94b4-2518-49b4-a6c6-1b3ad783f1f1","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02060","last_updated":"2024-06-12T02:46:16Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T15:59:11Z","title":"Long-context LLMs Struggle with Long In-context Learning","version":3},"cited_work":{"arxiv_id":"2404.02060","doi":"10.48550/arxiv.2404.02060","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.02060","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Long- context llms struggle with long in-context learning","venue":"arXiv (Cornell University)","work_id":"595d1e20-91fe-461e-9442-4baeb3560aee","year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2404.02060","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:7eeb1655d72d210328fe280b3032e4febb538137194eee1a31d03d7b208c76fe","observation_id":"05aeba3b-0582-44f7-9d3c-69f7309d4e74","resolution":{"observed_at":"2026-06-30T06:14:17.965737Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"How Well Can a Long Sequence Model Model Long Sequences? Comparing Architectural Inductive Biases on Long-Context Abilities , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:c9c72897fc6c36968eb337c086a6124e901ac690fdc8d94ad559a4c6e6212342","observation_id":"0d017267-820b-4df7-b1f8-66940d5f1c33","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.emnlp-main.550","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T20:05:33.949387Z","title":"Dense Passage Retrieval for Open-Domain Question Answering","venue":"Proceedings of the 2020 Conference on Empirical Methods in Natural Language Processing (EMNLP)","work_id":"083391f8-812d-430f-8d08-89a03031ce6c","year":2020},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:eb46525b9a6e53b2769858a08dad452ff5a35208d2c29f8fc8199e7afa140f95","observation_id":"0ffed6e6-bc53-4a79-91c8-19f4a8560ca8","resolution":{"observed_at":"2026-06-30T06:14:17.978453Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T13:38:13.70004+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T13:38:13.70004+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Proceedings of the 37th International Conference on Machine Learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:b8c44656f1dc1d4db7c134776987c3d91c350624db5984472b7cfeb6f4cc3a20","observation_id":"2dea12d1-5b1a-483d-b2b5-3f92d309faaa","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Atlas: Few-shot Learning with Retrieval Augmented Language Models , journal =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:fb81e23adf58ed021440bdcd93d1493147032e68b34199a557d796e382f1d7ea","observation_id":"da87887c-0802-4159-ab76-762d3d719011","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:0cbe13787673d93a9c04dbb4ce01a139a81e1489ed283ac1343d47e1816d075d","observation_id":"bdb3f1e7-b986-4629-a9dd-3d3bdf1f17aa","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":"2310.06825","doi":"10.48550/arxiv.2310.06825","metadata_source":"pith","pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mistral 7B","venue":"cs.CL","work_id":"eb5e1305-ad11-4875-ad8d-ad8b8f697599","year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:72dc5bc426b6a5194221073f833393ed58ed8b982a9d0076c46f1648221f75af","observation_id":"411483e9-f65a-4870-b64f-b9975ccd2b0c","resolution":{"observed_at":"2026-06-30T06:14:17.954054Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"2019 , eprint=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:a86143739fc7298616a4396ec32b1be0d02f1e422eb30fe931f1fe01c7ce2435","observation_id":"7ccea5c7-66bd-4881-9ced-e0f0cd48fd39","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"SparseBERT: Rethinking the Importance Analysis in Self-attention , booktitle =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:17d8796a526a894d63f9602261a2116351d1bb261a45ef4280c7392c4bae7e8b","observation_id":"e827a778-dcea-495b-9cb9-0ec0b488a731","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02486","last_updated":"2023-07-19T12:25:35Z","snapshot_observed_at":"2026-08-05T18:04:01.030198Z","submitted_at":"2023-07-05T17:59:38Z","title":"LongNet: Scaling Transformers to 1,000,000,000 Tokens","version":2},"cited_work":{"arxiv_id":"2307.02486","doi":"10.48550/arxiv.2307.02486","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02486","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2307.02486 (2023)","venue":"arXiv (Cornell University)","work_id":"d2bcbcf1-3536-4da3-a03e-007066557381","year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2307.02486","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:36578d6a111d27ea4b0e043abbbd811caaf776d756933b0cb68a2784bc389f81","observation_id":"b5dc1aca-f97f-4b6b-b56e-f1f328b8022f","resolution":{"observed_at":"2026-06-30T06:14:17.915989Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"8th International Conference on Learning Representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:3964404eece8ee522a97366a3ade0b88d5e9b7a897f8c6baaa8a8eeb6f6a2c26","observation_id":"56af077c-4cc4-46df-b367-cd22fb5271cb","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03172","last_updated":"2023-11-20T23:09:34Z","snapshot_observed_at":"2026-07-06T15:51:12.179086Z","submitted_at":"2023-07-06T17:54:11Z","title":"Lost in the Middle: How Language Models Use Long Contexts","version":3},"cited_work":{"arxiv_id":"2307.03172","doi":"10.1162/tacl","metadata_source":"pith","pith_arxiv_id":"2307.03172","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Lost in the Middle: How Language Models Use Long Contexts","venue":"cs.CL","work_id":"37c05e13-4a24-44f8-a1c4-da1bbe7223aa","year":2023},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"cited_paper":"/paper/2307.03172","citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:a4511cc47e71947455801b8ab1d43766ecbf34a6ff09f6e000d65fa123fd8d77","observation_id":"4e78b377-09a6-4a68-9174-7d70dbc169de","resolution":{"observed_at":"2026-06-30T06:14:17.918553Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:11:23.742632Z","title":"Ponti , title =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-06-30T06:11:23.742632Z"},"links":{"citing_paper":"/paper/2606.29844"},"observation_digest":"sha256:cbfa36e476d9b11b7d8337f0d5d2b7091c916309fb0079c23fa8bd6b8b9df189","observation_id":"e4b463a2-54d8-4315-93eb-1327c632693b","resolution":{"observed_at":"2026-06-30T06:11:23.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.29844","last_updated":"2026-06-29T06:33:37Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T00:15:01.794218Z","submitted_at":"2026-06-29T06:33:37Z","title":"MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":23,"parse_uncertain":0,"unresolved":60,"verified_exact":16,"verified_fuzzy":0},"total_outbound_references":121},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 100 of 121 outbound references and 0 inbound Pith citation observations for arXiv:2606.29844."}