{"as_of":"2026-08-09T13:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b4b2f4542e04820b6d76482917d99569aa90519be9feac6dc53577243a810ef","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":35,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:25:16.984092Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-13T18:00:53.389420Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2404.06395"},"observation_digest":"sha256:232a166248e9b67103800abf52dddbd1b461010aa0dc011f2e1b13cbe777af5a","observation_id":"131b3c3b-b1de-4099-a819-baee0149ff7e","resolution":{"observed_at":"2026-05-13T18:00:53.511381Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2406.04264","last_updated":"2025-01-01T15:53:58Z","snapshot_observed_at":"2026-08-03T20:38:36.602554Z","submitted_at":"2024-06-06T17:09:32Z","title":"MLVU: Benchmarking Multi-task Long Video Understanding","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-14T19:55:26.333923Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2406.04264"},"observation_digest":"sha256:cf16d0c2b0f1ad1283ad5fe32c9c60cf42bd42c9aaaa4a887d9a3546f3f2d6f3","observation_id":"61d27b91-65d6-485d-908a-ca05b83339af","resolution":{"observed_at":"2026-05-14T19:55:26.502053Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2502.01941","last_updated":"2026-05-12T08:04:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T02:23:06Z","title":"Semantic Integrity Matters: Benchmarking and Preserving High-Density Reasoning in KV Cache Compression","version":4},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-23T04:15:36.906263Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2502.01941"},"observation_digest":"sha256:e3ba6fb6a66b0b4f63b50aef78050f1c31fd52fb0c48cf0b85e541efa9cced50","observation_id":"3e30bb0f-e511-45ba-b73e-943899986e8b","resolution":{"observed_at":"2026-05-23T04:17:31.180588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-08T20:07:33.797188Z","title":"K., Han, X., Thai, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05167","last_updated":"2025-07-09T14:35:23Z","snapshot_observed_at":"2026-08-08T19:59:08.845558Z","submitted_at":"2025-02-07T18:49:46Z","title":"NoLiMa: Long-Context Evaluation Beyond Literal Matching","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T20:07:33.797188Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2502.05167"},"observation_digest":"sha256:5b4f487fa2dbcb27e572b4a913c636954f7fdc4a65bd2edd6c5f65a1e35517f4","observation_id":"613c0194-d071-4128-8a77-b9f1fd881478","resolution":{"observed_at":"2026-08-08T20:07:33.797188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-08T20:25:16.984092Z","title":"bench: Extending long context evaluation beyond 100k tokens, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.984092Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:d4d81ad22c9ffb94043705fc970afd2108eddd3b2881a778988cccbb57a38ebb","observation_id":"c4e73476-9160-44b4-97d4-1b5ad729b0da","resolution":{"observed_at":"2026-08-08T20:25:16.984092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-07T23:19:37.949529Z","title":"K., Han, X., Thai, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08910","last_updated":"2025-02-13T02:52:01Z","snapshot_observed_at":"2026-08-09T08:05:54.940220Z","submitted_at":"2025-02-13T02:52:01Z","title":"InfiniteHiP: Extending Language Model Context Up to 3 Million Tokens on a Single GPU","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T23:19:37.949529Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2502.08910"},"observation_digest":"sha256:e07633697be3f29a6311e60ba283eaed3c8c2251d5d067262bc194f27096d699","observation_id":"7df593e2-e375-404e-be22-b30d877a80c0","resolution":{"observed_at":"2026-08-07T23:19:37.949529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-07T20:56:53.962989Z","title":"needle-in-a-haystack","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09597","last_updated":"2025-02-13T18:52:03Z","snapshot_observed_at":"2026-08-07T20:50:37.813735Z","submitted_at":"2025-02-13T18:52:03Z","title":"Do LLMs Recognize Your Preferences? Evaluating Personalized Preference Following in LLMs","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T20:56:53.962989Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2502.09597"},"observation_digest":"sha256:32a1c0b9574816901a7298de06cf4f8667ae550da12266a2594ccd9bf0ff1fce","observation_id":"d2df9c47-4011-41fa-ab68-c3d47672659b","resolution":{"observed_at":"2026-08-07T20:56:53.962989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-07T14:40:56.019774Z","title":"One of the special magic numbers for deep-astrology is: 3365093","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18092","last_updated":"2025-05-27T09:42:25Z","snapshot_observed_at":"2026-08-07T14:33:20.156940Z","submitted_at":"2025-05-23T16:47:00Z","title":"QwenLong-CPRS: Towards $\\infty$-LLMs with Dynamic Context Optimization","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:40:56.019774Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2505.18092"},"observation_digest":"sha256:a8e0d5c6c5282c924883a445543e2ed2d4142053ec02aaa3bbc0cc87ef1f66ff","observation_id":"743f2d16-f512-428a-a506-87516fafeef0","resolution":{"observed_at":"2026-08-07T14:40:56.019774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-07T04:13:17.794692Z","title":"bench: Extending long context evaluation beyond 100k tokens, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.794692Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:95b25a16a35a5830ea3c3deb8d9c17518e6aa4f5a0381fbc2e8fc8fe5c213b05","observation_id":"f936a41a-b2a4-4d44-b710-f6820d013140","resolution":{"observed_at":"2026-08-07T04:13:17.794692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2509.22630","last_updated":"2026-04-24T05:03:12Z","snapshot_observed_at":"2026-07-06T22:30:55.313733Z","submitted_at":"2025-09-26T17:55:22Z","title":"StateX: Enhancing RNN Recall via Post-training State Expansion","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T12:27:06.616920Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2509.22630"},"observation_digest":"sha256:58ab6f7def71168c52d63e1db81f7ebb2d442f9fbf6daf5872bede85b00ab22b","observation_id":"b02d03ba-048e-436f-8d19-bc15d32c8d47","resolution":{"observed_at":"2026-05-18T12:31:22.135209Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-04T09:11:58.610538Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.16928","last_updated":"2026-06-10T23:59:45Z","snapshot_observed_at":"2026-08-07T17:55:57.165449Z","submitted_at":"2025-10-19T16:55:20Z","title":"ChiKhaPo: A Large-Scale Multilingual Benchmark for Evaluating Lexical Comprehension and Generation in Large Language Models","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-04T09:11:58.610538Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2510.16928"},"observation_digest":"sha256:1e531c8caa7ce0318e19ea3d31d9e301bc4f7ebd227e393855460ddd3bdba9b7","observation_id":"2b6bd92f-2b7f-4389-a7ef-76de11f0a04f","resolution":{"observed_at":"2026-08-04T09:11:58.610538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2511.03092","last_updated":"2026-04-08T21:56:44Z","snapshot_observed_at":"2026-08-02T21:39:50.543195Z","submitted_at":"2025-11-05T00:38:31Z","title":"SnapStream: Efficient Long Sequence Decoding on Dataflow Accelerators","version":6},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T01:59:30.583027Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2511.03092"},"observation_digest":"sha256:30fb581f79eb667b952cd7e2faf59d7522480bcd7eaa3931ddf882c5e8ee963b","observation_id":"0b58d72a-6099-4f09-991f-47c904079b56","resolution":{"observed_at":"2026-05-18T02:00:39.299754Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-03T12:42:28.024235Z","title":"∞bench: Extending long context evaluation beyond 100k tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02023","last_updated":"2026-07-14T21:47:31Z","snapshot_observed_at":"2026-08-08T04:32:46.940287Z","submitted_at":"2026-01-05T11:30:56Z","title":"Not All Needles Are Found: How Fact Distribution and Don't Make It Up Prompts Shape Retrieval, Reasoning, and Hallucination in Long-Context LLMs","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T12:42:28.024235Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2601.02023"},"observation_digest":"sha256:7d22d08e7e2b252b7f2c87bc5b48c3e89ad00a5cf1a7e7f4bdfdea7a6f6e8558","observation_id":"1b681f5a-3dfe-4d30-964b-97071f816c23","resolution":{"observed_at":"2026-08-03T12:42:28.024235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2603.23516","last_updated":"2026-04-13T03:01:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-06T02:29:54Z","title":"MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-15T16:00:03.578685Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2603.23516"},"observation_digest":"sha256:5b43f80d142a7e262caec682790c33f5e6cc65efb26612ab574f7d04937a38f1","observation_id":"71ede16f-f364-4be3-9839-37c55f85d1e6","resolution":{"observed_at":"2026-05-15T16:00:10.028746Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2604.06111","last_updated":"2026-04-10T03:07:44Z","snapshot_observed_at":"2026-08-02T21:04:18.191344Z","submitted_at":"2026-04-07T17:21:28Z","title":"AgentCE-Bench: Agent Configurable Evaluation with Scalable Horizons and Controllable Difficulty under Lightweight Environments","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T19:07:46.077831Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2604.06111"},"observation_digest":"sha256:c6f15f6bbdd75f10e4dcbbfff41229f0b4cf8a7755ca6e337aaec57ef0108031","observation_id":"475b7349-4c93-4772-b742-c52e4dc60b7c","resolution":{"observed_at":"2026-05-10T23:30:49.417343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2604.17265","last_updated":"2026-05-12T13:20:03Z","snapshot_observed_at":"2026-08-02T13:37:40.268419Z","submitted_at":"2026-04-19T05:35:06Z","title":"MemSearch-o1: Empowering Large Language Models with Reasoning-Aligned Memory Growth in Agentic Search","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-10T06:15:11.432788Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2604.17265"},"observation_digest":"sha256:ac92af033a9915ff5e90325ac5d6286e97da59e91d1097bfb4981f32617f9af1","observation_id":"fb42417b-c1f9-4f90-a1dd-deea1b670594","resolution":{"observed_at":"2026-05-10T06:16:20.793604Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2604.27043","last_updated":"2026-04-29T17:44:32Z","snapshot_observed_at":"2026-08-03T12:37:08.017930Z","submitted_at":"2026-04-29T17:44:32Z","title":"CL-bench Life: Can Language Models Learn from Real-Life Context?","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-07T09:42:33.635866Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2604.27043"},"observation_digest":"sha256:c6208fc4fcedb9d42a3d54b1d1a964825784de7425983291d50ee4b1379e4c31","observation_id":"c1a03221-8d01-4372-86c2-847e83d522a6","resolution":{"observed_at":"2026-05-12T09:41:27.012435Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2605.07234","last_updated":"2026-05-08T04:37:22Z","snapshot_observed_at":"2026-08-06T04:40:19.152385Z","submitted_at":"2026-05-08T04:37:22Z","title":"Reformulating KV Cache Eviction Problem for Long-Context LLM Inference","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-11T02:37:52.545943Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2605.07234"},"observation_digest":"sha256:c22ffbcd28b862bfb4f0916f7bb5b70185f3e2948f16c67262782fc2a1fd4f8b","observation_id":"ab77f047-e1dd-4cd6-8dd4-c034c6b0419b","resolution":{"observed_at":"2026-05-11T03:10:53.538724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2605.12493","last_updated":"2026-05-12T17:59:34Z","snapshot_observed_at":"2026-07-06T23:24:08.763444Z","submitted_at":"2026-05-12T17:59:34Z","title":"LongMemEval-V2: Evaluating Long-Term Agent Memory Toward Experienced Colleagues","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-13T03:52:58.177144Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2605.12493"},"observation_digest":"sha256:7f282dae1dd9d510e26a90b03d498b848a8f9fb67d7b8b6d8073237548be785f","observation_id":"4153ef6a-b7ff-485d-960b-2b169f97546e","resolution":{"observed_at":"2026-05-13T03:57:12.681055Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2605.23170","last_updated":"2026-05-22T02:42:41Z","snapshot_observed_at":"2026-08-03T03:47:34.013785Z","submitted_at":"2026-05-22T02:42:41Z","title":"Positional Failures in Long-Context LLMs: A Blind Spot in Reasoning Benchmarks","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-25T04:58:15.184063Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2605.23170"},"observation_digest":"sha256:65fda4e903d9a9ab7929a1b0e8c6d838e0236cb0da5eeba817e8685759b60931","observation_id":"544d91ea-4fa1-46e2-9506-bdf78bd4a8f3","resolution":{"observed_at":"2026-05-25T05:00:21.882013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2606.06203","last_updated":"2026-06-04T14:08:30Z","snapshot_observed_at":"2026-08-05T23:46:47.965425Z","submitted_at":"2026-06-04T14:08:30Z","title":"Dense Contexts Are Hard Contexts: Lexical Density Limits Effective Context in LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-28T02:00:37.167896Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2606.06203"},"observation_digest":"sha256:c859ebe27f063867608a30030c8213557f9354423c74e252fe54d5d9dd11c72f","observation_id":"af6999a9-f568-4fb8-9ce1-de878c1585fb","resolution":{"observed_at":"2026-07-02T12:36:56.798880Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2606.17328","last_updated":"2026-06-15T22:21:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-15T22:21:23Z","title":"MemTrace: Probing What Final Accuracy Misses in Long-Term Memory","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-27T03:13:52.804489Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2606.17328"},"observation_digest":"sha256:5015b19e758b75422480ce7b7d312c46927ba73ee4993f57e891eff7f89daa75","observation_id":"b9e625b0-cc9c-47ea-8a77-7a8d71aa27a8","resolution":{"observed_at":"2026-07-03T18:18:49.817849Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2606.17391","last_updated":"2026-06-16T01:04:55Z","snapshot_observed_at":"2026-08-07T20:36:16.553798Z","submitted_at":"2026-06-16T01:04:55Z","title":"NarrativeWorldBench: A Frontier-Saturated Benchmark and a Latent World Model for Long-Horizon Co-Creative Audio Drama","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T01:48:08.794210Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2606.17391"},"observation_digest":"sha256:01bff227a370dbb1cc0d05e1ad298904b46fe37dc55bfdd56a5a1cebfd0fe64f","observation_id":"5119249a-f988-4267-8315-4fd4ebd9bd1d","resolution":{"observed_at":"2026-07-03T19:28:52.480993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2606.21734","last_updated":"2026-06-19T20:43:49Z","snapshot_observed_at":"2026-08-05T18:05:51.515234Z","submitted_at":"2026-06-19T20:43:49Z","title":"HPP: Hierarchical Programmatic Probing for Long Video Understanding by Decoupling Perception and Reasoning","version":1},"reference_index":190,"source":"arxiv_source","source_observed_at":"2026-06-26T14:19:53.450263Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2606.21734"},"observation_digest":"sha256:edc59e97bd3288fb3577a79464715f2b78039bd71b2946d2924b9146a4b04bd4","observation_id":"740ed88a-fa5d-44be-976f-28f5d03c97ed","resolution":{"observed_at":"2026-07-04T06:39:37.667928Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2606.29503","last_updated":"2026-06-28T17:03:01Z","snapshot_observed_at":"2026-08-01T23:44:06.338851Z","submitted_at":"2026-06-28T17:03:01Z","title":"The Verbose Context Problem in Medical Records","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T07:29:42.068362Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2606.29503"},"observation_digest":"sha256:2a137060a65d74c5ba343f5d9b2492d4672397ec4d07e613d46b3f9f36d1a066","observation_id":"5b2d1083-a868-4c2c-b9b3-72eed0357df7","resolution":{"observed_at":"2026-06-30T07:34:21.563320Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2606.29708","last_updated":"2026-06-30T03:13:37Z","snapshot_observed_at":"2026-07-07T00:03:41.292432Z","submitted_at":"2026-06-29T02:24:13Z","title":"Demystifying the Design Space and Best Practices for Heterogeneous LLM Inference and Serving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T05:37:13.211613Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2606.29708"},"observation_digest":"sha256:9f5e134b1eb27d38b3b8f4064d7053861e250b7f2820d1b121e2e9c99083bdd6","observation_id":"cbad6bff-9346-4594-988c-675e45938fee","resolution":{"observed_at":"2026-06-30T14:04:45.298052Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2606.29708","last_updated":"2026-06-30T03:13:37Z","snapshot_observed_at":"2026-07-07T00:03:41.292432Z","submitted_at":"2026-06-29T02:24:13Z","title":"Demystifying the Design Space and Best Practices for Heterogeneous LLM Inference and Serving","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-01T07:06:53.318182Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2606.29708"},"observation_digest":"sha256:d06ff82f7c741d09e8adb0e4a48480d679616330494b48d7667c55b5fc020bc0","observation_id":"2b478166-6003-4193-bd26-c3cbaaa49d21","resolution":{"observed_at":"2026-07-01T08:55:35.112954Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":"2402.13718","doi":"10.48550/arxiv.2402.13718","metadata_source":"pith","pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"∞-bench: Extending long context evaluation beyond 100k tokens","venue":"cs.CL","work_id":"1920d14f-6a8c-4b95-b765-32b6de15ebdd","year":2024},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-02T16:38:21.894642Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":149,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:c082ed9a5acba77012763c817644fe7aef3239454db46267cc3a2eb362e58f59","observation_id":"3c810e5b-db20-4172-a8f9-efac3c8dc984","resolution":{"observed_at":"2026-07-10T01:36:44.321053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-07-13T03:52:24.872919Z","title":"org/abs/2402.13718","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09328","last_updated":"2026-07-23T17:56:03Z","snapshot_observed_at":"2026-08-05T04:17:50.821563Z","submitted_at":"2026-07-10T12:09:21Z","title":"WildTrace: Benchmarking Natural Evidence Trails in Long-Context Reasoning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T03:52:24.872919Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2607.09328"},"observation_digest":"sha256:8631d5996cec416b330ee69cc813d8932dfd1ee6158c7ce611745b7da1425096","observation_id":"95a74e48-2564-44cb-8a06-3dccc99dfdee","resolution":{"observed_at":"2026-07-13T03:52:24.872919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-02T07:40:58.784842Z","title":"org/abs/2402.13718","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09328","last_updated":"2026-07-23T17:56:03Z","snapshot_observed_at":"2026-08-05T04:17:50.821563Z","submitted_at":"2026-07-10T12:09:21Z","title":"WildTrace: Benchmarking Natural Evidence Trails in Long-Context Reasoning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T07:40:58.784842Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2607.09328"},"observation_digest":"sha256:4bb61d631246217c960dd084cab197181a334ea6cbfa3e7c1edf0a56d7d48a4b","observation_id":"b8133e90-1526-4ae2-bf84-6b0bf42b83dd","resolution":{"observed_at":"2026-08-02T07:40:58.784842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-01T04:48:29.418599Z","title":"arXiv:2402.13718","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22448","last_updated":"2026-07-27T23:08:28Z","snapshot_observed_at":"2026-08-08T03:02:00.797726Z","submitted_at":"2026-07-24T16:10:21Z","title":"Where Facts Go Missing: A Layerwise Taxonomy and Per-Layer Attribution of Information Omission in Air-Gapped LLMAgent Pipelines","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T04:48:29.418599Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2607.22448"},"observation_digest":"sha256:ea9173396b618e0504c890ab03c85b32f21865a57601b820364c48e806909ac4","observation_id":"62a9804a-a428-4246-988f-f67628a57fed","resolution":{"observed_at":"2026-08-01T04:48:29.418599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-07-30T15:06:50.750693Z","title":"arXiv preprint arXiv:2402.13718 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23722","last_updated":"2026-07-26T15:38:28Z","snapshot_observed_at":"2026-08-09T13:13:40.060087Z","submitted_at":"2026-07-26T15:38:28Z","title":"E-Bench: Benchmarking Multi-Step Tool-Use Agents in Real-World Product Scenarios","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-07-30T15:06:50.750693Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2607.23722"},"observation_digest":"sha256:c0f51770fa4b83ae2bef66e5197113aaef2217598793420fa2351f9556f80210","observation_id":"77af0014-4020-42b7-8390-5fb5d7ca707a","resolution":{"observed_at":"2026-07-30T15:06:50.750693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-01T02:37:54.442812Z","title":"∞bench: Extending long context evaluation beyond 100k tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25380","last_updated":"2026-07-28T07:34:53Z","snapshot_observed_at":"2026-08-08T07:59:40.180280Z","submitted_at":"2026-07-28T07:34:53Z","title":"Memory for Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T02:37:54.442812Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2607.25380"},"observation_digest":"sha256:0de103abfcdd9201476fd02f9dbf59821a2ee64f9f2c1b254c885d1cadc0445e","observation_id":"47cdab76-80e3-4aed-b820-02c3d39a103a","resolution":{"observed_at":"2026-08-01T02:37:54.442812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-07T00:15:00.919480Z","title":"Xinrong Zhang, Yingfa Chen, Shengding Hu, Zihang Xu, Junhao Chen, Moo Khai Hao, Xu Han, Zhen Leng Thai, Shuo Wang, Zhiyuan Liu, and Maosong Sun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01662","last_updated":"2026-08-04T07:46:43Z","snapshot_observed_at":"2026-08-07T23:09:43.802314Z","submitted_at":"2026-08-03T03:51:21Z","title":"LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:00.919480Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2608.01662"},"observation_digest":"sha256:b1a4d71ab7187e9f7e8488650c732b6fa0d49a3a7f06adf5f470abb05147cc06","observation_id":"034893be-4464-47b1-933e-19a3fabebe93","resolution":{"observed_at":"2026-08-07T00:15:00.919480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-07T00:45:48.547366Z","title":"K., Han, X., Thai, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.547366Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:c9316e9f4a611d9b9e84161e78adf32930456fc7cf8c347cd4cbe68b65784f00","observation_id":"b76b7076-7ac9-4a03-9408-1683c1071703","resolution":{"observed_at":"2026-08-07T00:45:48.547366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.13718/citation-record","integrity":"/paper/2402.13718/integrity","json":"/paper/2402.13718/citation-record.json","paper":"/paper/2402.13718"},"outbound":[],"paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 35 inbound Pith citation observations for arXiv:2402.13718."}