{"as_of":"2026-08-07T18:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7fdeef1514b20690772975861a9d2a7a7b45e69ada7bcf12888ca072ce0daf07","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:31:43.210471Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":6,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":"2406.10149","doi":"10.48550/arxiv.2406.10149","metadata_source":"pith","pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bulatov, Petr Anokhin, Ivan Rodkin, Dmitry Sorokin, Artyom Y","venue":"cs.CL","work_id":"3c13d7c5-4137-4127-9390-500e01f37de6","year":2024},"citing_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T03:55:20.355345Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2404.06654"},"observation_digest":"sha256:9406871cb04d03eead43c38a9ad704ee63faf158e8320b7f0228c97addf084d3","observation_id":"dcbe3a3d-3b5a-46fa-b0fa-600ee6d9fdf8","resolution":{"observed_at":"2026-05-11T03:55:20.655690Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-07T14:08:09.869247Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-07T14:00:30.802570Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:09.869247Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:b5b7c40f5dd9939f3566809c3184c9ed7a1d64ebf487df588241d6fb4d080ebc","observation_id":"54cc1b36-120f-4524-a2db-2901e5781a05","resolution":{"observed_at":"2026-08-07T14:08:09.869247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-07T15:31:43.210471Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02000","last_updated":"2025-06-23T01:41:05Z","snapshot_observed_at":"2026-08-07T15:25:33.498661Z","submitted_at":"2025-05-20T20:54:37Z","title":"NovelHopQA: Diagnosing Multi-Hop Reasoning Failures in Long Narrative Contexts","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:31:43.210471Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2506.02000"},"observation_digest":"sha256:f429759e8da473557dd156803daa6dba80dce0d98be4d0ec3b94c803cad49103","observation_id":"37534588-8791-4d18-a9c2-29caca12fa5e","resolution":{"observed_at":"2026-08-07T15:31:43.210471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-07T04:44:03.221816Z","title":"Kuratov, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09849","last_updated":"2025-06-11T15:21:16Z","snapshot_observed_at":"2026-08-07T14:02:52.704779Z","submitted_at":"2025-06-11T15:21:16Z","title":"IntPhys 2: Benchmarking Intuitive Physics Understanding In Complex Synthetic Environments","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:44:03.221816Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2506.09849"},"observation_digest":"sha256:9a75d20313c0b6f1851b396a98be5d84d1bd85929592b0793360cc93071f6be3","observation_id":"2e03c3cd-abd0-49d9-a16a-3c4563e4d3a2","resolution":{"observed_at":"2026-08-07T04:44:03.221816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-07T10:17:46.769302Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10019","last_updated":"2025-06-06T11:09:46Z","snapshot_observed_at":"2026-08-07T10:10:45.315025Z","submitted_at":"2025-06-06T11:09:46Z","title":"A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations","version":1},"reference_index":156,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:46.769302Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2506.10019"},"observation_digest":"sha256:546493ecf3caa05e30209d8726e2bb0d406f0e0cc038969e7f9cca8511f97654","observation_id":"39fbe1fd-1b36-448d-8992-9e86b99e4ae2","resolution":{"observed_at":"2026-08-07T10:17:46.769302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-06T19:45:12.466041Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04723","last_updated":"2025-07-07T07:33:24Z","snapshot_observed_at":"2026-08-07T06:43:20.530023Z","submitted_at":"2025-07-07T07:33:24Z","title":"LOOM-Scope: a comprehensive and efficient LOng-cOntext Model evaluation framework","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:12.466041Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2507.04723"},"observation_digest":"sha256:61c8a6c7984c5be747d49a8856e3a509c2fd05ece6490aa3c80612dd4b83540a","observation_id":"e97b852f-4873-4ae1-adbe-de8d3a8c5f21","resolution":{"observed_at":"2026-08-06T19:45:12.466041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-05T22:12:56.219629Z","title":"Mosh Levy, Alon Jacoby, and Yoav Goldberg","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.07479","last_updated":"2025-08-10T20:40:24Z","snapshot_observed_at":"2026-08-07T00:34:30.717760Z","submitted_at":"2025-08-10T20:40:24Z","title":"Positional Biases Shift as Inputs Approach Context Window Limits","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T22:12:56.219629Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2508.07479"},"observation_digest":"sha256:e14fcec0ca859a6ce7b79e073ea5ddbb7436053261dee55fb2b02ad9ecacae04","observation_id":"902bc66f-9254-4443-bada-97d472af23bf","resolution":{"observed_at":"2026-08-05T22:12:56.219629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":"2406.10149","doi":"10.48550/arxiv.2406.10149","metadata_source":"pith","pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bulatov, Petr Anokhin, Ivan Rodkin, Dmitry Sorokin, Artyom Y","venue":"cs.CL","work_id":"3c13d7c5-4137-4127-9390-500e01f37de6","year":2024},"citing_paper":{"arxiv_id":"2511.12676","last_updated":"2026-04-20T15:58:25Z","snapshot_observed_at":"2026-08-03T08:02:06.363721Z","submitted_at":"2025-11-16T16:30:38Z","title":"BridgeEQA: Virtual Embodied Agents for Real Bridge Inspections","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-17T21:40:51.426489Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2511.12676"},"observation_digest":"sha256:833f30c573467e4f1e39acf3d5ae523702d35011f6a26f5ee76ae80a23963818","observation_id":"7e42fbbc-7002-4020-9ab2-847602c1be3e","resolution":{"observed_at":"2026-05-17T21:42:07.490897Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-03T12:42:27.870418Z","title":"BABILong: Testing the limits of LLMs with long context reasoning-in-a-haystack,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02023","last_updated":"2026-07-14T21:47:31Z","snapshot_observed_at":"2026-08-04T07:31:52.300054Z","submitted_at":"2026-01-05T11:30:56Z","title":"Not All Needles Are Found: How Fact Distribution and Don't Make It Up Prompts Shape Retrieval, Reasoning, and Hallucination in Long-Context LLMs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T12:42:27.870418Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2601.02023"},"observation_digest":"sha256:b83e45a71d32a65ad3cfe6d046c36cd5c50364c67a847fd801d6947c5aeccacb","observation_id":"e56728d6-6922-42a7-8896-6aef5a8a41dd","resolution":{"observed_at":"2026-08-03T12:42:27.870418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":"2406.10149","doi":"10.48550/arxiv.2406.10149","metadata_source":"pith","pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bulatov, Petr Anokhin, Ivan Rodkin, Dmitry Sorokin, Artyom Y","venue":"cs.CL","work_id":"3c13d7c5-4137-4127-9390-500e01f37de6","year":2024},"citing_paper":{"arxiv_id":"2605.02173","last_updated":"2026-05-04T03:05:56Z","snapshot_observed_at":"2026-07-29T15:21:30.847953Z","submitted_at":"2026-05-04T03:05:56Z","title":"Retrieval and Multi-Hop Reasoning in 1M-Token Context Windows: Evaluating LLMs on Classical Chinese Text","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-09T16:46:02.443761Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2605.02173"},"observation_digest":"sha256:398c875fa2c960ce1a3da56d108ec2e6c39602ded93a596e1b1acbdc94e0e365","observation_id":"cc35383c-c636-4fbf-954f-9f50c968b197","resolution":{"observed_at":"2026-05-11T16:26:09.838239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":"2406.10149","doi":"10.48550/arxiv.2406.10149","metadata_source":"pith","pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bulatov, Petr Anokhin, Ivan Rodkin, Dmitry Sorokin, Artyom Y","venue":"cs.CL","work_id":"3c13d7c5-4137-4127-9390-500e01f37de6","year":2024},"citing_paper":{"arxiv_id":"2605.23170","last_updated":"2026-05-22T02:42:41Z","snapshot_observed_at":"2026-08-03T03:47:34.013785Z","submitted_at":"2026-05-22T02:42:41Z","title":"Positional Failures in Long-Context LLMs: A Blind Spot in Reasoning Benchmarks","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-25T04:58:15.184063Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2605.23170"},"observation_digest":"sha256:ce753e082edca99209035123e7400a2196ffc919accdb80c056547c0dc5efba0","observation_id":"b95822b3-b6f5-48a9-811f-eb0545578443","resolution":{"observed_at":"2026-05-25T05:00:21.910436Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":"2406.10149","doi":"10.48550/arxiv.2406.10149","metadata_source":"pith","pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bulatov, Petr Anokhin, Ivan Rodkin, Dmitry Sorokin, Artyom Y","venue":"cs.CL","work_id":"3c13d7c5-4137-4127-9390-500e01f37de6","year":2024},"citing_paper":{"arxiv_id":"2606.06758","last_updated":"2026-06-08T19:53:29Z","snapshot_observed_at":"2026-08-01T15:02:29.085490Z","submitted_at":"2026-06-04T22:44:57Z","title":"Diagnosing Evidence Utilization in Long-Context and Retrieval-Augmented Language Models under Matched Evidence Conditions","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T00:56:58.759665Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2606.06758"},"observation_digest":"sha256:16f2d9dd19f2d02f3b28aed2229941a63ee200e0fcfbd8638bd35b07d69a23f5","observation_id":"9fdcd53c-50f1-43f1-a1ff-93b82fc0110a","resolution":{"observed_at":"2026-07-02T13:46:59.863455Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":"2406.10149","doi":"10.48550/arxiv.2406.10149","metadata_source":"pith","pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bulatov, Petr Anokhin, Ivan Rodkin, Dmitry Sorokin, Artyom Y","venue":"cs.CL","work_id":"3c13d7c5-4137-4127-9390-500e01f37de6","year":2024},"citing_paper":{"arxiv_id":"2606.06840","last_updated":"2026-06-05T02:32:24Z","snapshot_observed_at":"2026-08-05T15:03:33.373071Z","submitted_at":"2026-06-05T02:32:24Z","title":"Characterize Then Distill: Mechanistic Reasoning in Large Output Spaces","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-06-27T22:22:52.690010Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2606.06840"},"observation_digest":"sha256:48f91a0777448c740a3fc0a0c1415c9f7a501888a70a72142fb13d19f66d2f88","observation_id":"6e02aa06-8a04-4e02-9488-c52188e65884","resolution":{"observed_at":"2026-06-27T22:31:21.491643Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":"2406.10149","doi":"10.48550/arxiv.2406.10149","metadata_source":"pith","pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bulatov, Petr Anokhin, Ivan Rodkin, Dmitry Sorokin, Artyom Y","venue":"cs.CL","work_id":"3c13d7c5-4137-4127-9390-500e01f37de6","year":2024},"citing_paper":{"arxiv_id":"2606.11470","last_updated":"2026-06-09T21:59:37Z","snapshot_observed_at":"2026-07-06T23:50:35.052764Z","submitted_at":"2026-06-09T21:59:37Z","title":"The Periodic Table of LLM Reasoning: A Structured Survey of Reasoning Paradigms, Methods, and Failure Modes","version":1},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-06-27T12:59:51.091008Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2606.11470"},"observation_digest":"sha256:4588c5089139225eea616375774e2186fbc9428652f754d925db987977b0eaf8","observation_id":"5d286266-e25c-4358-8884-435a42ecc16e","resolution":{"observed_at":"2026-07-03T05:57:41.661388Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":"2406.10149","doi":"10.48550/arxiv.2406.10149","metadata_source":"pith","pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bulatov, Petr Anokhin, Ivan Rodkin, Dmitry Sorokin, Artyom Y","venue":"cs.CL","work_id":"3c13d7c5-4137-4127-9390-500e01f37de6","year":2024},"citing_paper":{"arxiv_id":"2606.23687","last_updated":"2026-06-22T17:59:53Z","snapshot_observed_at":"2026-07-06T23:58:20.975630Z","submitted_at":"2026-06-22T17:59:53Z","title":"Randomized YaRN Improves Length Generalization for Long-Context Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T08:14:33.226848Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2606.23687"},"observation_digest":"sha256:576b35f552ccd63302c31b37a6a9e83b7205c6595eb0f0956f0022dab2169615","observation_id":"445558d0-253e-443a-afe8-19916fc7558a","resolution":{"observed_at":"2026-07-04T10:59:46.621214Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":"2406.10149","doi":"10.48550/arxiv.2406.10149","metadata_source":"pith","pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bulatov, Petr Anokhin, Ivan Rodkin, Dmitry Sorokin, Artyom Y","venue":"cs.CL","work_id":"3c13d7c5-4137-4127-9390-500e01f37de6","year":2024},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-02T16:38:21.894642Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:28967aa96572017effd4ec1a54d38cfcb4f246e597a2237ca5e7a8af1b4e47dd","observation_id":"133c98d7-fa10-43da-8001-1d13b617990c","resolution":{"observed_at":"2026-07-10T01:36:44.091424Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-07-13T03:52:24.872919Z","title":"Babilong: Testing the limits of llms with long context reasoning-in-a-haystack.arXiv preprint arXiv:2406.10149,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09328","last_updated":"2026-07-23T17:56:03Z","snapshot_observed_at":"2026-08-05T04:17:50.821563Z","submitted_at":"2026-07-10T12:09:21Z","title":"WildTrace: Benchmarking Natural Evidence Trails in Long-Context Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T03:52:24.872919Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2607.09328"},"observation_digest":"sha256:70ce4d5446cfe68a9e5f3b8e7f29dd1e0dff6c81beb17db86d484cac5a55b0f6","observation_id":"550637b4-7d3e-4350-a0bd-dd5be3140afc","resolution":{"observed_at":"2026-07-13T03:52:24.872919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-02T07:40:56.540931Z","title":"Babilong: Testing the limits of llms with long context reasoning-in-a-haystack.arXiv preprint arXiv:2406.10149,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09328","last_updated":"2026-07-23T17:56:03Z","snapshot_observed_at":"2026-08-05T04:17:50.821563Z","submitted_at":"2026-07-10T12:09:21Z","title":"WildTrace: Benchmarking Natural Evidence Trails in Long-Context Reasoning","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-02T07:40:56.540931Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2607.09328"},"observation_digest":"sha256:b8e7e09c940b3b8b0f28f03416684cc2d50bd4e00c406c91bb375febfb77b90f","observation_id":"5b0fcf00-ff01-4511-b418-633c4506c10f","resolution":{"observed_at":"2026-08-02T07:40:56.540931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-07-14T10:51:16.019022Z","title":"arXiv preprint arXiv:2406.10149 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10557","last_updated":"2026-07-12T04:13:27Z","snapshot_observed_at":"2026-08-05T13:33:51.510035Z","submitted_at":"2026-07-12T04:13:27Z","title":"UNIBROWSE: A Data-to-Agent Framework for Multimodal BrowseComp","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-14T10:51:16.019022Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2607.10557"},"observation_digest":"sha256:74d4d5d7536ef312fb76b47afb5495632f836addade44644176c4b185ac0a147","observation_id":"1498b5e4-839d-4439-9266-7ebf3bdaad0a","resolution":{"observed_at":"2026-07-14T10:51:16.019022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-02T14:02:40.746028Z","title":"BABILong: Testing the limits of LLMs with long context reasoning-in-a-haystack","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20457","last_updated":"2026-05-14T23:43:35Z","snapshot_observed_at":"2026-08-06T20:23:00.843191Z","submitted_at":"2026-05-14T23:43:35Z","title":"Dropping the Anchor: Statistical Context Summarization for Distributed Systems via Pulsar Attention","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T14:02:40.746028Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2607.20457"},"observation_digest":"sha256:106c5f8de8b9a11f996fdbad1bf395b680eeb31cd567acd206b724a30db758e4","observation_id":"3174dc67-2214-4bee-ac8f-24deb82b378a","resolution":{"observed_at":"2026-08-02T14:02:40.746028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.10149/citation-record","integrity":"/paper/2406.10149/integrity","json":"/paper/2406.10149/citation-record.json","paper":"/paper/2406.10149"},"outbound":[],"paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T20:22:33.555366Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2406.10149."}