{"as_of":"2026-08-10T15:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d70db8c511c280dd3dd193cff00c62c83b5d1b00758075b6b5f48684401c1d22","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:32:35.222863Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:59:51.822438Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2409.12917","last_updated":"2024-10-04T17:28:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-19T17:16:21Z","title":"Training Language Models to Self-Correct via Reinforcement Learning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-17T12:04:10.210508Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2409.12917"},"observation_digest":"sha256:22df0e3a50a8017487fa1dee1a7ab6771b26b8f14a2b84a47ee3cea33eade9ba","observation_id":"37e5cd86-be56-4489-9a55-34baba46d34a","resolution":{"observed_at":"2026-05-17T12:04:10.504299Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2412.13682","last_updated":"2026-04-29T16:45:39Z","snapshot_observed_at":"2026-07-06T20:09:05.798010Z","submitted_at":"2024-12-18T10:10:12Z","title":"ChinaTravel: An Open-Ended Travel Planning Benchmark with Compositional Constraint Validation for Language Agents","version":5},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-23T07:09:43.442736Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2412.13682"},"observation_digest":"sha256:f792b396c36b3f73754e6b10bfec5d987714348a090c3e26664c1a5c04c72407","observation_id":"1300e581-84e5-4e4f-8f68-02e4d4f2a5c8","resolution":{"observed_at":"2026-05-23T07:12:41.542281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-07T13:32:35.222863Z","title":"Le, Ed H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21674","last_updated":"2025-05-27T18:51:06Z","snapshot_observed_at":"2026-08-07T23:39:33.909297Z","submitted_at":"2025-05-27T18:51:06Z","title":"Make Planning Research Rigorous Again!","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:35.222863Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2505.21674"},"observation_digest":"sha256:a225ae6a5a0a9f77adcdc1806a9985ec7a90eafe47c366c14fb4455dd7d464d2","observation_id":"8b60198b-8768-4086-bab5-005f4f0a4d71","resolution":{"observed_at":"2026-08-07T13:32:35.222863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-07T10:42:05.447049Z","title":"Natural plan: Benchmarking llms on natural language planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04649","last_updated":"2025-06-05T05:31:50Z","snapshot_observed_at":"2026-08-09T18:11:09.194990Z","submitted_at":"2025-06-05T05:31:50Z","title":"Flex-TravelPlanner: A Benchmark for Flexible Planning with Language Agents","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:42:05.447049Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2506.04649"},"observation_digest":"sha256:3b1512c56b2a0e9e9bf1aa509791ff3e8d6a03ebee3633dbdfa51ecf04c3e2e6","observation_id":"2fc36915-60ff-431f-b62d-6c4b967cd63f","resolution":{"observed_at":"2026-08-07T10:42:05.447049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-07T04:28:47.872578Z","title":"Natural plan: Benchmarking llms on natural language planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.872578Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:7ddce6faa5499faf3741418603bf997a716e810c240291b8b1d77d85ab8fa009","observation_id":"3f1b9139-7109-4809-907e-8bb7be6e5fb6","resolution":{"observed_at":"2026-08-07T04:28:47.872578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-07T06:00:19.892698Z","title":"Natural plan: Benchmark- ing llms on natural language planning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11102","last_updated":"2025-06-06T17:52:18Z","snapshot_observed_at":"2026-08-07T05:54:56.593167Z","submitted_at":"2025-06-06T17:52:18Z","title":"Evolutionary Perspectives on the Evaluation of LLM-Based AI Agents: A Comprehensive Survey","version":1},"reference_index":196,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:19.892698Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2506.11102"},"observation_digest":"sha256:9cc54a855debe62ea6b1e0278ad86a05e2f66ae9f9bf0e76d058d2902374e9b7","observation_id":"067558ea-3b41-4cb4-9ea6-df9f104b1b8e","resolution":{"observed_at":"2026-08-07T06:00:19.892698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2507.21046","last_updated":"2026-01-16T20:59:08Z","snapshot_observed_at":"2026-08-01T06:32:44.461162Z","submitted_at":"2025-07-28T17:59:05Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","version":4},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-14T22:23:14.621091Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2507.21046"},"observation_digest":"sha256:c58288888df901825e1f2d15a8457b02ca5ac14afd07a067bd946131ac52c4cd","observation_id":"4e126a35-b617-4082-925f-449620976d1b","resolution":{"observed_at":"2026-05-14T22:23:15.711668Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-06T11:08:11.607173Z","title":"Liu, Julian Michael, and Mohit Iyyer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-06T11:07:51.867557Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:11.607173Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:8b5aac136f72a61616b0f2046c4e89d0aa346eaabe8415a1e4c7923a0e55a267","observation_id":"ca1758e0-256a-4b6e-bdb3-7c4418888108","resolution":{"observed_at":"2026-08-06T11:08:11.607173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-06T10:45:59.570552Z","title":"Le, Ed H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23589","last_updated":"2025-07-31T14:25:54Z","snapshot_observed_at":"2026-08-10T14:15:07.176654Z","submitted_at":"2025-07-31T14:25:54Z","title":"Can LLM-Reasoning Models Replace Classical Planning? A Benchmark Study","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T10:45:59.570552Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2507.23589"},"observation_digest":"sha256:fb0a2f719ec5e752793b97b1e2e1f61a143b54edd6313492b4aaf24500372b45","observation_id":"c995e071-1e8c-4969-9b34-55c5c68ada16","resolution":{"observed_at":"2026-08-06T10:45:59.570552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2508.15487","last_updated":"2025-08-21T12:09:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-21T12:09:58Z","title":"Dream 7B: Diffusion Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T16:25:53.143469Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2508.15487"},"observation_digest":"sha256:294486d8d95b862b7c392f345f7acb3c63545497fd160ab73438c1ff27cfc30b","observation_id":"df672c84-54ba-4139-a9b0-f012eb1b6315","resolution":{"observed_at":"2026-05-11T16:25:53.408460Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2509.12626","last_updated":"2026-04-06T16:19:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-16T03:43:13Z","title":"DoubleAgents: Human-Agent Alignment in a Socially Embedded Workflow","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-18T17:09:02.466082Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2509.12626"},"observation_digest":"sha256:d930a79bbf5390f410262d5452971e24cc28088dd5c98ca3dee102e88cf98fb9","observation_id":"92ce1154-07ce-4cac-9126-4598e85f7a46","resolution":{"observed_at":"2026-05-18T17:11:40.356821Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2512.09629","last_updated":"2026-05-08T15:34:03Z","snapshot_observed_at":"2026-07-06T22:38:35.387503Z","submitted_at":"2025-12-10T13:17:08Z","title":"End-to-end PDDL Planning with Hardcoded and Dynamic Agents","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-16T23:34:20.411940Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2512.09629"},"observation_digest":"sha256:e64c41692dbe716501629a023352416b55b7925a00df8e9716554efd518eaafe","observation_id":"3488c4b6-ea63-4525-8e13-8e014c2e2a4e","resolution":{"observed_at":"2026-05-16T23:38:41.708009Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-03T10:46:57.500704Z","title":"InProceedings of the 2025 Con- ference on Empirical Methods in Natural Language Processing (EMNLP)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09097","last_updated":"2026-07-10T08:14:37Z","snapshot_observed_at":"2026-08-06T12:19:36.404612Z","submitted_at":"2026-01-14T02:58:07Z","title":"Programming over Thinking: Efficient and Robust Multi-Constraint Planning","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T10:46:57.500704Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2601.09097"},"observation_digest":"sha256:af43a0e30777693dc75f029e673e2573fd93c6496b925975dd6032545f4c38e7","observation_id":"9ca36b71-9b13-4e92-b597-9cac6c589198","resolution":{"observed_at":"2026-08-03T10:46:57.500704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-02T22:26:39.609708Z","title":"Natural plan: Benchmarking llms on natural language planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.16902","last_updated":"2026-05-30T16:45:37Z","snapshot_observed_at":"2026-08-08T21:03:21.486519Z","submitted_at":"2026-02-18T21:33:59Z","title":"LLM-WikiRace Benchmark: How Far Can LLMs Plan over Real-World Knowledge Graphs?","version":4},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T22:26:39.609708Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2602.16902"},"observation_digest":"sha256:5985ebcdac2b593df6ee1616c712eadc79214f3e1ed60fb589eef870462b373d","observation_id":"e3cabc62-623d-4118-8735-d697558512b0","resolution":{"observed_at":"2026-08-02T22:26:39.609708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2604.06452","last_updated":"2026-04-07T20:47:40Z","snapshot_observed_at":"2026-08-05T13:22:07.566013Z","submitted_at":"2026-04-07T20:47:40Z","title":"Learning to Interrupt in Language-based Multi-agent Communication","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-10T19:08:45.818851Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2604.06452"},"observation_digest":"sha256:5ac876dc4cf5feb5f6e26737c8569742eb122ba64375869e99ad2a5747ffcce2","observation_id":"e3f84698-33d2-44e5-9f24-aed5a9073c27","resolution":{"observed_at":"2026-05-10T23:25:53.687359Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2604.14930","last_updated":"2026-04-16T12:18:27Z","snapshot_observed_at":"2026-07-06T23:02:36.062162Z","submitted_at":"2026-04-16T12:18:27Z","title":"IE as Cache: Information Extraction Enhanced Agentic Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T10:49:50.177400Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2604.14930"},"observation_digest":"sha256:201fad7e2ec1acd445948ac1bf4cb97efad7601425b3019dec7720c47ebc2bc3","observation_id":"99c42156-37cc-4220-8939-c6493d97c0de","resolution":{"observed_at":"2026-05-10T10:49:55.864171Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2605.06840","last_updated":"2026-05-22T00:29:09Z","snapshot_observed_at":"2026-08-03T21:39:56.998797Z","submitted_at":"2026-05-07T18:45:46Z","title":"Extracting Search Trees from LLM Reasoning Traces Reveals Myopic Planning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T00:52:59.406190Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2605.06840"},"observation_digest":"sha256:7015d26ad2171d53ee70a22d62a59794775e2a44d3f08bf44cf523f6522f16e5","observation_id":"90f03aa4-7e52-4f7e-903f-a74e65fb4be2","resolution":{"observed_at":"2026-05-11T05:05:56.713740Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2605.06840","last_updated":"2026-05-22T00:29:09Z","snapshot_observed_at":"2026-08-03T21:39:56.998797Z","submitted_at":"2026-05-07T18:45:46Z","title":"Extracting Search Trees from LLM Reasoning Traces Reveals Myopic Planning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T02:23:55.323250Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2605.06840"},"observation_digest":"sha256:3535ecf5cfe67f792c9c734f30888e660cc49bc9651000d23ed9f30540b9de3f","observation_id":"5e734042-f403-45a6-a7b3-582e60dd121e","resolution":{"observed_at":"2026-05-12T07:41:28.603949Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2605.06840","last_updated":"2026-05-22T00:29:09Z","snapshot_observed_at":"2026-08-03T21:39:56.998797Z","submitted_at":"2026-05-07T18:45:46Z","title":"Extracting Search Trees from LLM Reasoning Traces Reveals Myopic Planning","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T06:21:00.353334Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2605.06840"},"observation_digest":"sha256:bff10f4ace406c6202cb36bec6f1b5e0fbd4102cfc5fbe65bbce4e6242a21065","observation_id":"bcb47b33-1232-4619-a08e-536ed6a74004","resolution":{"observed_at":"2026-05-13T06:22:23.231324Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2605.06840","last_updated":"2026-05-22T00:29:09Z","snapshot_observed_at":"2026-08-03T21:39:56.998797Z","submitted_at":"2026-05-07T18:45:46Z","title":"Extracting Search Trees from LLM Reasoning Traces Reveals Myopic Planning","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-14T20:55:31.770238Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2605.06840"},"observation_digest":"sha256:7aaa0fac9217bcfd07ec262a73b6e91f07bcf2937d6e938e99341fc9554bfa8c","observation_id":"7f26c506-eba0-44fa-b45b-b14a35215cc7","resolution":{"observed_at":"2026-05-14T20:59:27.824924Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2605.06840","last_updated":"2026-05-22T00:29:09Z","snapshot_observed_at":"2026-08-03T21:39:56.998797Z","submitted_at":"2026-05-07T18:45:46Z","title":"Extracting Search Trees from LLM Reasoning Traces Reveals Myopic Planning","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-25T05:57:58.487109Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2605.06840"},"observation_digest":"sha256:9ef766a85c0c4b188b38a62f52352f65d886b9203b1c2e9d1793ff36fef6cbee","observation_id":"513b9174-d572-4252-8212-949f5fdd5def","resolution":{"observed_at":"2026-05-25T06:00:23.404420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2605.22355","last_updated":"2026-05-21T11:42:33Z","snapshot_observed_at":"2026-08-02T10:09:30.789824Z","submitted_at":"2026-05-21T11:42:33Z","title":"TransitLM: A Large-Scale Dataset and Benchmark for Map-Free Transit Route Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T05:47:29.031123Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2605.22355"},"observation_digest":"sha256:c700deddb39916b9fb20efae2fe02ad70ca3ac65107ec59fa06eb54fb4e72f87","observation_id":"d0534a05-5d73-4e61-b020-5abf2eef5e68","resolution":{"observed_at":"2026-05-22T05:51:08.865641Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2606.02994","last_updated":"2026-06-02T01:11:15Z","snapshot_observed_at":"2026-07-06T23:43:17.879245Z","submitted_at":"2026-06-02T01:11:15Z","title":"Inducing Reasoning Primitives from Agent Traces","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-28T10:54:57.324498Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2606.02994"},"observation_digest":"sha256:52f1943f72e82c1aa316980eed57678e701fa45b97f975b65a4dee7279aeb253","observation_id":"1e026219-115f-4132-878c-cba6445443e1","resolution":{"observed_at":"2026-07-02T02:26:26.916687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2606.03685","last_updated":"2026-06-02T14:09:16Z","snapshot_observed_at":"2026-08-07T10:48:20.979251Z","submitted_at":"2026-06-02T14:09:16Z","title":"A Close Look At World Model Recovery In Supervised Fine-Tuned LLM Planners","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T11:36:14.896698Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2606.03685"},"observation_digest":"sha256:9ed362814325fe031f9fb61504ba225b69911b87b4036719735979f64a6d3d84","observation_id":"b5c3602b-a9b1-419a-9dd4-8b28afb9ed55","resolution":{"observed_at":"2026-07-02T01:46:26.398207Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2606.21740","last_updated":"2026-06-19T20:53:10Z","snapshot_observed_at":"2026-08-01T23:24:43.869329Z","submitted_at":"2026-06-19T20:53:10Z","title":"Training the Orchestrator: A Supervised Approach to End-to-End PDDL Planning with LLM Agents","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-06-26T13:56:51.914966Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2606.21740"},"observation_digest":"sha256:fc5c50926a2862a6ccad4b753f95de69ac1eb2126b12db3c4e4e1cc3527df067","observation_id":"5b780118-1d35-427a-b4ab-d27d3152a32e","resolution":{"observed_at":"2026-07-04T06:59:38.192958Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2606.26969","last_updated":"2026-06-25T12:42:04Z","snapshot_observed_at":"2026-08-09T16:42:06.004756Z","submitted_at":"2026-06-25T12:42:04Z","title":"Einstein World Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-26T04:47:59.575489Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2606.26969"},"observation_digest":"sha256:3903e0cc6a7bc059458cec01a694b0838faedf954841530512de54f2e32f11ef","observation_id":"1a0fa1fb-b79e-40a5-ab0d-23079d64995f","resolution":{"observed_at":"2026-07-04T13:59:51.823996Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":"2406.04520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-04T13:59:51.822438Z","title":"falling piece","venue":null,"work_id":"2adf962c-5da0-490b-b12d-d0d660a4b594","year":2024},"citing_paper":{"arxiv_id":"2607.01972","last_updated":"2026-07-02T10:07:34Z","snapshot_observed_at":"2026-08-08T10:05:32.150742Z","submitted_at":"2026-07-02T10:07:34Z","title":"Object Aligner: A Configurable JSON Schema Similarity Score for Graphs, Applied to LLM Prompt Optimization","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-03T14:54:36.915852Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2607.01972"},"observation_digest":"sha256:360ce191103e84d75ca23a76fa01a6e0d9f77b21db2d0efce8c8f737d32d1024","observation_id":"993dfd27-3347-47c6-b307-329c7274927f","resolution":{"observed_at":"2026-07-03T14:58:32.444975Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-11T13:53:36.775836Z","title":"arXiv preprint arXiv:2406.04520 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04763","last_updated":"2026-07-26T14:17:18Z","snapshot_observed_at":"2026-08-02T10:24:43.977557Z","submitted_at":"2026-07-06T07:56:53Z","title":"Multi-Turn On-Policy Distillation with Prefix Replay","version":1},"reference_index":153,"source":"arxiv_source","source_observed_at":"2026-07-11T13:53:36.775836Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2607.04763"},"observation_digest":"sha256:846bdd0dcea47cbd60d2e713f8e4452ae994018200c76db0ff721c8ca5bf4a88","observation_id":"bbbd66e0-afc1-4b4b-a0e8-3ac65aea0700","resolution":{"observed_at":"2026-07-11T13:53:36.775836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-02T08:40:49.410640Z","title":"arXiv preprint arXiv:2406.04520 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04763","last_updated":"2026-07-26T14:17:18Z","snapshot_observed_at":"2026-08-02T10:24:43.977557Z","submitted_at":"2026-07-06T07:56:53Z","title":"Multi-Turn On-Policy Distillation with Prefix Replay","version":3},"reference_index":154,"source":"arxiv_source","source_observed_at":"2026-08-02T08:40:49.410640Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2607.04763"},"observation_digest":"sha256:5437281ce946375428c137b8b78091492d69b126cdfabe166e3ae6d91ca0e21d","observation_id":"435dcd78-ace1-47c7-aff7-5326416933c5","resolution":{"observed_at":"2026-08-02T08:40:49.410640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-07-30T15:14:06.324551Z","title":"Le, Ed H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26977","last_updated":"2026-07-29T14:35:29Z","snapshot_observed_at":"2026-08-06T03:59:45.914522Z","submitted_at":"2026-07-29T14:35:29Z","title":"TREK: A Travel Reasoning and Evaluation Kit for LLM Agents in Complex Trip Planning","version":1},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-07-30T15:14:06.324551Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2607.26977"},"observation_digest":"sha256:295a2c78b1ea31a25790d7e6fb0539d5e9709009b384cc8dc8a6354bd95960dd","observation_id":"1c1678b8-4fbd-4301-9942-84b96c067510","resolution":{"observed_at":"2026-07-30T15:14:06.324551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-06T00:40:34.550973Z","title":"and Chi, Ed H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00991","last_updated":"2026-08-02T04:41:20Z","snapshot_observed_at":"2026-08-06T23:25:16.991822Z","submitted_at":"2026-08-02T04:41:20Z","title":"SCHEDBench: A Benchmark for Evaluating LLM Constraint Faithfulness in Natural-Language Combinatorial Scheduling","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T00:40:34.550973Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2608.00991"},"observation_digest":"sha256:f3580c94f7e88f72ca063ea3d4b5597c32c696b816174085e6c4e6101d34ce9c","observation_id":"eb204b0b-ca29-4062-938a-b8a90a35ada4","resolution":{"observed_at":"2026-08-06T00:40:34.550973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-06T04:30:45.725769Z","title":"NATURAL PLAN: Benchmarking LLMs on natural language planning.arXiv preprint arXiv:2406.04520, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05139","last_updated":"2026-08-05T17:57:16Z","snapshot_observed_at":"2026-08-09T12:43:19.697158Z","submitted_at":"2026-08-05T17:57:16Z","title":"Toward Skill-Native LLMs: Skill Entropy for Benchmarking and Training Long-Horizon Reasoning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T04:30:45.725769Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2608.05139"},"observation_digest":"sha256:3d9ea701681b9eb8c4bc5ece205a7d7857ade48bdf03d24ecc52d3adb52a3338","observation_id":"c0bce8bd-4215-492e-b0f8-185d3f0d0725","resolution":{"observed_at":"2026-08-06T04:30:45.725769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.04520/citation-record","integrity":"/paper/2406.04520/integrity","json":"/paper/2406.04520/citation-record.json","paper":"/paper/2406.04520"},"outbound":[],"paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 32 inbound Pith citation observations for arXiv:2406.04520."}