{"as_of":"2026-08-11T05:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c05cd96680e85ea55b8a7ec375e0950d42ba377b2a9415abd81985c083452a98","coverage":[{"denominator":142,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T23:01:35.758160Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06663/citation-record","integrity":"/paper/2608.06663/integrity","json":"/paper/2608.06663/citation-record.json","paper":"/paper/2608.06663"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.14499","last_updated":"2026-07-10T21:48:09Z","snapshot_observed_at":"2026-08-07T16:54:09.525403Z","submitted_at":"2025-03-18T17:59:31Z","title":"Measuring AI Ability to Complete Long Software Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14499","snapshot_observed_at":"2026-08-10T23:01:35.467237Z","title":"Ziegler, Elizabeth Barnes, and Lawrence Chan","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.467237Z"},"links":{"cited_paper":"/paper/2503.14499","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:50bd76447a0cd6195248db58f20fa81724d6409d30fe2bed2565e4b8a97417f9","observation_id":"4d91c039-ad49-4de0-8523-8e0ec040dd6f","resolution":{"observed_at":"2026-08-10T23:01:35.467237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01798","last_updated":"2024-03-14T04:27:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T04:56:12Z","title":"Large Language Models Cannot Self-Correct Reasoning Yet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01798","snapshot_observed_at":"2026-08-10T23:01:35.471245Z","title":"Large language models cannot self-correct reasoning yet, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.471245Z"},"links":{"cited_paper":"/paper/2310.01798","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:583375650e302ec3d54e5c4e76b3666930a7db1e018f439a5f5edf84dcce44b4","observation_id":"09b0131f-8e67-4138-8ced-bd0416dd7465","resolution":{"observed_at":"2026-08-10T23:01:35.471245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15223","last_updated":"2025-09-09T02:59:54Z","snapshot_observed_at":"2026-08-09T23:57:55.814634Z","submitted_at":"2025-03-19T14:02:21Z","title":"Are \"Solved Issues\" in SWE-bench Really Solved Correctly? An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15223","snapshot_observed_at":"2026-08-10T23:01:35.474552Z","title":"Are ”solved issues” in SWE-bench really solved correctly? an empirical study, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.474552Z"},"links":{"cited_paper":"/paper/2503.15223","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:4ec55804f39299b06df11bfb4016c0ad61b595eed4bcdf7357447521c0838ec2","observation_id":"9a2f02d2-5ee1-4303-83f9-b10ec55959bb","resolution":{"observed_at":"2026-08-10T23:01:35.474552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.477854Z","title":"The SWE-bench illusion: When state-of-the-art LLMs remember instead of reason, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.477854Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:b7de39723c339a148694e26e1f9ab622b807d6ecb74850a826c11d9e06e88407","observation_id":"c637a348-385d-4bdf-9277-48b0c9453c64","resolution":{"observed_at":"2026-08-10T23:01:35.477854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02825","last_updated":"2025-08-07T06:58:08Z","snapshot_observed_at":"2026-08-09T13:14:30.968472Z","submitted_at":"2025-07-03T17:35:31Z","title":"Establishing Best Practices for Building Rigorous Agentic Benchmarks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02825","snapshot_observed_at":"2026-08-10T23:01:35.480747Z","title":"Establishing best practices for building rigorous agentic benchmarks, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.480747Z"},"links":{"cited_paper":"/paper/2507.02825","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:4d5e1b1a03ca75d9ca8c2d6746748a94ef53b44656b85125446818e2d69d0f37","observation_id":"0cf16eda-132d-4502-aa08-c8cad43c3488","resolution":{"observed_at":"2026-08-10T23:01:35.480747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02716","last_updated":"2024-02-05T04:25:24Z","snapshot_observed_at":"2026-08-10T13:27:24.204831Z","submitted_at":"2024-02-05T04:25:24Z","title":"Understanding the planning of LLM agents: A survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02716","snapshot_observed_at":"2026-08-10T23:01:35.483951Z","title":"Understanding the planning of LLM agents: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.483951Z"},"links":{"cited_paper":"/paper/2402.02716","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:6355078ad5bf48aef056c774f3d6da6111da83efa25b46b87b6615a524f41bdb","observation_id":"79e13dfe-c8ed-4052-a90e-8d56c9c6b9c3","resolution":{"observed_at":"2026-08-10T23:01:35.483951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.487410Z","title":"LLMs as planning formalizers: A survey for leveraging large language models to construct automated planning models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.487410Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:a523be03617f9497d401da1dd268bbee55ea9fa719216b00d7b15c61bbe4f99a","observation_id":"9b045725-a423-42aa-9b11-3b0314362d1d","resolution":{"observed_at":"2026-08-10T23:01:35.487410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13501","last_updated":"2024-04-21T01:49:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-21T01:49:46Z","title":"A Survey on the Memory Mechanism of Large Language Model based Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13501","snapshot_observed_at":"2026-08-10T23:01:35.490120Z","title":"A survey on the memory mechanism of large language model based agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.490120Z"},"links":{"cited_paper":"/paper/2404.13501","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:f861f112fcda2a54f6e49c124f3f01ddb9822e97a138f9d64e76b611f99e3f11","observation_id":"49569b95-0a7b-4b37-888f-b7de3ab610f8","resolution":{"observed_at":"2026-08-10T23:01:35.490120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.493279Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.493279Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:e7ac9bbf398aeb9e2c57070f19aa11b37e958df8067f3345cf817af1d3a777ba","observation_id":"5d276526-6a02-481d-8c49-59bec7991584","resolution":{"observed_at":"2026-08-10T23:01:35.493279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18279","last_updated":"2025-05-06T15:08:00Z","snapshot_observed_at":"2026-07-06T19:57:55.925634Z","submitted_at":"2024-11-27T12:13:39Z","title":"Large Language Model-Brained GUI Agents: A Survey","version":12},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18279","snapshot_observed_at":"2026-08-10T23:01:35.495876Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.495876Z"},"links":{"cited_paper":"/paper/2411.18279","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:5eee1bcd20b286afe62302d9dfddb52908ccd1cb7f93581a34c52cb10b3d34f1","observation_id":"05fff376-c46b-40a1-ac08-6742aabd3304","resolution":{"observed_at":"2026-08-10T23:01:35.495876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.498394Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.498394Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:ca66892b82ab6c810e4806baf985de9d142529ecda8f35736ab2b119a121f8a0","observation_id":"e3c4aaa9-5303-41b1-9df1-04d0f9fb8a74","resolution":{"observed_at":"2026-08-10T23:01:35.498394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13865","last_updated":"2025-06-04T17:29:13Z","snapshot_observed_at":"2026-08-07T16:32:02.150493Z","submitted_at":"2025-03-27T17:58:31Z","title":"A Survey on (M)LLM-Based GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13865","snapshot_observed_at":"2026-08-10T23:01:35.501038Z","title":"A survey on (m)LLM-based GUI agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.501038Z"},"links":{"cited_paper":"/paper/2504.13865","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:71d76497053b4d5bdbf32bf40f4a863dadf8a41cd81fadbe7af15388e215629d","observation_id":"5aa6c2f5-88bd-4b5d-8583-c74358440bb0","resolution":{"observed_at":"2026-08-10T23:01:35.501038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.503946Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.503946Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:70869e786b9711cbe4310ad0a2506f94c4612c400c1e991b03f109d74ca7cd2f","observation_id":"79898d1e-c85f-4e7c-ac4c-01028f7fb264","resolution":{"observed_at":"2026-08-10T23:01:35.503946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01297","last_updated":"2024-12-03T19:14:06Z","snapshot_observed_at":"2026-08-02T06:30:19.601023Z","submitted_at":"2024-06-03T13:05:46Z","title":"When Can LLMs Actually Correct Their Own Mistakes? A Critical Survey of Self-Correction of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01297","snapshot_observed_at":"2026-08-10T23:01:35.506528Z","title":"When can LLMs actually correct their own mistakes? a critical survey of self-correction of LLMs, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.506528Z"},"links":{"cited_paper":"/paper/2406.01297","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:dfe12875471f18d1192771f6a520b6087a9e3620ac54a13f377b2ecf468844e7","observation_id":"416228f4-611e-4317-816d-b6627376714b","resolution":{"observed_at":"2026-08-10T23:01:35.506528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.07663","last_updated":"2026-07-08T17:19:50Z","snapshot_observed_at":"2026-07-30T01:44:04.256851Z","submitted_at":"2026-07-08T17:19:50Z","title":"Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.07663","snapshot_observed_at":"2026-08-10T23:01:35.509270Z","title":"Recursive self-improvement in ai: From bounded self-refinement to autonomous research loops, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.509270Z"},"links":{"cited_paper":"/paper/2607.07663","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:96a3ed9ffde3568134f72f7ea460d15153aea0ebb2c10f0e96bef076d6cdc713","observation_id":"495abdf0-ba25-461b-9bfa-39dccef6eade","resolution":{"observed_at":"2026-08-10T23:01:35.509270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.512030Z","title":"Sutton, Doina Precup, and Satinder Singh","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.512030Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:f02587c2883b800003b38a9bd694aa65a1cccf85d81c04dd741e3a48a8431cf5","observation_id":"7611fd6d-329b-4548-a39b-882f21ab0d74","resolution":{"observed_at":"2026-08-10T23:01:35.512030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.514691Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.514691Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:1838dd170157b1a0a515c901eed560b85583f520bf00055562da6e3ad4054d41","observation_id":"c59fb5cb-4685-4af3-ad59-040a0e204946","resolution":{"observed_at":"2026-08-10T23:01:35.514691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11477","last_updated":"2023-09-27T07:29:44Z","snapshot_observed_at":"2026-08-01T15:58:01.346044Z","submitted_at":"2023-04-22T20:34:03Z","title":"LLM+P: Empowering Large Language Models with Optimal Planning Proficiency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11477","snapshot_observed_at":"2026-08-10T23:01:35.517185Z","title":"LLM+P: Empowering large language models with optimal planning proficiency, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.517185Z"},"links":{"cited_paper":"/paper/2304.11477","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:a9f5a9de6192b0a31b63ef420c2cdacdfe6ee9d30ea1020ee850547478b0722d","observation_id":"8f23b146-909e-479d-ab6b-2f57f65a232f","resolution":{"observed_at":"2026-08-10T23:01:35.517185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-10T23:01:35.520046Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.520046Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:b214376b7abf0b2f7d0451ac9e8e844a699a34a1ba07bc53000210b21f161cbd","observation_id":"0bc5a8c1-5005-47b7-a175-aabf23646121","resolution":{"observed_at":"2026-08-10T23:01:35.520046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04272","last_updated":"2026-04-13T04:41:02Z","snapshot_observed_at":"2026-07-06T20:02:17.096487Z","submitted_at":"2024-12-05T15:54:16Z","title":"PoTable: Towards Systematic Thinking via Plan-then-Execute Stage Reasoning on Tables","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04272","snapshot_observed_at":"2026-08-10T23:01:35.522839Z","title":"PoTable: Towards systematic thinking via plan-then-execute stage reasoning on tables, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.522839Z"},"links":{"cited_paper":"/paper/2412.04272","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:df7237827cb736f647fb18214812e46e9d2d7ef834152905436f5e9f68d62cbc","observation_id":"805e7fd4-dd42-47f6-b2ea-372260a6d7cd","resolution":{"observed_at":"2026-08-10T23:01:35.522839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14212","last_updated":"2024-12-18T08:47:17Z","snapshot_observed_at":"2026-08-08T23:00:53.590145Z","submitted_at":"2024-12-18T08:47:17Z","title":"Tree-of-Code: A Hybrid Approach for Robust Complex Task Planning and Execution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14212","snapshot_observed_at":"2026-08-10T23:01:35.525639Z","title":"Tree-of-code: A hybrid approach for robust complex task planning and execution, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.525639Z"},"links":{"cited_paper":"/paper/2412.14212","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:7373ff3d99c2968bde2d48f3b8c92230cb31a7093438ce46b614e791bf5ef1e5","observation_id":"1debe8c0-46e5-41b1-90a9-54954f4e4cb5","resolution":{"observed_at":"2026-08-10T23:01:35.525639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09572","last_updated":"2025-04-22T17:56:22Z","snapshot_observed_at":"2026-08-07T20:22:20.692339Z","submitted_at":"2025-03-12T17:40:52Z","title":"Plan-and-Act: Improving Planning of Agents for Long-Horizon Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09572","snapshot_observed_at":"2026-08-10T23:01:35.528245Z","title":"Furuta, Gopala K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.528245Z"},"links":{"cited_paper":"/paper/2503.09572","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:5297cb91c8e834a68f22c6763a2364b34a1c80b67b7994f795254393e102e421","observation_id":"09e9ca7e-7693-4537-99a7-81361682208e","resolution":{"observed_at":"2026-08-10T23:01:35.528245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.11225","last_updated":"2026-05-11T20:43:20Z","snapshot_observed_at":"2026-08-02T05:32:20.307482Z","submitted_at":"2026-05-11T20:43:20Z","title":"PIVOT: Bridging Planning and Execution in LLM Agents via Trajectory Refinement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.11225","snapshot_observed_at":"2026-08-10T23:01:35.531161Z","title":"PIVOT: Bridging planning and execution in LLM agents via trajectory refinement, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.531161Z"},"links":{"cited_paper":"/paper/2605.11225","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:38b654c732ce87eaa19cf8e157417dafa0e233e5c3c3d43a2f696774509d9d5f","observation_id":"0e3d99fc-a984-40f2-af62-86f7a7d69fcc","resolution":{"observed_at":"2026-08-10T23:01:35.531161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.21516","last_updated":"2026-05-15T12:47:13Z","snapshot_observed_at":"2026-08-02T04:12:03.015112Z","submitted_at":"2026-05-15T12:47:13Z","title":"Harnesses for Inference-Time Alignment over Execution Trajectories","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.21516","snapshot_observed_at":"2026-08-10T23:01:35.533892Z","title":"Harnesses for inference-time alignment over execution trajectories, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.533892Z"},"links":{"cited_paper":"/paper/2605.21516","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:9442c2bb8f1571d302fd554d530b0b883ab61efb1731d8764ed7345591921c3f","observation_id":"80a59d1c-9c40-4e89-9904-6c726f451504","resolution":{"observed_at":"2026-08-10T23:01:35.533892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08702","last_updated":"2024-10-03T16:11:43Z","snapshot_observed_at":"2026-07-06T17:29:39.117068Z","submitted_at":"2024-02-13T16:38:01Z","title":"PRompt Optimization in Multi-Step Tasks (PROMST): Integrating Human Feedback and Heuristic-based Sampling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08702","snapshot_observed_at":"2026-08-10T23:01:35.536440Z","title":"PRompt optimization in multi-step tasks (PROMST): Integrating human feedback and heuristic-based sampling, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.536440Z"},"links":{"cited_paper":"/paper/2402.08702","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:56e4587b215b916dff06fc3387fa65977a07b7e2c3c6e0e9252bdc4ad186741e","observation_id":"e5b00e30-16ae-4bab-9c74-c69743b834ed","resolution":{"observed_at":"2026-08-10T23:01:35.536440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06951","last_updated":"2025-05-29T17:37:26Z","snapshot_observed_at":"2026-08-07T17:17:55.474030Z","submitted_at":"2025-03-10T05:56:46Z","title":"ReAgent: Reversible Multi-Agent Reasoning for Knowledge-Enhanced Multi-Hop QA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06951","snapshot_observed_at":"2026-08-10T23:01:35.539470Z","title":"ReAgent: Reversible multi-agent reasoning for knowledge-enhanced multi-hop QA, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.539470Z"},"links":{"cited_paper":"/paper/2503.06951","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:76aeb0f5f7494f287219d963432737a04134690e5026bcc96ebf35713915cc2c","observation_id":"d32cb368-2985-4bdb-ba00-13b110e59b19","resolution":{"observed_at":"2026-08-10T23:01:35.539470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08477","last_updated":"2026-05-08T20:51:42Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T20:51:42Z","title":"Do Agents Need to Plan Step-by-Step? Rethinking Planning Horizon in Data-Centric Tool Calling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08477","snapshot_observed_at":"2026-08-10T23:01:35.542342Z","title":"Do agents need to plan step-by-step? rethinking planning horizon in data-centric tool calling, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.542342Z"},"links":{"cited_paper":"/paper/2605.08477","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:32b681900df42144f71bbe3a1968113446daad4d4f32da78569edea18b0b36ab","observation_id":"58ba2e0e-129a-4325-9afb-b97ab8098bce","resolution":{"observed_at":"2026-08-10T23:01:35.542342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.545080Z","title":"The cognitive bandwidth bottleneck: Shifting long-horizon agent from plan- ning with actions to planning with schemas, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.545080Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:0e30096ebc9fa035e0fa4191d8b06637f73d8cf7422d60135577b77e77d6d6fc","observation_id":"e2076d76-067d-49b0-b556-169498d713be","resolution":{"observed_at":"2026-08-10T23:01:35.545080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10601","last_updated":"2023-12-03T22:50:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T23:16:17Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10601","snapshot_observed_at":"2026-08-10T23:01:35.547554Z","title":"Griﬀiths, Yuan Cao, and Karthik Narasimhan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.547554Z"},"links":{"cited_paper":"/paper/2305.10601","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:4e517fb633f8398ea2bd987e58c01c0f22a664f8808fad9ed5857d0fef7dcb61","observation_id":"4d9aaf94-2e8c-48c3-9c7b-37f5cb63231d","resolution":{"observed_at":"2026-08-10T23:01:35.547554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07551","last_updated":"2025-06-12T07:30:27Z","snapshot_observed_at":"2026-08-07T22:38:32.445079Z","submitted_at":"2025-06-09T08:41:39Z","title":"CheMatAgent: Enhancing LLMs for Chemistry and Materials Science through Tree-Search Based Tool Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07551","snapshot_observed_at":"2026-08-10T23:01:35.550199Z","title":"An, Yuwei Wan, Wenliang Chen, Binbin Lin, Yuqiang Li, Tong Xie, and Dongzhan Zhou","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.550199Z"},"links":{"cited_paper":"/paper/2506.07551","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:4198af686fc4b58cd3e3dc8062d4c72cf9b2e3b69a38a286760824578569638f","observation_id":"9b1e3e64-304b-4287-bd15-f678d3f508d2","resolution":{"observed_at":"2026-08-10T23:01:35.550199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07557","last_updated":"2025-06-09T08:52:27Z","snapshot_observed_at":"2026-08-07T05:28:24.761670Z","submitted_at":"2025-06-09T08:52:27Z","title":"SELT: Self-Evaluation Tree Search for LLMs with Task Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07557","snapshot_observed_at":"2026-08-10T23:01:35.553083Z","title":"SELT: Self- evaluation tree search for LLMs with task decomposition, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.553083Z"},"links":{"cited_paper":"/paper/2506.07557","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:b5e9f5773e17cd00fe0deae7605375b3c7b48a2419c03cbc674dc1ba4b654ae7","observation_id":"b223cb23-1271-4f9b-a6a2-139b36034026","resolution":{"observed_at":"2026-08-10T23:01:35.553083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.555658Z","title":"W ALL-e: World alignment by rule learning improves world model-based LLM agents,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.555658Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:b791ab75900cf9d0dc9cdb6ad719b5c97563a2b38be58ee7ad798dde7384dbb2","observation_id":"f3ed3bc5-cb75-4177-b4a5-89dd8e52bbe8","resolution":{"observed_at":"2026-08-10T23:01:35.555658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.561984Z","title":"Laird and Corey Clark","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.561984Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:3a2b85d5094971aebab09785062de9be920f89c2b3efa2df4656165f8fef5e4a","observation_id":"33743249-9f5b-4ae8-bcc4-d377b3b30ab2","resolution":{"observed_at":"2026-08-10T23:01:35.561984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.564416Z","title":"MobileDreamer: Generative sketch world model for GUI agent, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.564416Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:4244e08721d5eb0a53b5dd82dff745c04f3d84ecb5978a0090e56d0e57001754","observation_id":"dd8b4f10-3641-48e2-acb3-f6ea52dcf7db","resolution":{"observed_at":"2026-08-10T23:01:35.564416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.15660","last_updated":"2026-07-17T06:12:04Z","snapshot_observed_at":"2026-08-07T03:49:15.500655Z","submitted_at":"2026-07-17T06:12:04Z","title":"ToolVerse: Unlocking Massive Environments and Long-Horizon Tasks for Agentic Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.15660","snapshot_observed_at":"2026-08-10T23:01:35.567093Z","title":"ToolVerse: Unlocking massive environments and long-horizon tasks for agentic reinforcement learning, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.567093Z"},"links":{"cited_paper":"/paper/2607.15660","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:d71f75ec986db786de3f03ea2c74e2b2ba05bc0724dc17691cca3483d536954c","observation_id":"0fdff7de-756d-46cb-b1a5-3f3f35638a9b","resolution":{"observed_at":"2026-08-10T23:01:35.567093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.570037Z","title":"AgentEvolver: Towards eﬀicient self-evolving agent system, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.570037Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:961ac4dcf49ee6935190bab1babf838131048bf9b9e7be313f60d0a75a754dc8","observation_id":"304c4095-52cc-4303-8b03-781ba31759b7","resolution":{"observed_at":"2026-08-10T23:01:35.570037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02556","last_updated":"2026-04-24T18:39:50Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-01-30T13:15:13Z","title":"Beyond Experience Retrieval: Learning to Generate Utility-Optimized Structured Experience for Frozen LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.02556","snapshot_observed_at":"2026-08-10T23:01:35.572747Z","title":"Beyond experience re- trieval: Learning to generate utility-optimized structured experience for frozen LLMs","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.572747Z"},"links":{"cited_paper":"/paper/2602.02556","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:8ae9d88704076c36a661a8963b587640529c5162d1cd4908e2d1103169628507","observation_id":"a2ae34fd-a085-46a5-9538-a4e50a4f620d","resolution":{"observed_at":"2026-08-10T23:01:35.572747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03172","last_updated":"2023-11-20T23:09:34Z","snapshot_observed_at":"2026-07-06T15:51:12.179086Z","submitted_at":"2023-07-06T17:54:11Z","title":"Lost in the Middle: How Language Models Use Long Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03172","snapshot_observed_at":"2026-08-10T23:01:35.575978Z","title":"Liu, Kevin Lin, John Hewitt, Ashwin Paranjape, Michele Bevilacqua, Fabio Petroni, and Percy Liang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.575978Z"},"links":{"cited_paper":"/paper/2307.03172","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:5b15933635670fafe01f21fa8fcb0a381eb4fb2da5f51905cdabffcafd975fcf","observation_id":"af5c6012-b77a-43f6-98a7-b8f0140b360f","resolution":{"observed_at":"2026-08-10T23:01:35.575978Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13171","last_updated":"2025-08-08T16:32:47Z","snapshot_observed_at":"2026-08-08T03:45:05.614126Z","submitted_at":"2025-08-08T16:32:47Z","title":"Cognitive Workspace: Active Memory Management for LLMs -- An Empirical Study of Functional Infinite Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.13171","snapshot_observed_at":"2026-08-10T23:01:35.578943Z","title":"Cognitive workspace: Active memory management for LLMs – an empirical study of functional infinite context, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.578943Z"},"links":{"cited_paper":"/paper/2508.13171","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:7055c9547b86a94a9f4612b2a115d20a6ac7f00dcb600d37e1355620ef5f9c66","observation_id":"42ccb7fc-bc1a-44fa-9e25-e720b5f6ca86","resolution":{"observed_at":"2026-08-10T23:01:35.578943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.00031","last_updated":"2026-07-24T20:05:06Z","snapshot_observed_at":"2026-08-06T11:42:24.722042Z","submitted_at":"2025-07-30T08:01:45Z","title":"Git Context Controller: Manage the Context of LLM-based Agents like Git","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.00031","snapshot_observed_at":"2026-08-10T23:01:35.581794Z","title":"Git context controller: Manage the context of LLM-based agents like git, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.581794Z"},"links":{"cited_paper":"/paper/2508.00031","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:011fcdb18292ec2f941d262bd1aa0bbaa22d87db680343217bc364ba0fe20482","observation_id":"028e1dcd-ab43-4f06-921e-e162afc1fea9","resolution":{"observed_at":"2026-08-10T23:01:35.581794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.584602Z","title":"Scaling long-horizon LLM agent via context-folding, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.584602Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:54b229047ab2d84ca1c8e597353997592161a22d947c92327205c4abfbcb46f9","observation_id":"21703a96-ef58-4aba-924f-ca12aa1fea38","resolution":{"observed_at":"2026-08-10T23:01:35.584602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.00615","last_updated":"2026-06-01T07:41:52Z","snapshot_observed_at":"2026-08-08T16:59:13.993229Z","submitted_at":"2025-10-01T07:43:49Z","title":"ACON: Optimizing Context Compression for Long-horizon LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.00615","snapshot_observed_at":"2026-08-10T23:01:35.587099Z","title":"Inan, Lukas Wutschitz, Yanzhi Chen, Robert B","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.587099Z"},"links":{"cited_paper":"/paper/2510.00615","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:e6649d7e45d3b774eb3dfc0e6259bcfff33b1f2a2eae7d81aa747798bd68e517","observation_id":"27a8c101-fa00-4eed-94a8-fa0f4fb79d25","resolution":{"observed_at":"2026-08-10T23:01:35.587099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.29718","last_updated":"2026-08-04T16:37:54Z","snapshot_observed_at":"2026-08-07T23:11:40.046063Z","submitted_at":"2026-06-29T02:53:28Z","title":"Diagnosing and Mitigating Context Rot in Long-horizon Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.29718","snapshot_observed_at":"2026-08-10T23:01:35.589850Z","title":"Diagnosing and mitigating context rot in long-horizon search, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.589850Z"},"links":{"cited_paper":"/paper/2606.29718","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:dea92ba1f1c71133738f914c7f02a64b8c2bd2e9b5d1c696f29140dd1caa6f08","observation_id":"b5c86055-aa32-468c-95fe-eb38d94e9afe","resolution":{"observed_at":"2026-08-10T23:01:35.589850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.22953","last_updated":"2026-06-22T07:30:47Z","snapshot_observed_at":"2026-07-31T01:34:28.285642Z","submitted_at":"2026-06-22T07:30:47Z","title":"Plans Don't Persist: Why Context Management Is Load Bearing for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.22953","snapshot_observed_at":"2026-08-10T23:01:35.592719Z","title":"Plans don’t persist: Why context management is load bearing for LLM agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.592719Z"},"links":{"cited_paper":"/paper/2606.22953","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:2a073e17fd75ea0b1c44828bbede98b27ddf8fcdc771edf9d5b9bc858c9f48e1","observation_id":"8bc86b62-d07b-43a3-9b2b-15d3a3ad1905","resolution":{"observed_at":"2026-08-10T23:01:35.592719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08560","last_updated":"2024-02-12T18:59:46Z","snapshot_observed_at":"2026-08-09T03:13:16.831626Z","submitted_at":"2023-10-12T17:51:32Z","title":"MemGPT: Towards LLMs as Operating Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08560","snapshot_observed_at":"2026-08-10T23:01:35.595485Z","title":"Patil, Ion Stoica, and Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.595485Z"},"links":{"cited_paper":"/paper/2310.08560","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:7f2aa00024f3aa0839c2a7d52f89dbb991a198c700b87bc64070ceace31c4fc1","observation_id":"416faf43-b239-422d-952c-75b229eb1b1b","resolution":{"observed_at":"2026-08-10T23:01:35.595485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.598199Z","title":"O’Brien, Carrie J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.598199Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:e6a9059d573fb0aeaff700f374b3d4a1c25b3a8594856d6105280f8b52d608e3","observation_id":"c9386a00-719c-4362-9d2b-47e1ba67ab20","resolution":{"observed_at":"2026-08-10T23:01:35.598199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12110","last_updated":"2025-10-08T01:46:37Z","snapshot_observed_at":"2026-08-03T02:27:06.991396Z","submitted_at":"2025-02-17T18:36:14Z","title":"A-MEM: Agentic Memory for LLM Agents","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12110","snapshot_observed_at":"2026-08-10T23:01:35.600632Z","title":"A-MEM: Agentic memory for LLM agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.600632Z"},"links":{"cited_paper":"/paper/2502.12110","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:69c04da3fa7cc7c819166f337fa906498f6adc18b7402956d9cc1f958af3abed","observation_id":"70f1a38c-65e0-4521-ae94-a5d7bf04b98e","resolution":{"observed_at":"2026-08-10T23:01:35.600632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2602.05665","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:36.191897Z","title":"Graph-based agent memory: Taxonomy, techniques, and applications","venue":null,"work_id":"df2771f1-a407-4d81-a85d-a3bf54de5a81","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.603257Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:d66e30d7f9f50daba0165133600b331274f769ed1a70ba18665aaccc8833f52e","observation_id":"edd121b7-034a-4807-bff7-c0f3132f3d96","resolution":{"observed_at":"2026-08-10T23:01:36.195059Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.12997","last_updated":"2026-07-22T21:19:00Z","snapshot_observed_at":"2026-08-07T17:40:47.895215Z","submitted_at":"2025-11-17T05:38:50Z","title":"WebCoach: Self-Evolving Web Agents with Cross-Session Memory Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.12997","snapshot_observed_at":"2026-08-10T23:01:35.605771Z","title":"WebCoach: Self-evolving web agents with cross-session memory guidance, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.605771Z"},"links":{"cited_paper":"/paper/2511.12997","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:c0b1191f6abced907e25ba789808ebb31e447a94e15ebf3bc6116a07b9a13536","observation_id":"a691d46d-79fa-4b54-aa69-31ff878f77e2","resolution":{"observed_at":"2026-08-10T23:01:35.605771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07313","last_updated":"2026-05-08T06:22:31Z","snapshot_observed_at":"2026-08-02T18:15:50.190350Z","submitted_at":"2026-05-08T06:22:31Z","title":"When Stored Evidence Stops Being Usable: Scale-Conditioned Evaluation of Agent Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07313","snapshot_observed_at":"2026-08-10T23:01:35.608319Z","title":"When stored evidence stops being usable: Scale-conditioned evaluation of agent memory, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.608319Z"},"links":{"cited_paper":"/paper/2605.07313","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:bc2d5bdd20a93d4e24c785b55c6a18e34cefc87bea0175007a87acab4460eff2","observation_id":"3ad3c7ab-96a1-4af4-b83f-cfbd3fa8e789","resolution":{"observed_at":"2026-08-10T23:01:35.608319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18565","last_updated":"2026-05-19T16:05:55Z","snapshot_observed_at":"2026-08-02T22:32:41.890039Z","submitted_at":"2026-05-18T15:43:35Z","title":"MINTEval: Evaluating Memory under Multi-Target Interference in Long-Horizon Agent Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18565","snapshot_observed_at":"2026-08-10T23:01:35.610938Z","title":"MINTEval: Evaluating memory under multi-target interference in long-horizon agent systems, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.610938Z"},"links":{"cited_paper":"/paper/2605.18565","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:6a831811d6c841d3198dddfa76f9a47eeb4ff1cd7afd27f3fd753827de125142","observation_id":"5a0df324-3392-4164-9585-507b372a872e","resolution":{"observed_at":"2026-08-10T23:01:35.610938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2601.18642","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:36.131008Z","title":"FadeMem: Biologically-inspired forgetting for eﬀicient agent memory","venue":null,"work_id":"343f6b8c-2efa-4683-b85f-0f83b296fc3e","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.613747Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:87b1df0debc8b0f5ee51de76e365b567aa26cfa2ebaea1c5659d80fb0a3e701c","observation_id":"c9a1bb9a-942a-4db0-8214-6ed790172bda","resolution":{"observed_at":"2026-08-10T23:01:36.134245Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.00680","last_updated":"2026-04-09T06:51:56Z","snapshot_observed_at":"2026-07-06T22:47:24.369805Z","submitted_at":"2026-02-28T14:43:02Z","title":"MemPO: Self-Memory Policy Optimization for Long-Horizon Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.00680","snapshot_observed_at":"2026-08-10T23:01:35.616146Z","title":"MemPO: Self-memory policy optimization for long-horizon agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.616146Z"},"links":{"cited_paper":"/paper/2603.00680","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:eeffd4be19f0146013ae58a5ab449becb263083fd0f3916fb96b55c973b47505","observation_id":"f72a3db0-9a42-4860-b3e8-e028ae15a2fa","resolution":{"observed_at":"2026-08-10T23:01:35.616146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20987","last_updated":"2026-04-22T18:17:17Z","snapshot_observed_at":"2026-07-06T23:07:36.996629Z","submitted_at":"2026-04-22T18:17:17Z","title":"Co-Evolving LLM Decision and Skill Bank Agents for Long-Horizon Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.20987","snapshot_observed_at":"2026-08-10T23:01:35.619058Z","title":"Co-evolving LLM decision and skill bank agents for long-horizon tasks, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.619058Z"},"links":{"cited_paper":"/paper/2604.20987","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:7aee8bdd0f397947d4c553693d98db81d9c39b8a4ddf14c2cac22ca7bc946983","observation_id":"1c123bf1-e8e8-47e0-a896-32a2a2db64e0","resolution":{"observed_at":"2026-08-10T23:01:35.619058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29960","last_updated":"2026-05-28T14:02:00Z","snapshot_observed_at":"2026-08-04T10:03:16.376465Z","submitted_at":"2026-05-28T14:02:00Z","title":"Hijacking Agent Memory: Stealthy Trojan Attacks Through Conversational Interaction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.29960","snapshot_observed_at":"2026-08-10T23:01:35.621794Z","title":"Hijacking agent memory: Stealthy trojan attacks through conversational interaction, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.621794Z"},"links":{"cited_paper":"/paper/2605.29960","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:1cb1c41862e5605848548c1ecdd2142811590cbfd5252c426d42e7542b1bf6a7","observation_id":"f03b548b-bc5a-4e8c-9968-3d6b5dfc9262","resolution":{"observed_at":"2026-08-10T23:01:35.621794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.30566","last_updated":"2026-07-21T04:24:11Z","snapshot_observed_at":"2026-08-07T20:15:22.829553Z","submitted_at":"2026-06-29T17:09:03Z","title":"Forensic Trajectory Signatures for Agent Memory Poisoning Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.30566","snapshot_observed_at":"2026-08-10T23:01:35.624528Z","title":"Forensic trajectory signatures for agent memory poisoning detection, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.624528Z"},"links":{"cited_paper":"/paper/2606.30566","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:fa6dbd66679d88260fd71cbfc2b38e1587c2fdafc5ff6c0f1baebf8a162d803a","observation_id":"78ed0683-b93e-444e-9d7e-ff74ac0c4d53","resolution":{"observed_at":"2026-08-10T23:01:35.624528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-10T23:01:35.627306Z","title":"ReAct: Synergizing reasoning and acting in language models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.627306Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:7166390eb44de287f76102a919e929cba3c252051523e9f70984fa094c1df8ef","observation_id":"fc37d485-bad3-4b9f-be01-ba609ce4a7be","resolution":{"observed_at":"2026-08-10T23:01:35.627306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08646","last_updated":"2025-09-10T14:41:07Z","snapshot_observed_at":"2026-08-07T18:57:24.013284Z","submitted_at":"2025-09-10T14:41:07Z","title":"Architecting Resilient LLM Agents: A Guide to Secure Plan-then-Execute Implementations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08646","snapshot_observed_at":"2026-08-10T23:01:35.630273Z","title":"Del Rosario, Klaudia Krawiecka, and Christian Schroeder de Witt","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.630273Z"},"links":{"cited_paper":"/paper/2509.08646","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:ae7216bdd434d46a45ebb46908862668c2c58c88e12ebd0b820d51f261763c3a","observation_id":"1a45079d-5852-4f74-bab1-0229a88e15c3","resolution":{"observed_at":"2026-08-10T23:01:35.630273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-10T23:01:35.633179Z","title":"Toolformer: Language models can teach themselves to use tools","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.633179Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:ea69698680ca7595e083c0ef8a622e595a9d2a6b03f9abfe198f1d915966424f","observation_id":"1f63ca0e-1696-4977-8787-6c7a4866e897","resolution":{"observed_at":"2026-08-10T23:01:35.633179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.636179Z","title":"HuggingGPT: Solving AI tasks with ChatGPT and its friends in hugging face","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.636179Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:17ca9f73e608cf1abb6ffff3dbbd45bc73f3a38f96c6c3d96275ddc0d26146c7","observation_id":"3287544e-72b4-4d57-b3ce-b2c028532371","resolution":{"observed_at":"2026-08-10T23:01:35.636179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13081","last_updated":"2025-07-17T12:51:07Z","snapshot_observed_at":"2026-08-10T11:18:27.816851Z","submitted_at":"2025-07-17T12:51:07Z","title":"iReDev: A Knowledge-Driven Multi-Agent Framework for Intelligent Requirements Development","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.13081","snapshot_observed_at":"2026-08-10T23:01:35.638736Z","title":"iReDev: A knowledge-driven multi-agent framework for intelligent requirements development, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.638736Z"},"links":{"cited_paper":"/paper/2507.13081","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:fda92a82a32d147c38e685819d6d0790b90ca49dfb854c30aad8bed1a4a669a4","observation_id":"ec066b2d-7c9e-4b88-8e65-06046c159ad4","resolution":{"observed_at":"2026-08-10T23:01:35.638736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.641693Z","title":"SentiMM: A multimodal multi-agent framework for sentiment analysis in social media,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.641693Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:c9ca526056e6d2fe76f7495e09ef3c206f372eded15d06ca938df2c2ed03f91a","observation_id":"45abc842-3186-4af0-bd7e-a95067b0d78f","resolution":{"observed_at":"2026-08-10T23:01:35.641693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.13021","last_updated":"2026-04-27T11:42:26Z","snapshot_observed_at":"2026-08-11T04:30:24.333094Z","submitted_at":"2025-09-16T12:45:45Z","title":"xOffense: An Autonomous Multi-Agent Framework for Penetration Testing with Domain-Adapted Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.13021","snapshot_observed_at":"2026-08-10T23:01:35.647556Z","title":"xoffense: An autonomous multi- agent framework for penetration testing with domain-adapted large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.647556Z"},"links":{"cited_paper":"/paper/2509.13021","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:f6faba50a73fa407c9ecdb19f2a8810cb77f0369f59a7af1e247be7a9d00469b","observation_id":"901dfc73-dfa5-4c2d-843c-eef1836d35ea","resolution":{"observed_at":"2026-08-10T23:01:35.647556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.651564Z","title":"Lin, Eliot Krzysztof Jones, Donovan Julian Jasper, Ethan Ho, Anna H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.651564Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:5cc35950ca9919bcd902f80d9e12a673d3a52f165b8acb587b7fe7b3403eb960","observation_id":"84dea266-5519-4e0f-8279-6bd3287d25fb","resolution":{"observed_at":"2026-08-10T23:01:35.651564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.654095Z","title":"Generative AI-driven hierarchical multi-agent framework for zero-touch optical networks, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.654095Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:fabd6a9a6163ce839214536fb38005a760a9aa7b363ba1717a5ec59a4245d311","observation_id":"691c522d-49e5-43a6-b8d7-ccb8cc017c5f","resolution":{"observed_at":"2026-08-10T23:01:35.654095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.656554Z","title":"Multi-agent LLM orchestration achieves deterministic, high-quality decision support for incident response, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.656554Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:8b961ba8399e669f7c4c70c7135d2c662a7f86559593812ffe0004ea69525a9f","observation_id":"7dd39556-31b6-416e-919d-70fc6550e6e3","resolution":{"observed_at":"2026-08-10T23:01:35.656554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00906","last_updated":"2025-04-01T15:40:27Z","snapshot_observed_at":"2026-07-06T21:02:28.100677Z","submitted_at":"2025-04-01T15:40:27Z","title":"Agent S2: A Compositional Generalist-Specialist Framework for Computer Use Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00906","snapshot_observed_at":"2026-08-10T23:01:35.659062Z","title":"Agent s2: A compositional generalist-specialist framework for computer use agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.659062Z"},"links":{"cited_paper":"/paper/2504.00906","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:59c124d6a3f3a0ed96d67f04d8bfdf2276664726f203f48bcad19017efaa6477","observation_id":"adb5527c-b2b1-417e-8002-2ce9847da674","resolution":{"observed_at":"2026-08-10T23:01:35.659062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2601.20380","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:36.044228Z","title":"OmegaUse: Building a general-purpose GUI agent for autonomous task execution","venue":null,"work_id":"2a53e876-5546-4c7e-bcb6-755fdeab4a35","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.662924Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:c90f3e6fe69a1f3f03075c87a00e64a80a5eb79ff99811ea5f40fef9ae934e6c","observation_id":"63528579-e520-4bbe-a426-ccf7c5517246","resolution":{"observed_at":"2026-08-10T23:01:36.047704Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.19185","last_updated":"2026-04-02T22:22:56Z","snapshot_observed_at":"2026-07-06T22:30:36.671861Z","submitted_at":"2025-09-23T16:02:09Z","title":"An Empirical Study of Testing Practices in Open Source AI Agent Frameworks and Agentic Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.19185","snapshot_observed_at":"2026-08-10T23:01:35.665805Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.665805Z"},"links":{"cited_paper":"/paper/2509.19185","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:04c00413eb5b0e0c9533b1a7fb6d00b2b4f3bd91c2a131b200a4f92b5edc6c56","observation_id":"f3c0ffee-606a-4584-97cb-e4cd47405017","resolution":{"observed_at":"2026-08-10T23:01:35.665805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.13850","last_updated":"2026-05-24T10:19:18Z","snapshot_observed_at":"2026-08-08T07:41:39.543362Z","submitted_at":"2026-03-16T04:01:01Z","title":"A Two-Dimensional Framework for AI Agent Design Patterns: Cognitive Function and Execution Topology","version":2},"cited_work":{"arxiv_id":"2605.13850","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.13850","snapshot_observed_at":"2026-08-10T23:01:37.872833Z","title":"A Two-Dimensional Framework for AI Agent Design Patterns: Cognitive Function and Execution Topology","venue":"cs.AI","work_id":"e1c9a8e9-ccca-408f-864c-abd69f2d2ead","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.668706Z"},"links":{"cited_paper":"/paper/2605.13850","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:84ed7951be9a59b923ed179e9c71d540ee443bf967a522c7ef4cf359db764ed9","observation_id":"42aa1d8f-1201-41e9-9a3e-02e021fd7c3e","resolution":{"observed_at":"2026-08-10T23:01:37.875866Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07913","last_updated":"2025-02-11T14:30:44Z","snapshot_observed_at":"2026-08-10T20:27:31.971462Z","submitted_at":"2025-01-14T07:55:18Z","title":"Governing AI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07913","snapshot_observed_at":"2026-08-10T23:01:35.671459Z","title":"Governing AI agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.671459Z"},"links":{"cited_paper":"/paper/2501.07913","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:b759e4d7cb0f1c1f4913a2d618bdef5015eff49a732d4386bf1565337ce5c50d","observation_id":"add4d526-bcf5-4272-b7cf-7238890e9cf5","resolution":{"observed_at":"2026-08-10T23:01:35.671459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01635","last_updated":"2025-02-03T18:59:13Z","snapshot_observed_at":"2026-08-10T10:52:49.507908Z","submitted_at":"2025-02-03T18:59:13Z","title":"The AI Agent Index","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01635","snapshot_observed_at":"2026-08-10T23:01:35.674505Z","title":"Hunter, Carson Ezell, Emma Cabalé, Michael Gerovitch, Stewart Slocum, Kevin Wei, Nikola Jurkovic, Ariba Khan, Phillip J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.674505Z"},"links":{"cited_paper":"/paper/2502.01635","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:693ffe423d43e81817fee90a0bd44ca285cce85041b03bf685aef1a364e167e6","observation_id":"c9ea7510-3b8c-49a0-852c-a570ba15ded3","resolution":{"observed_at":"2026-08-10T23:01:35.674505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.677546Z","title":"Reflexion: Language agents with verbal reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.677546Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:87eaf9c42eca38d4d1adbcb2f0be8fc5906dc60e731d01c1ff54dc37a78b7c35","observation_id":"5a9985a9-5b84-4abf-861f-88c391b0aa02","resolution":{"observed_at":"2026-08-10T23:01:35.677546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-06T23:42:24.725526Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"cited_work":{"arxiv_id":"2506.15894","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.15894","snapshot_observed_at":"2026-08-10T23:01:37.846397Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","venue":"cs.CL","work_id":"6efc19b6-d8fb-4ad3-9130-718ae2a19cc6","year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.680054Z"},"links":{"cited_paper":"/paper/2506.15894","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:0e71e3c4c31b6c90102177808e428459481823be9a51366c9546c1abc564baf7","observation_id":"db5d97df-474b-4f8f-b5c5-96f76572501f","resolution":{"observed_at":"2026-08-10T23:01:37.849405Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14092","last_updated":"2024-10-03T02:00:53Z","snapshot_observed_at":"2026-08-06T15:12:30.397139Z","submitted_at":"2024-05-23T01:43:45Z","title":"Large Language Models Can Self-Correct with Key Condition Verification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14092","snapshot_observed_at":"2026-08-10T23:01:35.682869Z","title":"Large language models can self-correct with key condition verification, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.682869Z"},"links":{"cited_paper":"/paper/2405.14092","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:54342585dd5cd20b2721b6bfc1d7ff2c7ce44671b37141410b9998e5eae7b39f","observation_id":"5753611a-4298-44c7-bd09-4acea5a5c805","resolution":{"observed_at":"2026-08-10T23:01:35.682869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.685622Z","title":"Decomposing LLM self-correction: The accuracy-correction paradox and error depth hypothesis, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.685622Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:5f249206d9c48881a296498ebfcbfe9ec87f8a5a31304c7347cbb307cd82911d","observation_id":"307c0cdc-04a0-48be-a362-52d169bf18da","resolution":{"observed_at":"2026-08-10T23:01:35.685622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13271","last_updated":"2025-06-30T11:12:31Z","snapshot_observed_at":"2026-08-07T15:43:06.384864Z","submitted_at":"2025-05-19T15:52:19Z","title":"CSC-SQL: Corrective Self-Consistency in Text-to-SQL via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13271","snapshot_observed_at":"2026-08-10T23:01:35.688258Z","title":"CSC-SQL: Corrective self-consistency in text-to-SQL via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.688258Z"},"links":{"cited_paper":"/paper/2505.13271","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:6008a8cbcb86f05cb08bfb6624fa7bb32c554890c694f14bef529ed20d0a981e","observation_id":"24a7b499-63cf-473e-8a30-198ba7f86666","resolution":{"observed_at":"2026-08-10T23:01:35.688258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07935","last_updated":"2025-08-11T12:50:46Z","snapshot_observed_at":"2026-08-10T18:06:28.452284Z","submitted_at":"2025-08-11T12:50:46Z","title":"SHIELDA: Structured Handling of Exceptions in LLM-Driven Agentic Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.07935","snapshot_observed_at":"2026-08-10T23:01:35.691627Z","title":"SHIELDA: Structured handling of exceptions in LLM-driven agentic workflows, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.691627Z"},"links":{"cited_paper":"/paper/2508.07935","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:bd3d67867bc17e7f89b8c5d88e10f69d18d7f53871d39a74b13decdf11b4641b","observation_id":"ac8685f8-54ae-4ee3-9784-32b8027f87f0","resolution":{"observed_at":"2026-08-10T23:01:35.691627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.694532Z","title":"Beyond entangled planning: Task-decoupled planning for long-horizon agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.694532Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:75232bffe924f5f6407cef58adc2231c056b2329db8d591b691ac719c3ff6217","observation_id":"69cfafb1-596d-403e-bda3-fd2f5f9a17cb","resolution":{"observed_at":"2026-08-10T23:01:35.694532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-07T08:29:46.650400Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-10T23:01:35.697245Z","title":"Voyager: An open-ended embodied agent with large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.697245Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:e9feceff218333bff6f51caec59e401035614f207047f8e75288e66efa9a3be2","observation_id":"a1ee9040-cad6-44c8-914d-f865b460ce2f","resolution":{"observed_at":"2026-08-10T23:01:35.697245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.701005Z","title":"ViReSkill: Vision-grounded replanning with skill memory for LLM-based planning in lifelong robot learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.701005Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:400f14b10821aa5a2c01fa820a97472376ee4e37cbf9d1581fc5960dc2600181","observation_id":"0011074b-293d-4309-a6bf-df0031a71baa","resolution":{"observed_at":"2026-08-10T23:01:35.701005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04700","last_updated":"2025-08-12T15:11:53Z","snapshot_observed_at":"2026-08-09T20:49:03.329443Z","submitted_at":"2025-08-06T17:58:46Z","title":"SEAgent: Self-Evolving Computer Use Agent with Autonomous Learning from Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.04700","snapshot_observed_at":"2026-08-10T23:01:35.703441Z","title":"SEAgent: Self-evolving computer use agent with autonomous learning from experience, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.703441Z"},"links":{"cited_paper":"/paper/2508.04700","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:d1cdf9ec5a14071afd60036c6170ab9c29972da919cd4539a18e38be0fc7d8fe","observation_id":"e3fd0de4-9bc6-48f0-84fa-fad8f6ca66fb","resolution":{"observed_at":"2026-08-10T23:01:35.703441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.706348Z","title":"Segment policy optimization: Effective segment-level credit assignment in RL for large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.706348Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:2986953c3e9609f429a751e056ae0fd8ef2d05b21a34f99f7f423150e0934f60","observation_id":"5b467a41-9e0c-4344-bb23-a87414d2db54","resolution":{"observed_at":"2026-08-10T23:01:35.706348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.26684","last_updated":"2026-06-01T06:20:12Z","snapshot_observed_at":"2026-08-03T17:58:37.045292Z","submitted_at":"2026-05-26T08:23:34Z","title":"Beyond Trajectory-Level Attribution: Graph-Based Credit Assignment for Agentic Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.26684","snapshot_observed_at":"2026-08-10T23:01:35.708864Z","title":"Beyond trajectory-level attribution: Graph-based credit assignment for agentic reinforcement learn- ing, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.708864Z"},"links":{"cited_paper":"/paper/2605.26684","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:fe8958ed59fcb14fb5b7e93824d9e5ed0c8cf00ddf3802f547434d3931da9d58","observation_id":"341cc47c-06cd-4f9e-9f2f-7efe851364ed","resolution":{"observed_at":"2026-08-10T23:01:35.708864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.05965","last_updated":"2026-05-07T10:11:51Z","snapshot_observed_at":"2026-07-06T23:18:31.432422Z","submitted_at":"2026-05-07T10:11:51Z","title":"Beyond Uniform Credit Assignment: Selective Eligibility Traces for RLVR","version":1},"cited_work":{"arxiv_id":"2605.05965","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.05965","snapshot_observed_at":"2026-08-10T23:01:37.554932Z","title":"Beyond Uniform Credit Assignment: Selective Eligibility Traces for RLVR","venue":"cs.LG","work_id":"fcff61b0-1ed8-43f7-83eb-8e62ee758170","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.712150Z"},"links":{"cited_paper":"/paper/2605.05965","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:1be822795e50e773ecaed901574a7b1b37fa97bc8d0cad3646a3bfd7854e74cd","observation_id":"c6470f50-8445-4a83-8d26-7cb5846d6b56","resolution":{"observed_at":"2026-08-10T23:01:37.558636Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.06194","last_updated":"2026-07-29T06:55:29Z","snapshot_observed_at":"2026-08-03T09:13:12.714748Z","submitted_at":"2026-03-06T12:06:57Z","title":"MICA: Multi-granularity Intertemporal Credit Assignment for Long-Horizon Emotional Support Dialogue","version":3},"cited_work":{"arxiv_id":"2603.06194","doi":"10.48550/arxiv.2603.06194","metadata_source":"pith","pith_arxiv_id":"2603.06194","snapshot_observed_at":"2026-08-11T00:16:15.729268Z","title":"MICA: Multi-granularity Intertemporal Credit Assignment for Long-Horizon Emotional Support Dialogue","venue":"cs.CL","work_id":"9a4489d7-d836-4e88-a2bc-a36c3a78efeb","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.714955Z"},"links":{"cited_paper":"/paper/2603.06194","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:de5fb2d76ce606492081872552980949e43bfab83ed78c1a1ac56e843615c3e2","observation_id":"18100c34-618d-4f6f-a317-ab6985c78114","resolution":{"observed_at":"2026-08-10T23:01:35.979608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.21768","last_updated":"2026-05-20T22:02:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-20T22:02:00Z","title":"Memory-R2: Fair Credit Assignment for Long-Horizon Memory-Augmented LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.21768","snapshot_observed_at":"2026-08-10T23:01:35.718280Z","title":"Memory-r2: Fair credit assignment for long-horizon memory- augmented LLM agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.718280Z"},"links":{"cited_paper":"/paper/2605.21768","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:9ae081c50de34e2bbdda8bf9a28c5918cea1f7effca25ed57b0355a6530db81b","observation_id":"67b78875-b23f-4f73-99ed-7715ecf8436c","resolution":{"observed_at":"2026-08-10T23:01:35.718280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.721043Z","title":"Demystifying reinforcement learning for long-horizon tool-using agents: A comprehensive recipe, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.721043Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:44b7655132ce8970176c5e85510a7bbefc27c9454e3619a4f4216af9eb91aec0","observation_id":"6f24c853-84c5-4563-a314-5993871c2b10","resolution":{"observed_at":"2026-08-10T23:01:35.721043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-10T23:01:35.723496Z","title":"Let’s verify step by step, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.723496Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:8814bb0b659cf4b70baa175d1a3de118130c1fe49989a41aa25fd091590c5ce6","observation_id":"1a06d184-2b6d-4231-b3cf-177e3d10968f","resolution":{"observed_at":"2026-08-10T23:01:35.723496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.726497Z","title":"Entropy-regularized process reward model, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.726497Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:8a9c052e8b798b2d5b47fd06b25d513097dd5e26fffdecac77d3a833d6586167","observation_id":"d12b5d82-c357-4464-89c1-dcb0d289388e","resolution":{"observed_at":"2026-08-10T23:01:35.726497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.728986Z","title":"GroundedPRM: Tree-guided and fidelity-aware process reward mod- eling for step-level reasoning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.728986Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:87f73c624373648c20d9fb026b70de405f05c4b7db03c653ec18e0f51a1c539b","observation_id":"f48e0268-e156-475a-ab03-ac7aadb5c4f9","resolution":{"observed_at":"2026-08-10T23:01:35.728986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.21154","last_updated":"2026-05-28T14:21:47Z","snapshot_observed_at":"2026-08-09T12:57:17.611301Z","submitted_at":"2025-09-25T13:40:36Z","title":"GRPO is Secretly a Process Reward Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.21154","snapshot_observed_at":"2026-08-10T23:01:35.731504Z","title":"GRPO is secretly a process reward model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.731504Z"},"links":{"cited_paper":"/paper/2509.21154","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:3a6a43f2ddcad6f553fdf7aacaaa0c44b11f3d07b93d1f55872b47123b16a163","observation_id":"f4d8f352-658f-4f61-951f-23098439453f","resolution":{"observed_at":"2026-08-10T23:01:35.731504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16265","last_updated":"2025-05-22T05:56:11Z","snapshot_observed_at":"2026-08-10T13:00:24.344501Z","submitted_at":"2025-05-22T05:56:11Z","title":"Think-RM: Enabling Long-Horizon Reasoning in Generative Reward Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16265","snapshot_observed_at":"2026-08-10T23:01:35.734381Z","title":"Think-RM: Enabling long-horizon reasoning in generative reward models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.734381Z"},"links":{"cited_paper":"/paper/2505.16265","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:3ab5d47169fec0c8e39aceec8958ab03b26375b14df5d2a1a2a9849a67a4b4b0","observation_id":"abcf2ec5-4a78-4c06-90b6-c33f2e7f18b6","resolution":{"observed_at":"2026-08-10T23:01:35.734381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.737168Z","title":"AgentPRM: Process reward models for LLM agents via step-wise promise and progress, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.737168Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:b10b697aa050c802a561bc56ed06c880f4762caaa3d9affd3d621509cdd59c3e","observation_id":"f6761413-445d-484c-8e28-5896ccde7a29","resolution":{"observed_at":"2026-08-10T23:01:35.737168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14820","last_updated":"2026-04-16T09:41:47Z","snapshot_observed_at":"2026-07-06T23:02:31.717911Z","submitted_at":"2026-04-16T09:41:47Z","title":"SWE-TRACE: Optimizing Long-Horizon SWE Agents Through Rubric Process Reward Models and Heuristic Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14820","snapshot_observed_at":"2026-08-10T23:01:35.739622Z","title":"SWE-TRACE: Optimizing long-horizon SWE agents through rubric process reward models and heuristic test-time scaling, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.739622Z"},"links":{"cited_paper":"/paper/2604.14820","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:ceefcd5adbb2f732478696cd71fa0c0d4f46bf90df4825fd1d7af13e78e48b80","observation_id":"f5be3098-e6dc-41b4-a776-5bec79c7e34c","resolution":{"observed_at":"2026-08-10T23:01:35.739622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.17431","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:37.229852Z","title":"Agentic rein- forcement learning for search misaligns instruction-tuning, 2025","venue":null,"work_id":"28d9aafb-6020-4faa-a2cc-d98433f8a3e3","year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.742845Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:5ff1d7b5be26fe021a33730a2df19a0bc13dab536fdb4f063df1601b852ef72d","observation_id":"5d856c48-6af7-4ea0-9cb8-12146571136b","resolution":{"observed_at":"2026-08-10T23:01:37.234083Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07367","last_updated":"2026-06-05T15:09:52Z","snapshot_observed_at":"2026-08-04T14:57:01.386223Z","submitted_at":"2026-06-05T15:09:52Z","title":"Self-evolving LLM agents with in-distribution Optimization","version":1},"cited_work":{"arxiv_id":"2606.07367","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.07367","snapshot_observed_at":"2026-08-10T23:01:37.164083Z","title":"Self-evolving LLM agents with in-distribution Optimization","venue":"cs.LG","work_id":"a1df86f1-4bb9-4c85-a8ac-34bdb0310a14","year":2026},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.745579Z"},"links":{"cited_paper":"/paper/2606.07367","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:d78e613a3da80ca771592e9bf12d39724fd87fa26a1af0051c99df6903ffa567","observation_id":"2169a623-151b-4748-b08f-1e94f0cacc5f","resolution":{"observed_at":"2026-08-10T23:01:37.167467Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:01:35.749355Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.749355Z"},"links":{"citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:e313ae9220765fe1efb5a89b09cfe22d5170c95fa8bfd4e00ba47f1f2756600e","observation_id":"1b0478b4-4a35-464f-a68a-9a73bf9eea4b","resolution":{"observed_at":"2026-08-10T23:01:35.749355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14354","last_updated":"2024-08-26T15:30:05Z","snapshot_observed_at":"2026-08-10T18:57:19.903703Z","submitted_at":"2024-08-26T15:30:05Z","title":"SWE-bench-java: A GitHub Issue Resolving Benchmark for Java","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14354","snapshot_observed_at":"2026-08-10T23:01:35.755009Z","title":"Qi, Hao Yu, Lei Yu, Dezhi Ran, Muhan Zeng, Bo Shen, Pan Bian, Guangtai Liang, Bei Guan, Pengjie Huang, Tao Xie, Yongji Wang, and Qianxiang Wang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.755009Z"},"links":{"cited_paper":"/paper/2408.14354","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:540e726c23d006a3af094fd9b37ca719fd690e9094339b2ca193efccb83edb38","observation_id":"c40f7a68-d53b-4b54-92b5-d969088ad129","resolution":{"observed_at":"2026-08-10T23:01:35.755009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02605","last_updated":"2025-04-03T14:06:17Z","snapshot_observed_at":"2026-08-09T23:51:45.534260Z","submitted_at":"2025-04-03T14:06:17Z","title":"Multi-SWE-bench: A Multilingual Benchmark for Issue Resolving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02605","snapshot_observed_at":"2026-08-10T23:01:35.758160Z","title":"Multi-SWE-bench: A multilingual benchmark for issue resolving, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.758160Z"},"links":{"cited_paper":"/paper/2504.02605","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:f3151ca72d42b481077adebdafc6e2a6d700a0a14b395c561932b0b5822297d7","observation_id":"eabd52b4-b678-4be2-8d51-d1687327794f","resolution":{"observed_at":"2026-08-10T23:01:35.758160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T05:11:06.204546Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":90,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":142},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 142 outbound references and 0 inbound Pith citation observations for arXiv:2608.06663."}