{"as_of":"2026-08-08T08:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a1d6c991050185596741f321203699f80af6ce2be2766c9e805782264088da54","coverage":[{"denominator":95,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":95,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:38:41.021030Z","state":"measured"},{"denominator":95,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":95,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05013/citation-record","integrity":"/paper/2608.05013/integrity","json":"/paper/2608.05013/citation-record.json","paper":"/paper/2608.05013"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.19678","last_updated":"2026-03-06T19:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-28T11:08:22Z","title":"From LLM Reasoning to Autonomous AI Agents: A Comprehensive Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19678","snapshot_observed_at":"2026-08-08T00:38:39.536928Z","title":"From llm reasoning to autonomous ai agents: A comprehensive review, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.536928Z"},"links":{"cited_paper":"/paper/2504.19678","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:84da4d98fc7523a1be5601d935fd9a428beb54444ed5bed29f2ff1f58797dbb0","observation_id":"04750b3e-8eaf-4a96-b53c-c54dcba0a03d","resolution":{"observed_at":"2026-08-08T00:38:39.536928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.541971Z","title":"Llm-based agentic systems for software engineering: Challenges and opportunities,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.541971Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:310484da3a108c95d6a64a4218521172df98c84db0682c79ade796ff2c814f2c","observation_id":"80ff8988-6419-4476-aa75-3b2ef2e30d5f","resolution":{"observed_at":"2026-08-08T00:38:39.541971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.549630Z","title":"Sager, Benjamin Meyer, Peng Yan, Rebekka Von Wartburg-Kottler, Layan Etaiwi, Aref Enayati, Gabriel Nobel, Ahmed Abdulkadir, Benjamin F","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.549630Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:1b86adb85a50a62f452b2ec3a5329317b59667020fef424fa4d30b266b9e435a","observation_id":"c1eed431-8eb6-445e-ac82-cd179c3cbb67","resolution":{"observed_at":"2026-08-08T00:38:39.549630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.553376Z","title":"Deep research of deep research: From transformer to agent, from ai to ai for science, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.553376Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:7a3946b2d7067730de1077a552dae33bb23e054e8cbd49a8bf273f56c49181ab","observation_id":"6786f0a2-c3e8-4b42-aa98-aa7e6bf135fc","resolution":{"observed_at":"2026-08-08T00:38:39.553376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.556875Z","title":"URLhttps://arxiv.org/abs/2602.22680","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.556875Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:82fdfe487276d1c6a0a0f76043984c1ad6a069f1aff1327e484b3bb8df38785f","observation_id":"07e3de04-58b5-475d-81e3-57bed148998d","resolution":{"observed_at":"2026-08-08T00:38:39.556875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.20613","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:43.951270Z","title":"Agentif-oneday: A task-level instruction-following benchmark for general ai agents in daily scenarios, 2026","venue":null,"work_id":"67b83992-4fcf-49bc-b789-d121f0fc88ac","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.560065Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:df98c1a611e40270bb3a236ae2c6ee814421f0b698f057693573ed45e7389d0e","observation_id":"7b5098e6-d1dd-462f-a5d5-b405226c0a21","resolution":{"observed_at":"2026-08-08T00:38:43.955952Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-08T00:38:39.563986Z","title":"Glm-5: from vibe coding to agentic engineering, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.563986Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:86874b7e90042c4a59fb7702615e00ef75ef3f5661cfea8c0eb3d54d7fd98503","observation_id":"f0cc3073-345b-4686-83e6-347f3511a02f","resolution":{"observed_at":"2026-08-08T00:38:39.563986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-08T00:38:39.567649Z","title":"React: Synergizing reasoning and acting in language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.567649Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:68ede4d323b0643fcffe1d0f106f3e1712f7fc2a598d91ffdb8c7d00ba03b215","observation_id":"586d9ffe-7791-49cc-8e90-c7daa9ab1019","resolution":{"observed_at":"2026-08-08T00:38:39.567649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.571781Z","title":"A subgoal-driven framework for improving long-horizon llm agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.571781Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:a9d34d305aba0adf63b34897cc0eb441df851e06815654c58beee2e316f437b5","observation_id":"a081deff-7e38-4f1f-a40f-fd0a42363cd2","resolution":{"observed_at":"2026-08-08T00:38:39.571781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.10507","last_updated":"2026-06-09T07:35:14Z","snapshot_observed_at":"2026-08-05T06:17:13.116592Z","submitted_at":"2026-06-09T07:35:14Z","title":"HIPIF: Hierarchical Planning and Information Folding for Long-Horizon LLM Agent Learning","version":1},"cited_work":{"arxiv_id":"2606.10507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.10507","snapshot_observed_at":"2026-08-08T00:38:43.771411Z","title":"HIPIF: Hierarchical Planning and Information Folding for Long-Horizon LLM Agent Learning","venue":"cs.AI","work_id":"cd53a461-9c83-42fb-916c-005819aa349c","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.575007Z"},"links":{"cited_paper":"/paper/2606.10507","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:0c27f4c2c5a29d870b4708904286e02a1620abb2ee63e7dd708379e11611140e","observation_id":"7865ef8b-e6c9-4079-bc8f-3d07ee43ea5b","resolution":{"observed_at":"2026-08-08T00:38:43.775372Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-08T00:38:39.578497Z","title":"Xu, Hao Zhu, Xuhui Zhou, Robert Lo, Abishek Sridhar, Xianyi Cheng, Tianyue Ou, Yonatan Bisk, Daniel Fried, Uri Alon, and Graham Neubig","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.578497Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:58dec302e806a0af0b3dd6ce2eea574dd0bd32f92d83c0293b6dd8ec852f92f4","observation_id":"56a9fc33-7c88-422a-81f2-076fc2d4b9f2","resolution":{"observed_at":"2026-08-08T00:38:39.578497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11366","last_updated":"2023-10-10T05:21:45Z","snapshot_observed_at":"2026-07-06T15:05:53.556198Z","submitted_at":"2023-03-20T18:08:50Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11366","snapshot_observed_at":"2026-08-08T00:38:39.581950Z","title":"Reflexion: Language agents with verbal reinforcement learning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.581950Z"},"links":{"cited_paper":"/paper/2303.11366","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:940a160eb52418c8b3b01cd9b15a8a64596f323fc2701470fb9e9f094d691176","observation_id":"90c52209-8ed0-4d56-ad42-0c7427ddd1f1","resolution":{"observed_at":"2026-08-08T00:38:39.581950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-08-08T00:38:39.585957Z","title":"Self-refine: Iterative refinement with self-feedback, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.585957Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:cbc6f98e6743bc7f1ad51e2fcfccb348c3f000375d30ff5fa31cbfaf88aaa07f","observation_id":"548169e2-7067-4f58-8056-f913f434e35f","resolution":{"observed_at":"2026-08-08T00:38:39.585957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.589131Z","title":"Marco deepresearch: Unlocking efficient deep research agents via verification-centric design, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.589131Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:a81efa0b944e32d024ff1872186f0515d6f9fba42e2c3232b5cd8e3d03a5e675","observation_id":"67a3885a-0382-4be0-ae7d-eac8adf5520c","resolution":{"observed_at":"2026-08-08T00:38:39.589131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.29848","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:43.565041Z","title":"Agentfixer: From failure detection to fix recommendations in llm agentic systems, 2026","venue":null,"work_id":"20c34d82-10cf-4757-a91e-2a62f40330b3","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.622820Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:42ae7307eda60b86eb26651ca033739bdcda6aa10a72b4a380f719bd8cb80e54","observation_id":"2bfa67fa-d844-4a64-a515-74c59ad2e739","resolution":{"observed_at":"2026-08-08T00:38:43.667311Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.06448","last_updated":"2026-06-04T17:44:18Z","snapshot_observed_at":"2026-08-02T14:46:30.773077Z","submitted_at":"2026-06-04T17:44:18Z","title":"Agent Memory: Characterization and System Implications of Stateful Long-Horizon Workloads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.06448","snapshot_observed_at":"2026-08-08T00:38:39.657823Z","title":"Agent memory: Characterization and system implications of stateful long-horizon workloads, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.657823Z"},"links":{"cited_paper":"/paper/2606.06448","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:32b6b54acbe30ef2117e8f76bc467d5e1bd17f56b188373785b7229cac96b044","observation_id":"a379ab37-ac25-439a-8cb4-c8ade73a4d99","resolution":{"observed_at":"2026-08-08T00:38:39.657823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.20833","last_updated":"2026-05-20T07:25:33Z","snapshot_observed_at":"2026-08-08T02:04:54.204252Z","submitted_at":"2026-05-20T07:25:33Z","title":"MemGym: a Long-Horizon Memory Environment for LLM Agents","version":1},"cited_work":{"arxiv_id":"2605.20833","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.20833","snapshot_observed_at":"2026-08-08T00:38:43.200561Z","title":"MemGym: a Long-Horizon Memory Environment for LLM Agents","venue":"cs.CL","work_id":"8b8166c7-2ff6-4b0a-9e31-fac0cee26c35","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.716514Z"},"links":{"cited_paper":"/paper/2605.20833","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:7c65f5b9cbd020366f0604cf04173e8a3b2a5b16524b0e01f5666a9846d86c7e","observation_id":"61081a05-0526-4da6-aa28-f67be0aff174","resolution":{"observed_at":"2026-08-08T00:38:43.350593Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.772726Z","title":"Lightmem: Lightweight and efficient memory-augmented generation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.772726Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:0441686f7ca34ad271c8c86fcb4768f576af447d33793eb1ceccaaa4d2344c5c","observation_id":"c29a7ead-71b4-4644-8503-143fa7760e8b","resolution":{"observed_at":"2026-08-08T00:38:39.772726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.828429Z","title":"Gemini 3.1 pro model card, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.828429Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:b6a8e76f2d556062ff35a11ad3f912b6943da556c585bbe32c0937f3b0ea84ef","observation_id":"76acd607-ca3d-483a-adc6-c31871de1600","resolution":{"observed_at":"2026-08-08T00:38:39.828429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.832622Z","title":"Qwen3.5: Towards native multimodal agents, February 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.832622Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:c846bde0475e6e02cdb028fe1686e3646db9ba3bc0948afa5e16167edf92a44a","observation_id":"8a437970-00e0-4c66-b933-e06f617160db","resolution":{"observed_at":"2026-08-08T00:38:39.832622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.836836Z","title":"Qwen3.6-27B: Flagship-level coding in a 27B dense model, April 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.836836Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:fe09f445d21f6dcabbd60d8309fbaca3ab0b80e560e1d1220924b76268b905ee","observation_id":"1c88161f-59ff-457c-9b9d-cad6054130f2","resolution":{"observed_at":"2026-08-08T00:38:39.836836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.840071Z","title":"Gpt-5.5 system card","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.840071Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:5cab6303c71b635562071f91046cb6e7c268a3870357c78014c03036fd2f4352","observation_id":"0f456013-8aa8-4aec-96fe-5a837d5686bf","resolution":{"observed_at":"2026-08-08T00:38:39.840071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.843355Z","title":"Gemini 3 pro model card, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.843355Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:2b97c75c8fa3967df47b2bb4ca567e5f2a14d106cbd2f9c6f97565e4f2d95998","observation_id":"c2a64f32-2968-4c42-bf21-42d56604222f","resolution":{"observed_at":"2026-08-08T00:38:39.843355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.846865Z","title":"Towards a standard, enterprise-relevant agentic ai benchmark: Lessons from 5.5 billion tokens’ worth of agentic ai evaluations, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.846865Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:164939775d2039fa3c2617d9cc74725489e28e35e523e9e3b1d66974980a2d79","observation_id":"b18454b0-3a85-4d93-b67d-a32adae0107e","resolution":{"observed_at":"2026-08-08T00:38:39.846865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16944","last_updated":"2025-05-22T17:31:10Z","snapshot_observed_at":"2026-08-07T20:49:20.049385Z","submitted_at":"2025-05-22T17:31:10Z","title":"AGENTIF: Benchmarking Instruction Following of Large Language Models in Agentic Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16944","snapshot_observed_at":"2026-08-08T00:38:39.850531Z","title":"Agentif: Benchmarking instruction following of large language models in agentic scenarios, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.850531Z"},"links":{"cited_paper":"/paper/2505.16944","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:4aceee965a34c55fb15bc81a9f4327e1cf71cf862abeb75d9a4534f947a14e06","observation_id":"d5a82a04-907a-47fe-8923-de43d3b06e60","resolution":{"observed_at":"2026-08-08T00:38:39.850531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21460","last_updated":"2025-03-27T12:50:17Z","snapshot_observed_at":"2026-07-06T20:59:35.694800Z","submitted_at":"2025-03-27T12:50:17Z","title":"Large Language Model Agent: A Survey on Methodology, Applications and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21460","snapshot_observed_at":"2026-08-08T00:38:39.853869Z","title":"Yu, and Ming Zhang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.853869Z"},"links":{"cited_paper":"/paper/2503.21460","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:014b99ca797c2db6781f009e0581998d032270ec0fb5cbd2862b64d845f5ecbd","observation_id":"c17779f0-e8b1-429b-b25c-d8a8748db55e","resolution":{"observed_at":"2026-08-08T00:38:39.853869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.857768Z","title":"Agentic large language models, a survey.Journal of Artificial Intelligence Research, 84, December 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.857768Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:2d187824a15caecb1df5a123284f995f8cfc288b67b79fe1bbcf65c0645062de","observation_id":"af763340-8fdc-49c6-bc49-f9b398ef3b1b","resolution":{"observed_at":"2026-08-08T00:38:39.857768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.860692Z","title":"R., and Rajkumar Buyya","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.860692Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:fbd1fff36b3014a199526335977117d0d11d8b1e99496a519689837a970c3d37","observation_id":"a9a88cba-395c-40b6-bfda-b602e675250c","resolution":{"observed_at":"2026-08-08T00:38:39.860692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.00835","last_updated":"2026-06-29T05:50:41Z","snapshot_observed_at":"2026-07-13T14:49:11.842114Z","submitted_at":"2026-04-01T12:46:51Z","title":"Agentic Tool Use in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.00835","snapshot_observed_at":"2026-08-08T00:38:39.863622Z","title":"Agentic tool use in large language models, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.863622Z"},"links":{"cited_paper":"/paper/2604.00835","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:86c5fb9a9d5477bdc8c151bbbdff0f498753afa5ed87a04ff22ed8ed627a91f4","observation_id":"5ca62c7e-fade-44bd-af5e-a226af6e2507","resolution":{"observed_at":"2026-08-08T00:38:39.863622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.16330","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:42.956338Z","title":"Generalizability of large language model-based agents: A comprehensive survey, 2025","venue":null,"work_id":"cb8d58b0-870f-4e61-bbf9-bc7dbeb0d93d","year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.867530Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:0507cf18dab0556596e617b28caf1a9982602d52781b06e3c936118060c3a98a","observation_id":"29f91669-f9f5-4973-8c39-286e5700e3cc","resolution":{"observed_at":"2026-08-08T00:38:43.020563Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-07-31T19:03:03.494918Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-08T00:38:39.870399Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.870399Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:81c3abf81f847f96a9d6a4e6e627bb652fb5ca3a4d110b43bf5c17dba00c0640","observation_id":"5cffe755-aa90-45f8-bfb2-640b479be9a4","resolution":{"observed_at":"2026-08-08T00:38:39.870399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:39.902009Z","title":"Websailor- v2: Bridging the chasm to proprietary agents via synthetic data and scalable reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.902009Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:1c4a0f4c47a19b57ca0a41b5931cc5720eb6629020b0b3948176468bd82b8415","observation_id":"3f073bc2-7c5e-45f0-9218-5d2ffd6d73f0","resolution":{"observed_at":"2026-08-08T00:38:39.902009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00906","last_updated":"2025-04-01T15:40:27Z","snapshot_observed_at":"2026-07-06T21:02:28.100677Z","submitted_at":"2025-04-01T15:40:27Z","title":"Agent S2: A Compositional Generalist-Specialist Framework for Computer Use Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00906","snapshot_observed_at":"2026-08-08T00:38:39.938534Z","title":"Agent s2: A compositional generalist- specialist framework for computer use agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.938534Z"},"links":{"cited_paper":"/paper/2504.00906","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:5bddbdce47bd17837fe9f9eedf5ccf25a1ec637170ad51b8fce4af111863086c","observation_id":"cf24886b-61fe-460d-a943-9432a6f366ca","resolution":{"observed_at":"2026-08-08T00:38:39.938534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13131","last_updated":"2025-06-16T06:37:18Z","snapshot_observed_at":"2026-08-07T04:21:43.190472Z","submitted_at":"2025-06-16T06:37:18Z","title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13131","snapshot_observed_at":"2026-08-08T00:38:40.047564Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.047564Z"},"links":{"cited_paper":"/paper/2506.13131","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:5b0b35ca01e436157888a15bdd9a93d983e0712e70e92f812b487ff7d5cf6a0e","observation_id":"865fa3e2-22a1-493c-855b-afa97c994680","resolution":{"observed_at":"2026-08-08T00:38:40.047564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.00822","last_updated":"2026-05-04T08:55:15Z","snapshot_observed_at":"2026-07-06T22:47:24.369805Z","submitted_at":"2026-02-28T21:56:47Z","title":"ContextCov: Deriving and Enforcing Executable Constraints from Agent Instruction Files","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.00822","snapshot_observed_at":"2026-08-08T00:38:40.080419Z","title":"Contextcov: Deriving and enforcing executable constraints from agent instruction files, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.080419Z"},"links":{"cited_paper":"/paper/2603.00822","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:48a3c7122125d066717df6da43d1fc92d3f588fd50871fe053282f008bf6d166","observation_id":"3d043e16-85dd-4da7-8293-2c9eaf78dd2c","resolution":{"observed_at":"2026-08-08T00:38:40.080419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.084781Z","title":"Richard Yu","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.084781Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:b315ed487bd6346934c4ae575052919ac8ec0f226cb6398040856121c70a7259","observation_id":"81bd62d8-305c-4706-a15b-1c60c5f130a2","resolution":{"observed_at":"2026-08-08T00:38:40.084781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.088570Z","title":"Webresearcher: Unleashing unbounded reasoning capability in long-horizon agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.088570Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:01b17109d598e18be494e82f500f408a1baffb0c76ba19da81f1ee47c87fc52b","observation_id":"655f9331-19ef-43f9-b9d8-03656c02768f","resolution":{"observed_at":"2026-08-08T00:38:40.088570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.092093Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.092093Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:6a2fbb2d1c3721ac292e14fd9a3ca10b0d55c209f93f466146f11c6a49421554","observation_id":"6b0b7028-c3f7-4d49-86a0-25f0313d3a54","resolution":{"observed_at":"2026-08-08T00:38:40.092093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.05930","last_updated":"2026-04-07T04:58:28Z","snapshot_observed_at":"2026-08-02T11:04:20.320561Z","submitted_at":"2026-01-09T16:44:17Z","title":"Can We Predict Before Executing Machine Learning Agents?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.05930","snapshot_observed_at":"2026-08-08T00:38:40.097114Z","title":"Can we predict before executing machine learning agents?, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.097114Z"},"links":{"cited_paper":"/paper/2601.05930","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:ea318b87add61040c891bbf85558229eb1bd08ca4c033d60905dbd11159415a9","observation_id":"b298db28-2665-4ae2-a5b2-edf5ab7292b1","resolution":{"observed_at":"2026-08-08T00:38:40.097114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.100134Z","title":"Agentrl: Scaling agentic reinforcement learning with a multi-turn, multi-task framework, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.100134Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:d03be357eaaa1575143807edb76be82655fb69d3e4c33909c1d7165f083cfd64","observation_id":"387257a8-40de-4fa1-9bd2-a68d9170518b","resolution":{"observed_at":"2026-08-08T00:38:40.100134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18296","last_updated":"2026-04-21T06:22:33Z","snapshot_observed_at":"2026-07-06T22:43:02.453697Z","submitted_at":"2026-01-26T09:23:53Z","title":"Temp-R1: A Unified Autonomous Agent for Complex Temporal KGQA via Reverse Curriculum Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.18296","snapshot_observed_at":"2026-08-08T00:38:40.103638Z","title":"Temp-r1: A unified autonomous agent for complex temporal kgqa via reverse curriculum reinforcement learning, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.103638Z"},"links":{"cited_paper":"/paper/2601.18296","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:b79bb2fc2cbd13fc3e5ff150a1995922c5b23c5dc6d5f316b5c0502f4fed2f3d","observation_id":"bfeea1bf-f86d-4a35-8203-4b5a8f5fd69a","resolution":{"observed_at":"2026-08-08T00:38:40.103638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01952","last_updated":"2025-06-02T17:59:45Z","snapshot_observed_at":"2026-08-07T11:28:26.175325Z","submitted_at":"2025-06-02T17:59:45Z","title":"WebChoreArena: Evaluating Web Browsing Agents on Realistic Tedious Web Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01952","snapshot_observed_at":"2026-08-08T00:38:40.106880Z","title":"Webchorearena: Evaluating web browsing agents on realistic tedious web tasks, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.106880Z"},"links":{"cited_paper":"/paper/2506.01952","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:7d96912a831d2c076214e44b92f4061269d1eaf39277fa94cbc72553b19653fb","observation_id":"7b4217aa-847f-446c-a9c1-e742a0132ef7","resolution":{"observed_at":"2026-08-08T00:38:40.106880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.29537","last_updated":"2026-07-13T10:30:17Z","snapshot_observed_at":"2026-07-17T23:18:06.822637Z","submitted_at":"2026-06-28T17:59:17Z","title":"OSWorld 2.0: Benchmarking Computer Use Agents on Long-Horizon Real-World Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.29537","snapshot_observed_at":"2026-08-08T00:38:40.109954Z","title":"Osworld2.0: Benchmarkingcomputeruseagentsonlong-horizonreal-worldtasks,2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.109954Z"},"links":{"cited_paper":"/paper/2606.29537","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:7a19a3fe96e80a8f9813b4a224eb2d0e9729e26bdd3fd91ecd3e08baedfc0c24","observation_id":"2802c639-c1df-453e-ac9e-2422b95b71eb","resolution":{"observed_at":"2026-08-08T00:38:40.109954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27776","last_updated":"2026-04-30T12:13:27Z","snapshot_observed_at":"2026-08-02T19:49:15.389325Z","submitted_at":"2026-04-30T12:13:27Z","title":"WindowsWorld: A Process-Centric Benchmark of Autonomous GUI Agents in Professional Cross-Application Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27776","snapshot_observed_at":"2026-08-08T00:38:40.113594Z","title":"Windowsworld: A process-centric benchmark of autonomous gui agents in professional cross-application environments, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.113594Z"},"links":{"cited_paper":"/paper/2604.27776","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:3c2cdc22a105cba3e4487766abb7020d27524ad4b17c82a4105318a974994e25","observation_id":"3a38da17-07b0-4e86-b54e-449b0bd38431","resolution":{"observed_at":"2026-08-08T00:38:40.113594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.117606Z","title":"Mobileworld: Benchmarking autonomous mobile agents in agent-user interactive and mcp-augmented environments, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.117606Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:1262b9db2a958c27c6bf7d003884eeff9c83060a46166eb73723422db08b869c","observation_id":"68f7092e-8cb3-49aa-b477-833ea3b15112","resolution":{"observed_at":"2026-08-08T00:38:40.117606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16941","last_updated":"2025-11-14T22:00:03Z","snapshot_observed_at":"2026-08-06T21:34:46.041153Z","submitted_at":"2025-09-21T06:28:17Z","title":"SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.16941","snapshot_observed_at":"2026-08-08T00:38:40.120729Z","title":"Swe-bench pro: Can ai agents solve long-horizon software engineering tasks?, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.120729Z"},"links":{"cited_paper":"/paper/2509.16941","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:7ee196c1831777fd0401b3a8f8c1289e618816eaf5bd246a0ec583417507a1c8","observation_id":"0a31e3bf-61bd-491d-9f4e-46bf795551a7","resolution":{"observed_at":"2026-08-08T00:38:40.120729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.124583Z","title":"Deepswe v1.1: a cleaner, more reproducible benchmark for frontier coding agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.124583Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:b24bb25b1bcc3bd4067fa1996700492e511014eb2a6661bf1e45043481b9ad55","observation_id":"7d0f4a85-2cfa-41ce-b7e0-7730f6bb9fd0","resolution":{"observed_at":"2026-08-08T00:38:40.124583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12516","last_updated":"2025-04-16T22:27:45Z","snapshot_observed_at":"2026-08-03T00:43:33.338074Z","submitted_at":"2025-04-16T22:27:45Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12516","snapshot_observed_at":"2026-08-08T00:38:40.149028Z","title":"Browsecomp: A simple yet challenging benchmark for browsing agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.149028Z"},"links":{"cited_paper":"/paper/2504.12516","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:6a229757109cf3aba5e0c9d10f5467a7572c195256838c304a090b963449f016","observation_id":"8aa09c77-9568-4fdf-af64-39614a15442a","resolution":{"observed_at":"2026-08-08T00:38:40.149028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11763","last_updated":"2025-06-13T13:17:32Z","snapshot_observed_at":"2026-08-07T14:15:18.269910Z","submitted_at":"2025-06-13T13:17:32Z","title":"DeepResearch Bench: A Comprehensive Benchmark for Deep Research Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11763","snapshot_observed_at":"2026-08-08T00:38:40.206505Z","title":"Deepresearch bench: A comprehensive benchmark for deep research agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.206505Z"},"links":{"cited_paper":"/paper/2506.11763","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:1d66516510be3a2d4f37559c1b0233628c7878799815001711392c57bc27fc56","observation_id":"d66e2163-c5ef-42b6-bed2-5b6a669c5d2a","resolution":{"observed_at":"2026-08-08T00:38:40.206505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07982","last_updated":"2025-06-09T17:52:18Z","snapshot_observed_at":"2026-07-06T21:39:13.304260Z","submitted_at":"2025-06-09T17:52:18Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07982","snapshot_observed_at":"2026-08-08T00:38:40.219981Z","title":"URLhttps://arxiv.org/abs/2506.07982","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.219981Z"},"links":{"cited_paper":"/paper/2506.07982","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:4e0c024a0a21df1a4c33278b0b0a21821066fc8788b453ae51f721d9a1eb3c67","observation_id":"c34d5790-b6ef-4557-919b-873328926908","resolution":{"observed_at":"2026-08-08T00:38:40.219981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.335311Z","title":"A benchmark of expert-level academic questions to assess ai capabilities","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.335311Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:9ae347726f908e026d84ce6a87f4f1c0b89d852bada3d40f0969303cdb2e594d","observation_id":"a3e02029-5731-4636-910e-9bc8e3957e25","resolution":{"observed_at":"2026-08-08T00:38:40.335311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.340122Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.340122Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:46842242f48583afb7d09dfaa026d7a1441a0821fd05fc22204ff5318662fbe2","observation_id":"268b08bc-8b4b-4a9a-b142-51a3f9a85af7","resolution":{"observed_at":"2026-08-08T00:38:40.340122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.20683","last_updated":"2026-06-14T05:40:16Z","snapshot_observed_at":"2026-07-30T16:44:18.366904Z","submitted_at":"2026-06-14T05:40:16Z","title":"From Question Answering to Task Completion: A Survey on Agent System and Harness Design","version":1},"cited_work":{"arxiv_id":"2606.20683","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.20683","snapshot_observed_at":"2026-08-08T00:38:42.092078Z","title":"From Question Answering to Task Completion: A Survey on Agent System and Harness Design","venue":"cs.AI","work_id":"e9c46fad-a365-4b55-bb6c-95eb025c6990","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.348996Z"},"links":{"cited_paper":"/paper/2606.20683","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:20b0ec12125e463e7d2ab2f42aa133879de7a96b8766a03f9036d403c0b18934","observation_id":"203d08d0-d374-473f-8865-ba247b5e68cf","resolution":{"observed_at":"2026-08-08T00:38:42.189338Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.353053Z","title":"The tool decathlon: Benchmarking language agents for diverse, realistic, and long-horizon task execution, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.353053Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:2e071a15cd1b5d255a01347f9d48e47bab49eff89f132a98634a68d0db57131d","observation_id":"3c849c9f-a401-4be6-aa88-f4039a8a1463","resolution":{"observed_at":"2026-08-08T00:38:40.353053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.356344Z","title":"Lifesim: Long-horizon user life simulator for personalized assistant evaluation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.356344Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:5ff71b584376404b2792eb1dfc08b31959033597c3a1ffb5c1a96f68452db025","observation_id":"d98deaf1-c3c4-4a53-b4f5-5e39660c9e74","resolution":{"observed_at":"2026-08-08T00:38:40.356344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-08-08T00:38:40.359888Z","title":"Agencybench: Benchmarking the frontiers of autonomous agents in 1m-token real-world contexts, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.359888Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:21e99047464770438508d11b3c788210cb552e8a352062d36734035c680990bb","observation_id":"53dcfb93-67d9-4538-a10e-0d52a4499229","resolution":{"observed_at":"2026-08-08T00:38:40.359888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.05843","last_updated":"2026-06-04T17:59:52Z","snapshot_observed_at":"2026-08-08T03:30:45.952372Z","submitted_at":"2026-02-05T16:31:43Z","title":"OdysseyArena: Benchmarking Large Language Models For Long-Horizon, Active and Inductive Interactions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.05843","snapshot_observed_at":"2026-08-08T00:38:40.363598Z","title":"Odysseyarena: Benchmarking large language models for long-horizon, active and inductive interactions, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.363598Z"},"links":{"cited_paper":"/paper/2602.05843","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:46421fefcc9c0e46e44a813371c49e53f5bb552f21900acdf3ff666047daecd0","observation_id":"7ec780ab-da57-4e1c-ae97-bc8fa791f9dd","resolution":{"observed_at":"2026-08-08T00:38:40.363598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.09426","last_updated":"2026-07-06T14:25:02Z","snapshot_observed_at":"2026-08-07T06:06:28.992628Z","submitted_at":"2026-06-08T12:39:23Z","title":"WeaveBench: A Long-Horizon, Real-World Benchmark for Computer-Use Agents with Hybrid Interfaces","version":3},"cited_work":{"arxiv_id":"2606.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.09426","snapshot_observed_at":"2026-08-08T00:38:41.902147Z","title":"WeaveBench: A Long-Horizon, Real-World Benchmark for Computer-Use Agents with Hybrid Interfaces","venue":"cs.AI","work_id":"843f97fc-5ec4-462b-ab23-8a365de0fb3c","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.399733Z"},"links":{"cited_paper":"/paper/2606.09426","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:eb98afd6691bf81e5fa97b68f14296243296eba6944cb50ca9e82fa2ecee1573","observation_id":"4a6e44f2-f6d7-41ec-bee7-50322da1912c","resolution":{"observed_at":"2026-08-08T00:38:41.905661Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03596","last_updated":"2026-05-14T13:14:02Z","snapshot_observed_at":"2026-07-06T23:16:30.147006Z","submitted_at":"2026-05-05T10:17:06Z","title":"Workspace-Bench 1.0: Benchmarking AI Agents on Workspace Tasks with Large-Scale File Dependencies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03596","snapshot_observed_at":"2026-08-08T00:38:40.470942Z","title":"Workspace-bench 1.0: Benchmarking ai agents on workspace tasks with large-scale file dependencies, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.470942Z"},"links":{"cited_paper":"/paper/2605.03596","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:25e67e1799ca0c9c153c53bfcc81e08b6e83becf83fc8e928ae85165105de9c4","observation_id":"c1fc6ddc-1c45-450d-9aa5-19ec2e4f7f80","resolution":{"observed_at":"2026-08-08T00:38:40.470942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11868","last_updated":"2026-01-17T01:29:30Z","snapshot_observed_at":"2026-07-06T22:41:58.373427Z","submitted_at":"2026-01-17T01:29:30Z","title":"Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11868","snapshot_observed_at":"2026-08-08T00:38:40.592157Z","title":"Merrill et al","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.592157Z"},"links":{"cited_paper":"/paper/2601.11868","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:211d43e74dd2748f43e31772ed69c4bc6a49feb0f40141d189b2e0d545f43057","observation_id":"9901becd-2d3f-41ec-8637-a99890d60e5e","resolution":{"observed_at":"2026-08-08T00:38:40.592157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.669198Z","title":"Deepplanning: Benchmarking long-horizon agentic planning with verifiable constraints, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.669198Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:bab79d6813f50062efa4a769481f3b37c211436618a9a4680183ab1aad9f958d","observation_id":"f24011ba-da24-470b-8e67-90a258c4af05","resolution":{"observed_at":"2026-08-08T00:38:40.669198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.697620Z","title":"Trip-bench: A benchmark for long-horizon interactive agents in real-world scenarios, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.697620Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:71e701a227587003498d7e2bb9354e23d979bed0e7edace02057325f253c04f4","observation_id":"df25f9c8-ea83-4a70-90e9-78f5d73ccddc","resolution":{"observed_at":"2026-08-08T00:38:40.697620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.22388","last_updated":"2026-06-21T08:29:12Z","snapshot_observed_at":"2026-08-06T12:43:52.203315Z","submitted_at":"2026-06-21T08:29:12Z","title":"PlanBench-XL: Evaluating Long-Horizon Planning of LLM Tool-Use Agents in Large-Scale Tool Ecosystems","version":1},"cited_work":{"arxiv_id":"2606.22388","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.22388","snapshot_observed_at":"2026-08-08T00:38:41.542251Z","title":"PlanBench-XL: Evaluating Long-Horizon Planning of LLM Tool-Use Agents in Large-Scale Tool Ecosystems","venue":"cs.AI","work_id":"87c21b6b-61bd-4d19-8df9-088f9562ede8","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.700661Z"},"links":{"cited_paper":"/paper/2606.22388","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:bb3150583dd1f197c4ad190ea0f846a50040b3a3e9bcedbda82c2482eab0e9ac","observation_id":"47a96727-012b-4672-81f0-684fa8ca325a","resolution":{"observed_at":"2026-08-08T00:38:41.635861Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06008","last_updated":"2026-07-09T11:01:43Z","snapshot_observed_at":"2026-07-12T23:17:38.931960Z","submitted_at":"2026-07-07T08:50:09Z","title":"PolyWorkBench: Benchmarking Multilingual Long-Horizon LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.06008","snapshot_observed_at":"2026-08-08T00:38:40.704777Z","title":"Polyworkbench: Benchmarking multilingual long-horizon llm agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.704777Z"},"links":{"cited_paper":"/paper/2607.06008","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:c1417fa94a31a490440af195c7059b753e3d00549776610e99e66ae36c6b496e","observation_id":"0ad937e0-79f6-4eb7-8300-9d6e28168236","resolution":{"observed_at":"2026-08-08T00:38:40.704777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.707865Z","title":"Retailbench: Evaluating long-horizon autonomous decision- making and strategy stability of llm agents in realistic retail environments, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.707865Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:d1135f6bad5a60be16f1d792b8dd96233467841f0e35445909fbe29a7268750a","observation_id":"08dbc045-5f56-4fe4-b789-f952dc0ef365","resolution":{"observed_at":"2026-08-08T00:38:40.707865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.13357","last_updated":"2026-05-13T11:14:59Z","snapshot_observed_at":"2026-07-06T23:24:57.051440Z","submitted_at":"2026-05-13T11:14:59Z","title":"AI Harness Engineering: A Runtime Substrate for Foundation-Model Software Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.13357","snapshot_observed_at":"2026-08-08T00:38:40.711155Z","title":"Ai harness engineering: A runtime substrate for foundation-model software agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.711155Z"},"links":{"cited_paper":"/paper/2605.13357","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:a065bf1e1f0592ee771986716fe3b5e6f5b6280529c603347f77c6c5eeeec2fc","observation_id":"47343d4c-28c5-40e3-acf3-d780218c9821","resolution":{"observed_at":"2026-08-08T00:38:40.711155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.11224","last_updated":"2026-04-28T16:08:25Z","snapshot_observed_at":"2026-07-06T22:45:29.609382Z","submitted_at":"2026-02-11T13:31:18Z","title":"Agent-Diff: Benchmarking LLM Agents on Enterprise API Tasks via Code Execution with State-Diff-Based Evaluation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.11224","snapshot_observed_at":"2026-08-08T00:38:40.714960Z","title":"Pysklo, Artem Zhuravel, and Patrick D","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.714960Z"},"links":{"cited_paper":"/paper/2602.11224","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:8c9410732a9ddcdbcdff3f7c529161e9ab24e5ea9c0b0ca8150e4635bd083cb5","observation_id":"c0cf8fa8-f6e9-4792-b390-95e0772e0ed0","resolution":{"observed_at":"2026-08-08T00:38:40.714960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10601","last_updated":"2023-12-03T22:50:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T23:16:17Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10601","snapshot_observed_at":"2026-08-08T00:38:40.718865Z","title":"Griffiths, Yuan Cao, and Karthik Narasimhan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.718865Z"},"links":{"cited_paper":"/paper/2305.10601","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:0ed4458c6c9efc5156558be24f86c229848538013dc3973b58a690de4b984cfb","observation_id":"d6a105ae-591f-4c60-945c-7ad33238ce47","resolution":{"observed_at":"2026-08-08T00:38:40.718865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.722833Z","title":"Scaling long-horizon llm agent via context-folding, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.722833Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:5c6d4a0b18dbd6e54b641ce643b128670da8f19de1327b24750f53b7e39ee59b","observation_id":"5cb48ad3-3556-4615-b42d-d3559220687d","resolution":{"observed_at":"2026-08-08T00:38:40.722833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.727147Z","title":"Dynamiclongcontextreasoningovercompressed memory via end-to-end reinforcement learning, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.727147Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:b661fe5535b82e0ab306aed406f50f936b4c80ddf1b9361030735864313d6655","observation_id":"bd3c1f6c-4d0d-4175-ac9e-c532af2c40b0","resolution":{"observed_at":"2026-08-08T00:38:40.727147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.730159Z","title":"A-mem: Agentic memory for llm agents,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.730159Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:1fb8a649104148373f9a3e82dddffed43d053c4fb4dedbfb16052a12adec7a09","observation_id":"c89d41b4-58da-4db5-97fa-f9eb262147b0","resolution":{"observed_at":"2026-08-08T00:38:40.730159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.738178Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.738178Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:bda36460bd14c218676dcd4a0c1e83ad4ab6977aea5ed6f551548dad204786b6","observation_id":"db1b0779-bc4e-489f-b65a-be78e132329b","resolution":{"observed_at":"2026-08-08T00:38:40.738178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.12635","last_updated":"2026-05-07T13:18:53Z","snapshot_observed_at":"2026-08-06T02:47:17.802553Z","submitted_at":"2025-10-14T15:29:57Z","title":"Memory as Action: Autonomous Context Curation for Long-Horizon Agentic Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.12635","snapshot_observed_at":"2026-08-08T00:38:40.741477Z","title":"Memory as action: Autonomous context curation for long-horizon agentic tasks, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.741477Z"},"links":{"cited_paper":"/paper/2510.12635","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:e67491db1fd15f8ecdfbde13e8614a5dc1565df3cadfcd3418bdc995d1730f4e","observation_id":"5e3d4889-c979-4009-beec-b25eb7c71a62","resolution":{"observed_at":"2026-08-08T00:38:40.741477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.745249Z","title":"Context collapse in long-horizon agents: Benchmarking hierarchical memory against rag and summarization","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.745249Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:e2bd2094bfa54a0340c6c998a5337affa30ff60b3f18eb04520bdc0656cf8c8f","observation_id":"ef6ecf67-9e13-43a0-8123-48e7ec1d674b","resolution":{"observed_at":"2026-08-08T00:38:40.745249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.748731Z","title":"Infiagent: An infinite-horizon framework for general-purpose autonomous agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.748731Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:264bf652c0d62213206a32efa21b629d7c402833bde32227477b530c543280a5","observation_id":"6da74ca4-9f3a-4be0-afc6-0177fe3afadf","resolution":{"observed_at":"2026-08-08T00:38:40.748731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11978","last_updated":"2026-04-13T19:11:42Z","snapshot_observed_at":"2026-08-02T21:24:34.902135Z","submitted_at":"2026-04-13T19:11:42Z","title":"The Long-Horizon Task Mirage? Diagnosing Where and Why Agentic Systems Break","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11978","snapshot_observed_at":"2026-08-08T00:38:40.752080Z","title":"The long-horizon task mirage? diagnosing where and why agentic systems break, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.752080Z"},"links":{"cited_paper":"/paper/2604.11978","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:174e9d7281567d53981efb03245a9925baccab03ab8ca029e934e572af5972f8","observation_id":"a17159c5-4f31-4c8a-a0a3-7781af5cb799","resolution":{"observed_at":"2026-08-08T00:38:40.752080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.755570Z","title":"Agentlab: Benchmarking llm agents against long-horizon attacks, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.755570Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:a121ff4b6fce4a62d244f2ffa8f0a235b1df9a3d4b5a1a4cf9a481d5202c4268","observation_id":"aacf0d7f-8610-4d6a-aa59-8e74e3747ef4","resolution":{"observed_at":"2026-08-08T00:38:40.755570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.00933","last_updated":"2026-05-19T23:26:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-31T23:19:39Z","title":"MCP-Atlas: A Large-Scale Benchmark for Tool-Use Competency with Real MCP Servers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.00933","snapshot_observed_at":"2026-08-08T00:38:40.759145Z","title":"Mcp-atlas: A large-scale benchmark for tool-use competency with real mcp servers, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.759145Z"},"links":{"cited_paper":"/paper/2602.00933","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:bfb7761b786e6932265f19d780ec2fdc53766e3abc82fc3d0516ad7f623a88b9","observation_id":"10687782-3d25-408d-b62f-cff958cddc20","resolution":{"observed_at":"2026-08-08T00:38:40.759145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.763793Z","title":"Deepseek-v4: Towards highly efficient million-token context intelligence, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.763793Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:ca739ebfee2b1806655358f55c87536d459870351bcb9f2fcf39839b071a35e9","observation_id":"52a31bb2-1512-40b2-bea9-ebf41f2f21d1","resolution":{"observed_at":"2026-08-08T00:38:40.763793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-08T00:38:40.767183Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.767183Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:3dbcc603827009f7eb3ef8e007dc7c589161a49028572bc9c19b6f962f4d0899","observation_id":"1fbee9de-cea8-4740-9111-7e09ecb3135d","resolution":{"observed_at":"2026-08-08T00:38:40.767183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-08T00:38:40.782453Z","title":"name\": \"search","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.782453Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:9ab38ee68a71b297ec886ce2f2b1e8c6563e9ee90734df4ec848ec0cc7915644","observation_id":"310dea28-b87d-4994-b95e-8ae03a7fa0f3","resolution":{"observed_at":"2026-08-08T00:38:40.782453Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.851366Z","title":"If the task can be completed in one step, output 1 subtask","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.851366Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:fe75377b21c4501cd56db1278a12d38f693e5dcf18c4936151ca2ff9e4dab2f7","observation_id":"e6fc1301-ad31-4cb9-b757-64395354fb34","resolution":{"observed_at":"2026-08-08T00:38:40.851366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.928825Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.928825Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:5c268584c49fa008a6636f0d074ad265b9cc76f3c8b3be096f37f2af29236a3f","observation_id":"6e9cfcfc-f7d5-4ec6-b543-6eaf8a40296a","resolution":{"observed_at":"2026-08-08T00:38:40.928825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:40.992393Z","title":"subtasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.992393Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:501d50204ed8c387e9a99e7752cfa411bcdceda2b7c8051e9c258ad78f2c34e1","observation_id":"281175f3-e06d-4790-975a-512a729dc441","resolution":{"observed_at":"2026-08-08T00:38:40.992393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.523757Z","title":null,"venue":null,"work_id":"c5aaacc3-7985-4078-b2de-989d2ad943fd","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.995934Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:0e54fadd202f4b481810d1df7ff1c63f0161109cfb2cbcb1f465cbfe398f9293","observation_id":"059ff350-e17a-483f-b527-49561e055522","resolution":{"observed_at":"2026-08-08T00:38:44.526473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.401053Z","title":null,"venue":null,"work_id":"98dce1d7-3206-4f2d-b3af-4f6fe5e91b89","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.000052Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:833150225403ab4cd6182b8408f1908bdabbecde04d0c0836d5a74a68e852c91","observation_id":"51764e41-2616-4617-a3db-8f38403728ef","resolution":{"observed_at":"2026-08-08T00:38:44.516914Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.203556Z","title":null,"venue":null,"work_id":"c0b457fc-5732-4bb3-9ccb-976a386df052","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.004395Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:7a03292397601f42cd278e78a2f61b20ad22b2c6094939d770929924665a3f64","observation_id":"3b3e0d80-42ec-4576-9b59-d57e5b5b01bb","resolution":{"observed_at":"2026-08-08T00:38:44.298154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.164375Z","title":null,"venue":null,"work_id":"44cb9482-4701-45d6-ae1c-660c1fb7d54d","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.007928Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:34c2a81c476486277ca9e7cbb4025a3566b913ea5705fa262fd4e93ce61d241f","observation_id":"83cc229e-32bf-4b5d-b9ed-76fdafc9dc57","resolution":{"observed_at":"2026-08-08T00:38:44.167351Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.154070Z","title":null,"venue":null,"work_id":"34adb79a-d10e-4117-82df-ca60bbcddeca","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.010610Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:e939c182c8c5840b59fccb5faad9face2e8cbdf4a86000498691e3ff0050087b","observation_id":"b0b40ca6-51d6-449d-b64c-685fb90e87d9","resolution":{"observed_at":"2026-08-08T00:38:44.157646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.143983Z","title":null,"venue":null,"work_id":"f4bcd9ad-e1ae-428c-8dd1-ecba339f838d","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.014754Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:fb6f0270ac313dd81db9128ec2c7e5e61736487ca472d15459f5fa5974df7677","observation_id":"e13a73bf-961f-4ead-a9b4-a05578089dc5","resolution":{"observed_at":"2026-08-08T00:38:44.147112Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.134077Z","title":null,"venue":null,"work_id":"cd7a72b7-89a2-4c0c-a508-9fd91634c256","year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.018197Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:cfacc0a0df5b6e72ac7d08511128653b76e1f285fea5a86b7cc6d3de885ae7fd","observation_id":"218a2744-5a95-460a-8cbf-fefeb43e1492","resolution":{"observed_at":"2026-08-08T00:38:44.137661Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:38:44.123261Z","title":"completed","venue":null,"work_id":"553a4668-3770-4a2e-8fde-fbf5b4637855","year":2026},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:41.021030Z"},"links":{"citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:fabd745b50dffa8020a04510ea50784776ea218909de0446c06ff5c5ae4b9008","observation_id":"5b084cb2-12b0-4522-8213-cc8de69e7d78","resolution":{"observed_at":"2026-08-08T00:38:44.127434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T04:13:14.044604Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-08T00:38:40.343961Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.343961Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:3f5dbef8925d9a00d772ae4d7ef5a2b63fef7b2cf4f07563d0eb08ad98d6e399","observation_id":"91d19464-b7d6-4f6b-af82-eb04fb1b96d8","resolution":{"observed_at":"2026-08-08T00:38:40.343961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12110","last_updated":"2025-10-08T01:46:37Z","snapshot_observed_at":"2026-08-03T02:27:06.991396Z","submitted_at":"2025-02-17T18:36:14Z","title":"A-MEM: Agentic Memory for LLM Agents","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12110","snapshot_observed_at":"2026-08-08T00:38:40.733515Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:40.733515Z"},"links":{"cited_paper":"/paper/2502.12110","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:cab5cab85b9372a1090185327bca6d2c6716114a7b63515404252eb1a82bc027","observation_id":"94202e51-c293-48ff-a251-74c4118bea79","resolution":{"observed_at":"2026-08-08T00:38:40.733515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.09822","last_updated":"2026-01-19T19:10:53Z","snapshot_observed_at":"2026-08-07T09:19:36.604857Z","submitted_at":"2026-01-14T19:28:30Z","title":"LLM-Based Agentic Systems for Software Engineering: Challenges and Opportunities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.09822","snapshot_observed_at":"2026-08-08T00:38:39.545367Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-08T00:38:39.545367Z"},"links":{"cited_paper":"/paper/2601.09822","citing_paper":"/paper/2608.05013"},"observation_digest":"sha256:e584be9d987a9c38696f0ff22818865579d90e21868708b73ef8c67b062c10d2","observation_id":"1cd68544-b06e-4784-8e3e-bd694f19e3cd","resolution":{"observed_at":"2026-08-08T00:38:39.545367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05013","last_updated":"2026-08-04T17:55:41Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T08:14:05.983719Z","submitted_at":"2026-08-04T17:55:41Z","title":"OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents"},"reference_resolution":{"displayed":95,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":85,"verified_exact":8,"verified_fuzzy":1},"total_outbound_references":95},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 95 of 95 outbound references and 0 inbound Pith citation observations for arXiv:2608.05013."}