{"as_of":"2026-08-09T09:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6cf35c48609d3338c210822c895ca58448427a9ac8a99200e624a80812358398","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T12:35:01.615574Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05466/citation-record","integrity":"/paper/2608.05466/integrity","json":"/paper/2608.05466/citation-record.json","paper":"/paper/2608.05466"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-08T12:35:01.302551Z","title":"Self-play fine-tuning converts weak language models to strong language models.arXiv preprint arXiv:2401.01335, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.302551Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:d0bb9b6f7d61798a169f7c40710c181a82f192e98addcd27b859328908e95eb0","observation_id":"4751f222-a25a-4775-b46b-4ee03e3588fc","resolution":{"observed_at":"2026-08-08T12:35:01.302551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.472786Z","title":"From language to action: a review of large language models as autonomous agents and tool users.Artificial Intelligence Review, 59(2):71, 2026","venue":null,"work_id":"3451f309-8f90-46d1-8c47-e554e92da64c","year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.308995Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:1d742d28647430b99f6e89108cda86d39c08e6e64836273b9b24e8bf48adb715","observation_id":"a15515dc-8c1d-4801-8211-13d99d0058d8","resolution":{"observed_at":"2026-08-08T12:35:03.477520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.22535","last_updated":"2026-05-21T14:24:43Z","snapshot_observed_at":"2026-08-01T23:33:43.370851Z","submitted_at":"2026-05-21T14:24:43Z","title":"TerminalWorld: Benchmarking Agents on Real-World Terminal Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.22535","snapshot_observed_at":"2026-08-08T12:35:01.313844Z","title":"Barr, Mark Harman, Federica Sarro, and He Ye","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.313844Z"},"links":{"cited_paper":"/paper/2605.22535","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:a6ba7458311e34be8f070f10d8fef7284ebbbf35d1ce5ca5e85d947ba7800449","observation_id":"1f10b2bb-9552-4332-8ac2-e153443340b3","resolution":{"observed_at":"2026-08-08T12:35:01.313844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.319160Z","title":"Deepseek-v4: Towards highly efficient million-token context intelligence, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.319160Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:e6e346bbf4a21860a9396a9b72e0a5866d231499dd9dd7c2cf215d51fe248c7b","observation_id":"69728056-387a-4e4b-ac2a-689ae3c85b8b","resolution":{"observed_at":"2026-08-08T12:35:01.319160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07682","last_updated":"2026-06-05T00:39:44Z","snapshot_observed_at":"2026-07-06T23:47:19.773490Z","submitted_at":"2026-06-05T00:39:44Z","title":"SWE-Marathon: Can Agents Autonomously Complete Ultra-Long-Horizon Software Work?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07682","snapshot_observed_at":"2026-08-08T12:35:01.324108Z","title":"SWE-Marathon: Can Agents Autonomously Complete Ultra-Long-Horizon Software Work?https://arxiv.org/abs/2606.07682,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.324108Z"},"links":{"cited_paper":"/paper/2606.07682","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:80d9f0c7f7a0316c4e5df4ab32520c37a8d74834df653d20248619cf9fc4e5f7","observation_id":"329d895a-373f-43b2-bc37-e951ac911eee","resolution":{"observed_at":"2026-08-08T12:35:01.324108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.444050Z","title":"A survey on the optimization of large language model-based agents.ACM Computing Surveys, 58(9):1–37, 2026","venue":null,"work_id":"4ac38062-affd-4d82-8c1c-678aa24fb7a1","year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.334134Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:62fdbdd22da8c607c59c56bad37725747f72009f6893c291256a753105120b5b","observation_id":"cca10a6e-b833-4eab-afb1-e89759fd8640","resolution":{"observed_at":"2026-08-08T12:35:03.448752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.338853Z","title":"Webevolver: Enhancing web agent self-improvement with coevolving world model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.338853Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:e54594961cca528879349d89d3fc0656e650276634109e01c83061860af705c3","observation_id":"884f2c83-9d4e-42a0-88c4-4096f87d5cca","resolution":{"observed_at":"2026-08-08T12:35:01.338853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.419471Z","title":"Self-Verification Provably Prevents Model Collapse in Recursive Synthetic Training","venue":null,"work_id":"ed15119b-7720-4c7d-82a0-3e0e954493d3","year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.344029Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:5e27ce5037c5cecbd472b2b3c0a897ce1be3224e5393849d6a8b27b1a111742d","observation_id":"f9a59c73-280f-4920-b034-b8f13c837c20","resolution":{"observed_at":"2026-08-08T12:35:03.424792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.348930Z","title":"Goodman, and Dimitris Papailiopoulos","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.348930Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:595a2ebbe54405ae8b7e0d5042bf4796d923020efecde918310aa783f0049322","observation_id":"d14b23df-9113-4bde-b778-ec6e21c9a1a5","resolution":{"observed_at":"2026-08-08T12:35:01.348930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.353745Z","title":"Fung, Kun Wang, Linfeng Zhang, and Jing Shao","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.353745Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:b26ba00188a9000d36bfef773912ee3cb4aaef986e1aa063598205d21b5f9a2f","observation_id":"1955cd5c-6f20-423d-b1c3-8a0ef0f599f9","resolution":{"observed_at":"2026-08-08T12:35:01.353745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.358317Z","title":"Harbor: A framework for evaluating and optimizing agents and models in container environments, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.358317Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:5c21f1965e38d15351eec46ce05a1558760b78117655d56014828f6b619ce823","observation_id":"8d8e5b0c-886c-478a-893e-65510f9a7e02","resolution":{"observed_at":"2026-08-08T12:35:01.358317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.363192Z","title":"Visplay: Self-evolving vision- language models from images.arXiv preprint arXiv:2511.15661, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.363192Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:7aee000f19d20a400a86231be1eef79ccce2fcf0dde167749e37df24230e9b42","observation_id":"9db325c0-eb7f-493b-9c51-cc4702847e13","resolution":{"observed_at":"2026-08-08T12:35:01.363192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06457","last_updated":"2024-08-14T02:41:48Z","snapshot_observed_at":"2026-07-06T17:28:02.037844Z","submitted_at":"2024-02-09T15:02:56Z","title":"V-STaR: Training Verifiers for Self-Taught Reasoners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06457","snapshot_observed_at":"2026-08-08T12:35:01.368031Z","title":"V-star: Training verifiers for self-taught reasoners.arXiv preprint arXiv:2402.06457, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.368031Z"},"links":{"cited_paper":"/paper/2402.06457","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:cc501d157bb8522fbcfacb4137ac1c2a41f2909d78898f72fafd25bb19929ded","observation_id":"4aec1f12-e28b-4ee8-bbee-b2ee62967581","resolution":{"observed_at":"2026-08-08T12:35:01.368031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.22883","last_updated":"2026-06-22T05:50:23Z","snapshot_observed_at":"2026-08-07T14:57:03.822714Z","submitted_at":"2026-06-22T05:50:23Z","title":"CLI-Universe: Towards Verifiable Task Synthesis Engine for Terminal Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.22883","snapshot_observed_at":"2026-08-08T12:35:01.373257Z","title":"Cli-universe: Towards verifiable task synthesis engine for terminal agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.373257Z"},"links":{"cited_paper":"/paper/2606.22883","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:2ea971a4ce7cebfe87dd911d0a21bd01c9351a6c358915923b3db87a9a21cf01","observation_id":"f74f5342-4b66-46b2-b99f-d67ac79e12a3","resolution":{"observed_at":"2026-08-08T12:35:01.373257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05004","last_updated":"2026-02-13T18:53:32Z","snapshot_observed_at":"2026-07-06T22:09:08.864232Z","submitted_at":"2025-08-07T03:38:16Z","title":"R-Zero: Self-Evolving Reasoning LLM from Zero Data","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.05004","snapshot_observed_at":"2026-08-08T12:35:01.378303Z","title":"R-zero: Self-evolving reasoning llm from zero data, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.378303Z"},"links":{"cited_paper":"/paper/2508.05004","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:039f8f5f0db7356ed3181bcc790da0efb52e455e03944ec59157b98e80f606d2","observation_id":"af4ea242-212d-44d3-9029-a59d4d8b53e5","resolution":{"observed_at":"2026-08-08T12:35:01.378303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.23321","last_updated":"2026-06-22T13:32:52Z","snapshot_observed_at":"2026-07-06T23:58:07.236199Z","submitted_at":"2026-06-22T13:32:52Z","title":"Tmax: A simple recipe for terminal agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.23321","snapshot_observed_at":"2026-08-08T12:35:01.383123Z","title":"Tmax: A simple recipe for terminal agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.383123Z"},"links":{"cited_paper":"/paper/2606.23321","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:104dbc4da866eb17408bd7ea34a45719900e736b196a2a6bda9dc0a26796ad71","observation_id":"aa3a79ee-4f6f-4370-a4d9-5e8d187c5a6b","resolution":{"observed_at":"2026-08-08T12:35:01.383123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.404295Z","title":"Swe-bench: Can language models resolve real-world github issues? In B","venue":null,"work_id":"7099f216-d969-4530-8436-d07a9693417a","year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.388157Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:4caea3edeb90f4db5768ced0653ea0f1a1b9d17b462f1a2e04ad290e70d691ae","observation_id":"23b7dc0e-0a83-43ea-bd7f-8a97e0d40442","resolution":{"observed_at":"2026-08-08T12:35:03.409195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14499","last_updated":"2026-07-10T21:48:09Z","snapshot_observed_at":"2026-08-07T16:54:09.525403Z","submitted_at":"2025-03-18T17:59:31Z","title":"Measuring AI Ability to Complete Long Software Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14499","snapshot_observed_at":"2026-08-08T12:35:01.393285Z","title":"Ziegler, Elizabeth Barnes, and Lawrence Chan","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.393285Z"},"links":{"cited_paper":"/paper/2503.14499","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:a6e830c95e1cc3e8face78590c594f50ea2fd5845ff3a056d466621815391ce4","observation_id":"fdbb748b-6bad-4e35-833c-65bb425646de","resolution":{"observed_at":"2026-08-08T12:35:01.393285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19652","last_updated":"2026-04-27T16:28:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-27T08:01:03Z","title":"Self-Rewarding Vision-Language Model via Reasoning Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19652","snapshot_observed_at":"2026-08-08T12:35:01.398285Z","title":"Self-rewarding vision-language model via reasoning decomposition.arXiv preprint arXiv:2508.19652, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.398285Z"},"links":{"cited_paper":"/paper/2508.19652","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:8915fecf1d0f86624f8e953a67a3f784411c533d2123c78e1a1d7131ccfb749e","observation_id":"070ea0a5-1f76-4730-a143-e1040b2e3955","resolution":{"observed_at":"2026-08-08T12:35:01.398285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.403381Z","title":"Mm-zero: Self-evolving multi-model vision language models from zero data","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.403381Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:e0578fd3b347e42288d206b642ecb074eb2ffa2662bc33e6c001ba0fdd7d1dab","observation_id":"b1a70485-2250-434e-9bf7-99f0fa4a63ad","resolution":{"observed_at":"2026-08-08T12:35:01.403381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.08964","last_updated":"2026-07-13T06:00:47Z","snapshot_observed_at":"2026-08-07T13:50:01.305675Z","submitted_at":"2026-07-09T21:56:37Z","title":"Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks with Dense Reward-Based Grading","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.08964","snapshot_observed_at":"2026-08-08T12:35:01.407591Z","title":"Long-horizon-terminal-bench: Testing the limits of agents on long-horizon terminal tasks with dense reward-based grading, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.407591Z"},"links":{"cited_paper":"/paper/2607.08964","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:ef517a998ab9278b40437e154af7f40d66eca244db2ef617855421746b2406ec","observation_id":"f1b89008-24a9-40b4-bcdf-70106faf04c8","resolution":{"observed_at":"2026-08-08T12:35:01.407591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.389194Z","title":"Agentbench: Evaluating llms as agents,","venue":null,"work_id":"ae97ac29-08fb-4947-a7da-82b44630c892","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.412016Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:7483a753aff18eb97194e087bf2e7fca328901eadd324f8f1cc22d24fb6b93d0","observation_id":"93372bca-a708-461a-baa1-fee350f67689","resolution":{"observed_at":"2026-08-08T12:35:03.394024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11868","last_updated":"2026-01-17T01:29:30Z","snapshot_observed_at":"2026-07-06T22:41:58.373427Z","submitted_at":"2026-01-17T01:29:30Z","title":"Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11868","snapshot_observed_at":"2026-08-08T12:35:01.420886Z","title":"Merrill, Alexander G","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.420886Z"},"links":{"cited_paper":"/paper/2601.11868","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:7a379af480cea7b16ef77342ebf960ce16f2320c9e8e8a8c79207e2a0ffc8f04","observation_id":"e3dca9b8-f0a3-480e-b867-c2049c20edd0","resolution":{"observed_at":"2026-08-08T12:35:01.420886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12983","last_updated":"2023-11-21T20:34:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-21T20:34:47Z","title":"GAIA: a benchmark for General AI Assistants","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12983","snapshot_observed_at":"2026-08-08T12:35:01.425569Z","title":"Gaia: a benchmark for general ai assistants, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.425569Z"},"links":{"cited_paper":"/paper/2311.12983","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:730dfa77e7df46872a2f76023dc8340c9ed33fd5d3e589fff9994f88009d7fd8","observation_id":"3a062bd9-f771-4714-abd8-d610024726b7","resolution":{"observed_at":"2026-08-08T12:35:01.425569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21139","last_updated":"2025-06-06T07:53:20Z","snapshot_observed_at":"2026-07-06T20:14:49.976782Z","submitted_at":"2024-12-30T18:15:39Z","title":"Training Software Engineering Agents and Verifiers with SWE-Gym","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21139","snapshot_observed_at":"2026-08-08T12:35:01.430355Z","title":"Training software engineering agents and verifiers with swe-gym, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.430355Z"},"links":{"cited_paper":"/paper/2412.21139","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:82436baeaf9475c42b37a439a15432f646a0dcaabdcc97f131bb3d265383d50f","observation_id":"81f022bb-9ae9-45ea-860f-4044c6fe7478","resolution":{"observed_at":"2026-08-08T12:35:01.430355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29559","last_updated":"2026-05-28T08:11:57Z","snapshot_observed_at":"2026-08-06T04:57:04.668756Z","submitted_at":"2026-05-28T08:11:57Z","title":"LiteCoder-Terminal: Scaling Long-Horizon Terminal Environments for Learning Language Agents","version":1},"cited_work":{"arxiv_id":"2605.29559","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.29559","snapshot_observed_at":"2026-08-08T12:35:02.589780Z","title":"LiteCoder-Terminal: Scaling Long-Horizon Terminal Environments for Learning Language Agents","venue":"cs.CL","work_id":"8e7b172f-de6a-45e4-b1ab-9d6bd716f101","year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.435238Z"},"links":{"cited_paper":"/paper/2605.29559","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:e80fcec4995ca490688ff0d494dfdbe2055e340733fc183c0b3f632c112e1eb8","observation_id":"9bcd7778-c3ac-4d83-8b5f-e5b63395d5ea","resolution":{"observed_at":"2026-08-08T12:35:02.595199Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.440348Z","title":"On data engineering for scaling llm terminal capabilities, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.440348Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:05a02d4b106f00a273b27d49696707597c658d6238bc4625826dee10e9ae241b","observation_id":"26531a17-9801-4f31-95a4-df28cdd8236a","resolution":{"observed_at":"2026-08-08T12:35:01.440348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04109","last_updated":"2025-07-06T18:16:47Z","snapshot_observed_at":"2026-07-06T19:46:15.364468Z","submitted_at":"2024-11-06T18:36:22Z","title":"Self-Consistency Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04109","snapshot_observed_at":"2026-08-08T12:35:01.444948Z","title":"Self-consistency preference optimization.arXiv preprint arXiv:2411.04109, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.444948Z"},"links":{"cited_paper":"/paper/2411.04109","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:50f13ecb8900fba8ea80668fb643ad00b4864133d5c161d78dd11303dfb11287","observation_id":"818058ae-800e-4e9e-b1d8-8a1fc22eb194","resolution":{"observed_at":"2026-08-08T12:35:01.444948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.24855","last_updated":"2026-06-23T17:34:29Z","snapshot_observed_at":"2026-07-06T23:59:23.407216Z","submitted_at":"2026-06-23T17:34:29Z","title":"OpenThoughts-Agent: Data Recipes for Agentic Models","version":1},"cited_work":{"arxiv_id":"2606.24855","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.24855","snapshot_observed_at":"2026-08-08T12:35:02.464497Z","title":"OpenThoughts-Agent: Data Recipes for Agentic Models","venue":"cs.AI","work_id":"375e7474-9020-4cb2-a42a-f0898f4231a8","year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.449971Z"},"links":{"cited_paper":"/paper/2606.24855","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:4aa5525d7417f6945030c948bc684be13b12200f41a4882d235b57943b3b9b66","observation_id":"f7e921a1-b99a-40a7-9c36-ba29a007f1c0","resolution":{"observed_at":"2026-08-08T12:35:02.471780Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.10891","last_updated":"2026-07-12T19:40:27Z","snapshot_observed_at":"2026-08-02T15:45:32.411241Z","submitted_at":"2026-07-12T19:40:27Z","title":"SETA: Scaling Environments for Terminal Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.10891","snapshot_observed_at":"2026-08-08T12:35:01.454584Z","title":"Seta: Scaling environments for terminal agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.454584Z"},"links":{"cited_paper":"/paper/2607.10891","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:5874832f1e9eb6fe93a0ce8cca438096d1c03506154073f7f46f2139d3ec79a5","observation_id":"7b06f98d-147b-4eea-9a8e-a5f2c6131680","resolution":{"observed_at":"2026-08-08T12:35:01.454584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06585","last_updated":"2024-04-18T03:12:09Z","snapshot_observed_at":"2026-08-08T12:03:18.710098Z","submitted_at":"2023-12-11T18:17:43Z","title":"Beyond Human Data: Scaling Self-Training for Problem-Solving with Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06585","snapshot_observed_at":"2026-08-08T12:35:01.459919Z","title":"Co-Reyes, Rishabh Agarwal, Ankesh Anand, Piyush Patil, Xavier Garcia, Peter J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.459919Z"},"links":{"cited_paper":"/paper/2312.06585","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:29f25b426ebd04a138f26ea68f553092348611b7c52f61620c4e5ec3ec06f9d1","observation_id":"c2689870-d8ac-4522-a585-d2f1e16e5a9b","resolution":{"observed_at":"2026-08-08T12:35:01.459919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.05808","last_updated":"2026-04-17T17:24:06Z","snapshot_observed_at":"2026-08-02T19:53:18.484273Z","submitted_at":"2026-01-09T14:32:06Z","title":"EnvScaler: Scaling Tool-Interactive Environments for LLM Agent via Programmatic Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.05808","snapshot_observed_at":"2026-08-08T12:35:01.465550Z","title":"Envscaler: Scaling tool-interactive environments for llm agent via programmatic synthesis.arXiv preprint arXiv:2601.05808, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.465550Z"},"links":{"cited_paper":"/paper/2601.05808","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:3b5d009c2892a8735830fde5d36349768a918a9c799ee90a2d476738cc6651ff","observation_id":"dd7ade03-c98e-42fe-b544-e3b639fd4214","resolution":{"observed_at":"2026-08-08T12:35:01.465550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.471490Z","title":"Scaleenv: Scaling environment synthesis from scratch for generalist interactive tool-use agent training, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.471490Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:1cebbb013b52d56ee7aa03ef268a161a82f453031c0a20c690bae3e734ffbff5","observation_id":"391e5d70-936a-475f-8192-a738308d438b","resolution":{"observed_at":"2026-08-08T12:35:01.471490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.475984Z","title":"Apex-agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.475984Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:a1eb871eff5f014900249b30966b9a7dcf085bb0d19a97a8cf23d9ad27d3c1b5","observation_id":"f75fe1db-c6c7-42d2-b504-d3ab03f32073","resolution":{"observed_at":"2026-08-08T12:35:01.475984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.481690Z","title":"Swe-bench++: A framework for the scalable generation of software engineering benchmarks from open-source repositories, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.481690Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:9574618c06ed7c29bfe502ca2c73b9e6d08292e15133b1651cf78d8445db3686","observation_id":"59ac1581-8dd3-4cbe-bbdb-b6f08ad8e71c","resolution":{"observed_at":"2026-08-08T12:35:01.481690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16741","last_updated":"2025-04-18T18:14:31Z","snapshot_observed_at":"2026-08-02T14:58:44.167588Z","submitted_at":"2024-07-23T17:50:43Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16741","snapshot_observed_at":"2026-08-08T12:35:01.486636Z","title":"Xu, Xiangru Tang, Mingchen Zhuge, Jiayi Pan, Yueqi Song, Bowen Li, Jaskirat Singh, Hoang H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.486636Z"},"links":{"cited_paper":"/paper/2407.16741","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:4b49bef31936a916ae7560916dc1fbf4963a7b2b1a3b8fbe893a8bb9967bb457","observation_id":"b73eb0ae-1e24-46a0-acdd-9a924a810255","resolution":{"observed_at":"2026-08-08T12:35:01.486636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.491438Z","title":"Llms as scalable, general-purpose simulators for evolving digital agent training,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.491438Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:874e01fb625343697df42c5e5ddfe9b5074abe4edf3a57051ce27b6cf6e6287f","observation_id":"e3d7f8c9-ef03-4028-bcd5-ea8e4b3244fb","resolution":{"observed_at":"2026-08-08T12:35:01.491438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.01286","last_updated":"2026-05-31T15:12:16Z","snapshot_observed_at":"2026-08-03T00:41:34.020605Z","submitted_at":"2026-05-31T15:12:16Z","title":"BenchEvolver: Frontier Task Synthesis via Solution-Centric Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.01286","snapshot_observed_at":"2026-08-08T12:35:01.501875Z","title":"Li, Wenjie Ma, Li Cao, Ziheng Zhou, Mert Cemri, Shu Liu, Yuran Xiu, Chenxiao Yan, Haikun Zhao, Bin Yu, Ion Stoica, and Dawn Song","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.501875Z"},"links":{"cited_paper":"/paper/2606.01286","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:efd74d1666418a7ac3c3a4815880b67207a718d55102c2d330fe77722247b02a","observation_id":"762ab5bd-7461-4c05-bec4-bd2578a0d662","resolution":{"observed_at":"2026-08-08T12:35:01.501875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.506696Z","title":"Autowebworld: Synthesizing infinite verifiable web environments via finite state machines, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.506696Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:46f793e4e19c05879d3f1e838db21d1e5dd96a11b6f046417dc91c27a921f505","observation_id":"6e201482-5bee-4e4a-9bb7-a9d12a250cc1","resolution":{"observed_at":"2026-08-08T12:35:01.506696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.496200Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.496200Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:76670261cd4484afc2cce1d6dd50bca1cdf333bb2e43bebb90f2ab969fda2564","observation_id":"f0ec4313-9275-4087-a681-702e7034aa58","resolution":{"observed_at":"2026-08-08T12:35:01.496200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-09T01:39:11.956106Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07972","snapshot_observed_at":"2026-08-08T12:35:01.516490Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer environments, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.516490Z"},"links":{"cited_paper":"/paper/2404.07972","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:f87f6f95ff08d9df4bb840d29acfc82965b919a9424bbd57b8fe4c8bf6be159a","observation_id":"abd49d4b-6f43-44d2-8f0d-ffa3be579ecc","resolution":{"observed_at":"2026-08-08T12:35:01.516490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.364612Z","title":"Wizardlm: Empowering large pre-trained language models to follow complex instructions","venue":null,"work_id":"721ac073-ea07-4fe1-8871-f1707e8c5ea8","year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.521513Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:4ab4e805a9e0890cb3eaf5970e1b39a11b2e8556a19fadf6191561d706817068","observation_id":"38d9527c-56c1-4ec5-8657-19b07ab3dfeb","resolution":{"observed_at":"2026-08-08T12:35:03.369349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.511524Z","title":"Agent0: Unleashing self-evolving agents from zero data via tool-integrated reasoning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.511524Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:86ca1948a8dc5ecc065de643488c75c2da9922bd3c6a7d0bd1083ba3698a21a3","observation_id":"729330c6-6025-42dc-83e1-522d60a49f1b","resolution":{"observed_at":"2026-08-08T12:35:01.511524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-07T08:02:34.857823Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-08T12:35:01.531330Z","title":"Self-rewarding language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.531330Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:1a2b8c85a6e9637c8083f44b0917b9fde5bc341fc8ca21d18a8e247bff203b0a","observation_id":"9109421e-0c42-406c-98eb-dd6d0bba6352","resolution":{"observed_at":"2026-08-08T12:35:01.531330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02605","last_updated":"2025-04-03T14:06:17Z","snapshot_observed_at":"2026-07-30T07:56:48.878578Z","submitted_at":"2025-04-03T14:06:17Z","title":"Multi-SWE-bench: A Multilingual Benchmark for Issue Resolving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02605","snapshot_observed_at":"2026-08-08T12:35:01.535689Z","title":"Multi-swe-bench: A multilingual benchmark for issue resolving, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.535689Z"},"links":{"cited_paper":"/paper/2504.02605","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:729804ebbb204fdfbad95c0c486f0b32147a379adeef418c10eeef08051a2175","observation_id":"cc1409e5-004c-4d77-988e-33d9195d8939","resolution":{"observed_at":"2026-08-08T12:35:01.535689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-08-08T12:35:01.526085Z","title":"Jimenez, Alexander Wettig, Kilian Lieret, Shunyu Yao, Karthik Narasimhan, and Ofir Press","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.526085Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:b9f720118f84ca9a336bbb103ed2c70bf27d6dc424380d74a9796350c21f1bb7","observation_id":"4aaa81d3-0dd6-42cd-820f-18f95f0264c9","resolution":{"observed_at":"2026-08-08T12:35:01.526085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.07317","last_updated":"2026-06-06T19:45:56Z","snapshot_observed_at":"2026-08-03T23:08:02.092548Z","submitted_at":"2025-11-10T17:18:35Z","title":"RLVE: Scaling Up Reinforcement Learning for Language Models with Adaptive Verifiable Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.07317","snapshot_observed_at":"2026-08-08T12:35:01.545456Z","title":"Rlve: Scaling up reinforcement learning for language models with adaptive verifiable environments, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.545456Z"},"links":{"cited_paper":"/paper/2511.07317","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:a8748f06dbed123eddecb89e724544d1da0722d01ec9c9ef332053a91798f5f0","observation_id":"086199cf-c30f-4789-adfc-39e11916fa3d","resolution":{"observed_at":"2026-08-08T12:35:01.545456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.04126","last_updated":"2026-06-30T13:54:32Z","snapshot_observed_at":"2026-08-03T12:10:23.636506Z","submitted_at":"2026-01-07T17:40:08Z","title":"InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.04126","snapshot_observed_at":"2026-08-08T12:35:01.549784Z","title":"Infiniteweb: Scalable web environment synthesis for gui agent training, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.549784Z"},"links":{"cited_paper":"/paper/2601.04126","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:b7d5447116fa429fc72c719d35504f735ca48c473d105aaf159a32810ee4b6eb","observation_id":"fa4a0800-592c-458a-bb7d-a8380d0c1fbd","resolution":{"observed_at":"2026-08-08T12:35:01.549784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.540492Z","title":"Star: Bootstrapping reasoning with reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.540492Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:1ce354bb7486d234bb93a34fc92c730900594cc55acc920bd4c03eb2d3affff2","observation_id":"b1944726-6aad-4fc8-b534-cb506d1cd2e2","resolution":{"observed_at":"2026-08-08T12:35:01.540492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-08T12:35:01.558740Z","title":"Xu, Hao Zhu, Xuhui Zhou, Robert Lo, Abishek Sridhar, Xianyi Cheng, Tianyue Ou, Yonatan Bisk, Daniel Fried, Uri Alon, and Graham Neubig","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.558740Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:9cafba9e228aaeb7ce42bc6fa1977946b3f4aa049eca58f643bafb6205b28db7","observation_id":"8698f68a-6fc2-4622-a271-3aa74f7735bf","resolution":{"observed_at":"2026-08-08T12:35:01.558740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.339865Z","title":"Self-challenging lan- guage model agents","venue":null,"work_id":"e00486e1-64aa-4fca-8fdc-de003a4321fa","year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.563424Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:42c8fd86f41e4e40e409050cf351a99322c8702c42e4d8f5407ffe54990919c4","observation_id":"2e90da6b-1b81-43de-bc45-cbe34f63e5c0","resolution":{"observed_at":"2026-08-08T12:35:03.344626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03335","last_updated":"2025-10-16T08:23:36Z","snapshot_observed_at":"2026-07-06T21:19:34.329442Z","submitted_at":"2025-05-06T09:08:00Z","title":"Absolute Zero: Reinforced Self-play Reasoning with Zero Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03335","snapshot_observed_at":"2026-08-08T12:35:01.553746Z","title":"Absolute zero: Reinforced self-play reasoning with zero data, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.553746Z"},"links":{"cited_paper":"/paper/2505.03335","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:bfd6aefd68cb8526936c106980bd317fbd316b6b88d904c9e9e818470c9aa13e","observation_id":"2e6ed6e5-ba9a-4b21-a66f-3db5c4a8ae99","resolution":{"observed_at":"2026-08-08T12:35:01.553746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.572361Z","title":"fix this bug","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.572361Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:95b2566bee2c4ef82c5766be6a1ad4038fdf729d0a74d5fa20039a142cfc49d7","observation_id":"b7ff8250-9818-4272-839f-3f0875a1336f","resolution":{"observed_at":"2026-08-08T12:35:01.572361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:01.568019Z","title":"Termigen: High-fidelity environment and robust trajectory synthesis for terminal agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.568019Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:e58131cb69e048ecea7112899b2a7f9d50ea72e19e1377f054e9d8e11d751f5a","observation_id":"eac52f9b-f66f-41ea-ad23-52aecb70d653","resolution":{"observed_at":"2026-08-08T12:35:01.568019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.325610Z","title":null,"venue":null,"work_id":"e2fa4a8d-1adc-43a8-abbc-3f4bc1509795","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.578764Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:76b57bd96e9865e717b1cd1e9f06f043703cdda47a3ae9257ee0285c8ad5018d","observation_id":"65d712c6-8fd3-43e3-9b10-218b501f55c8","resolution":{"observed_at":"2026-08-08T12:35:03.330156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.311023Z","title":null,"venue":null,"work_id":"86056706-6610-4f6e-b54e-daa73d44d52a","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.583427Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:806acb5b85edb2373f66ddee441e5897b9d72fcc3480d0b128c0500161d0e5bd","observation_id":"7945c93a-e1b9-4e3d-8d89-b39a7815200f","resolution":{"observed_at":"2026-08-08T12:35:03.315673Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.296127Z","title":null,"venue":null,"work_id":"2203b136-4a5e-440a-a486-3626cf4ea236","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.587964Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:014bbb1f94f345dcefd7298706bcf7c9f563d57aae17a404804932d488e1431f","observation_id":"5e41e0c0-5d1b-4bbf-ac40-64942545073d","resolution":{"observed_at":"2026-08-08T12:35:03.300959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.279850Z","title":null,"venue":null,"work_id":"93bccb8a-5ab6-49ed-8a79-d1f5b190a264","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.592376Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:cee9c39d849f9599e2cb21c46b24415c3f59279267aa20cf0b1d68963c193cec","observation_id":"be9f50aa-88a0-45d5-8f78-c13f1fcab05d","resolution":{"observed_at":"2026-08-08T12:35:03.284962Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.264128Z","title":null,"venue":null,"work_id":"967e29c2-c594-49c2-aeda-0dae7683463e","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.597325Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:1eed9488b5bed123fcdaf9d44b38741befada0eee9f1110235054fe3f9e31227","observation_id":"fdd1eb42-3b5a-4b8b-9bc2-755602fabd3b","resolution":{"observed_at":"2026-08-08T12:35:03.268785Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.250200Z","title":null,"venue":null,"work_id":"0a34282d-dbdc-4af3-bace-5743c3786799","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.601936Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:0cc56f87a0703a91d3060be6ec681f5574303d0c601a9cd1bd653bafd4fa91bd","observation_id":"e6b5e406-e6e5-43f9-909a-3c9612176c37","resolution":{"observed_at":"2026-08-08T12:35:03.254594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.234983Z","title":null,"venue":null,"work_id":"c98d4356-d951-407c-8d5a-ad2d2691f6c7","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.606600Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:28ea337b153cf44d9f10cc02e6adbdbc6166ae7cd148b73be7079ce4a6de5603","observation_id":"3440699a-1c81-49ba-8a15-b7d892117e93","resolution":{"observed_at":"2026-08-08T12:35:03.239621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.220253Z","title":null,"venue":null,"work_id":"4d5f034c-6f80-4c38-ad76-5c759381fe24","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.611257Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:c5dada737bf332b69a558608afeab8a578e13a240e7b5c325160b112296f228a","observation_id":"eb565eab-b642-413e-9647-dbc85a94026c","resolution":{"observed_at":"2026-08-08T12:35:03.224772Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.205401Z","title":"until tests pass","venue":null,"work_id":"3447add5-658a-425e-a116-0541e3acdfad","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.615574Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:7b763feda893c955ce1250b89695bc93763ff4b2775564fab698b152495a2918","observation_id":"499ebf7c-6274-4ee3-bd1a-68d3c740cef9","resolution":{"observed_at":"2026-08-08T12:35:03.210164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-06T20:36:41.418114Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-08T12:35:01.416279Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.416279Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:c003d792db7c0e1fdeaf7f8ad1b4931b50acbf283656bcd327e763509574d04f","observation_id":"83c979f1-9a6d-4b75-85fc-9a87086c735c","resolution":{"observed_at":"2026-08-08T12:35:01.416279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:35:03.458545Z","title":null,"venue":null,"work_id":"66b6f6f2-4197-4bdb-9435-34dd617cd78a","year":null},"citing_paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-08T12:35:01.329215Z"},"links":{"citing_paper":"/paper/2608.05466"},"observation_digest":"sha256:5b9dc2d99e9624a4c2bdef3a9ea877598d9f34faf0072e1329a29c1a92c14328","observation_id":"3804f896-5336-4003-9f00-41dcb5ef1009","resolution":{"observed_at":"2026-08-08T12:35:03.463141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.05466","last_updated":"2026-08-05T23:24:26Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T08:10:59.720741Z","submitted_at":"2026-08-05T23:24:26Z","title":"Recursive Synthesis for Long-Horizon Terminal Tasks"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":55,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2608.05466."}