{"as_of":"2026-08-19T10:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61dc334760bc7fc60c1b4653c12c93da5908b9dba02a8a1a65bc1074079c7b6c","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:11:05.605570Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12564/citation-record","integrity":"/paper/2608.12564/integrity","json":"/paper/2608.12564/citation-record.json","paper":"/paper/2608.12564"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-16T00:11:05.283953Z","title":"The AI scientist: Towards fully automated open-ended scientific discovery.arXiv preprint arXiv:2408.06292, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.283953Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:b26eb131badb11de98001be9fb1460488209b3e6efe2d77aa618e6e775030146","observation_id":"7c2d0b47-dbc7-4ba4-b8e2-e18216e49ae4","resolution":{"observed_at":"2026-08-16T00:11:05.283953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18864","snapshot_observed_at":"2026-08-16T00:11:05.290228Z","title":"Towards an AI co-scientist.arXiv preprint arXiv:2502.18864, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.290228Z"},"links":{"cited_paper":"/paper/2502.18864","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:57992c6847a525594db2f5caff3f05535b9d88dc4860f7fe01311e3aa9fb43e8","observation_id":"ec215b5f-35c3-4aab-91ec-11f18071cb5e","resolution":{"observed_at":"2026-08-16T00:11:05.290228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04227","last_updated":"2025-06-17T16:19:14Z","snapshot_observed_at":"2026-08-03T03:40:06.947021Z","submitted_at":"2025-01-08T01:58:42Z","title":"Agent Laboratory: Using LLM Agents as Research Assistants","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04227","snapshot_observed_at":"2026-08-16T00:11:05.295789Z","title":"Agent laboratory: Using LLM agents as research assistants.arXiv preprint arXiv:2501.04227, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.295789Z"},"links":{"cited_paper":"/paper/2501.04227","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:acdabd6c5a2cca60a771c702161b28275e67e4d0d09501a5fa5c07fe5ecd23ea","observation_id":"e739cc44-fa7d-4bc4-9bea-3306fe2b801d","resolution":{"observed_at":"2026-08-16T00:11:05.295789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.301305Z","title":"ReAct: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.301305Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:e5b3b6bf54f024c38f81e5ba106652575fd7109cda9ade7018b2d19848184783","observation_id":"5264f757-8978-433b-a3d4-cccf44dd7a7f","resolution":{"observed_at":"2026-08-16T00:11:05.301305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.810548Z","title":"Tree of thoughts: Deliberate problem solving with large language models","venue":null,"work_id":"7d30ab97-919e-4575-adb5-4033ce899b4c","year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.306280Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:5becc268160feec20dc522bec18039f6b81a9468072bb9acacceac1ccda2f743","observation_id":"6851048e-6496-4525-a9f5-200d3a5d36a3","resolution":{"observed_at":"2026-08-16T00:11:06.815673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.795025Z","title":"Reflexion: Language agents with verbal reinforcement learning","venue":null,"work_id":"b2c82b24-c0bb-48ad-8066-274242c48038","year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.311620Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:dc271eab9f9a7d3603a04d4691f8f3242b2314a97806aae1ca35faa7e93ada8f","observation_id":"2be3fba0-ce69-4de5-b1b8-a0b462ea6457","resolution":{"observed_at":"2026-08-16T00:11:06.800489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.317141Z","title":"Boiko, Robert MacKnight, Ben Kline, and Gabe Gomes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.317141Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:1aa432d9fe7f45d3b34fdbdb83277c864f94e95d9cb30acabd10486c15e7fcbe","observation_id":"2f9c642f-3d07-4108-95be-3c82526bd47e","resolution":{"observed_at":"2026-08-16T00:11:05.317141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.768426Z","title":"Augmenting large language models with chemistry tools.Nature Machine Intelligence, 6(5):525–535, 2024","venue":null,"work_id":"e7bab12b-e11f-4c86-9e63-02e5f7a57156","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.321738Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:3136616306c1241946b4fe11192a486a608230592e995a8cb0039823b49fe816","observation_id":"cfb74660-e33f-4f0c-b01c-e6db6ae5b493","resolution":{"observed_at":"2026-08-16T00:11:06.773718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.753337Z","title":"An autonomous laboratory for the accelerated synthesis of novel inorganic materials.Nature, 624:86–91, 2023","venue":null,"work_id":"3c85282f-91a4-4207-9126-444242c128ea","year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.326136Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:9f1bb2b26c080ba27f203a895182ce3b5e50d674a49129db4006c1b9b0f56b56","observation_id":"36d5b75f-7e46-420b-8033-370916790f13","resolution":{"observed_at":"2026-08-16T00:11:06.757818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13138","last_updated":"2025-02-18T18:57:21Z","snapshot_observed_at":"2026-08-05T07:03:00.655237Z","submitted_at":"2025-02-18T18:57:21Z","title":"AIDE: AI-Driven Exploration in the Space of Code","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13138","snapshot_observed_at":"2026-08-16T00:11:05.330947Z","title":"AIDE: AI-driven exploration in the space of code.arXiv preprint arXiv:2502.13138, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.330947Z"},"links":{"cited_paper":"/paper/2502.13138","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:2f36786b66e269281495e64612977dfb83f632339896cadfe31ebfc0a5909bd4","observation_id":"4d2c54d5-b03b-47c7-8283-72f98edf4951","resolution":{"observed_at":"2026-08-16T00:11:05.330947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.738531Z","title":"DS-Agent: Automated data science by empowering large language models with case-based reasoning","venue":null,"work_id":"6b7db4f9-fc6b-476f-bb0c-63824942d3c6","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.336163Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:00aa0773a7b5372c30a483ce4a72f13f6a34a502d675b9bb219df4875be7fe85","observation_id":"c92a7e88-e0d7-4683-b7a3-8df5f8fc1483","resolution":{"observed_at":"2026-08-16T00:11:06.743544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.724279Z","title":"MLAgentBench: Evaluating language agents on machine learning experimentation","venue":null,"work_id":"44395dc2-8b4d-4e0b-aed5-51880896c493","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.341343Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:12b7a4d2f85b1d953afab4f51d41beb5d0d21456ae11032e432aed1c14904d0f","observation_id":"b8a2f26d-6207-4fed-8109-db7b81ec4956","resolution":{"observed_at":"2026-08-16T00:11:06.728662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T00:11:05.345933Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.345933Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:27bd819191ef9dd9281831fba9633e435925ec951b858b237581c7d15946ed7f","observation_id":"5a8b0a89-9c0e-453a-8806-78185b3a7665","resolution":{"observed_at":"2026-08-16T00:11:05.345933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-16T00:11:05.350677Z","title":"DeepSeekMath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.350677Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:10aa770211ff4a8e293c0bae2aab15dc3fb248f2acf48f70951da0384c64fb05","observation_id":"efb3001a-af35-4f44-b3d8-005113899b11","resolution":{"observed_at":"2026-08-16T00:11:05.350677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-17T14:11:00.232598Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-16T00:11:05.355314Z","title":"Tulu 3: Pushing frontiers in open language model post-training.arXiv preprint arXiv:2411.15124, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.355314Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:228943c3f3d1fa9b3820b3cee7a43fbc2aabf96efa211f4775053c0b9284f8d9","observation_id":"097dac6f-4047-4b2d-b1dc-10f19f94605b","resolution":{"observed_at":"2026-08-16T00:11:05.355314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-16T00:11:05.360160Z","title":"DeepSeek-R1: Incentivizing reasoning capability in LLMs via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.360160Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:5f510130a4d66f5a2d79421e026ea3280de84fd43ac9c871eb2f3f03622e4d34","observation_id":"998db60e-2b3d-4e9e-8844-e11e53591ed9","resolution":{"observed_at":"2026-08-16T00:11:05.360160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.710034Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":"bf2e3280-9dee-408b-b280-c84e2d20f86b","year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.364338Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:de2b70297d12f634e9575c12d20181cdbb7d770c3e17da264db06864bd14c420","observation_id":"a81ed9b4-8c04-4747-b143-f9f3a31a40d7","resolution":{"observed_at":"2026-08-16T00:11:06.714482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.368716Z","title":"Gonzalez, Clark Barrett, and Ying Sheng","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.368716Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:65a885a5d9c71fde45ee503d8edc571d522f4ce1025147bb184441a34c8d3d94","observation_id":"6c51220d-6fe0-404e-b0f9-e5c60f8ca9dc","resolution":{"observed_at":"2026-08-16T00:11:05.368716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07782","last_updated":"2025-05-12T17:35:43Z","snapshot_observed_at":"2026-08-17T02:29:08.239672Z","submitted_at":"2025-05-12T17:35:43Z","title":"MLE-Dojo: Interactive Environments for Empowering LLM Agents in Machine Learning Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07782","snapshot_observed_at":"2026-08-16T00:11:05.373386Z","title":"MLE-Dojo: Interactive environments for empowering LLM agents in machine learning engineering.arXiv preprint arXiv:2505.07782, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.373386Z"},"links":{"cited_paper":"/paper/2505.07782","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:511bbcf25395563d267759bb23ded1c8c1ab51f101087b8632c14607a4fc0d47","observation_id":"25e21d07-2a55-48e6-993c-df7cce75a138","resolution":{"observed_at":"2026-08-16T00:11:05.373386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.378163Z","title":"SWE-World: Building software engineering agents in docker-free environments.arXiv preprint arXiv:2602.03419, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.378163Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:d02823f69c3af50522846cf2b03cf1e83212c76068067e547868fad7c65fcdc6","observation_id":"608f95c0-b593-4d83-ae20-28bf0dc520cc","resolution":{"observed_at":"2026-08-16T00:11:05.378163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-08-18T07:04:58.690133Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-16T00:11:05.382737Z","title":"World models.arXiv preprint arXiv:1803.10122, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.382737Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:854b04122551b990765e186b1a7b59e5ce795740dea4bf708a77afe33a87b26b","observation_id":"2655ffa2-dfcb-4c73-bb60-31ff3095b7d9","resolution":{"observed_at":"2026-08-16T00:11:05.382737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.387851Z","title":"Mastering diverse control tasks through world models.Nature, 640(8059):647–653, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.387851Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:8183358873a5e67fa23e69b7c7e3faf44a237ffba02aeb3758d73add29046fed","observation_id":"aa1922a4-b213-41d8-903f-f5d416327c43","resolution":{"observed_at":"2026-08-16T00:11:05.387851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13131","last_updated":"2025-06-16T06:37:18Z","snapshot_observed_at":"2026-08-11T23:48:15.512738Z","submitted_at":"2025-06-16T06:37:18Z","title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13131","snapshot_observed_at":"2026-08-16T00:11:05.392258Z","title":"Alphaevolve: A coding agent for scientific and algorithmic discovery.arXiv preprint arXiv:2506.13131, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.392258Z"},"links":{"cited_paper":"/paper/2506.13131","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:afef33d47555125e61a9b4b5ed89c2e8ade94ec3b290567263cf367dbf424a1b","observation_id":"fcdf4f54-da5b-4440-a27c-ca89974482f3","resolution":{"observed_at":"2026-08-16T00:11:05.392258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08066","last_updated":"2025-04-10T18:44:41Z","snapshot_observed_at":"2026-08-10T03:18:36.275195Z","submitted_at":"2025-04-10T18:44:41Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08066","snapshot_observed_at":"2026-08-16T00:11:05.396676Z","title":"The AI scientist-v2: Workshop-level automated scientific discovery via agentic tree search","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.396676Z"},"links":{"cited_paper":"/paper/2504.08066","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:68be8a400854d17b8d626a7b5e5b0234eaaf5fbde0ab3e2315edb6282d8e19f0","observation_id":"727bb985-c958-41d2-bc63-37c8b6f31c0c","resolution":{"observed_at":"2026-08-16T00:11:05.396676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.25996","last_updated":"2026-07-04T15:07:51Z","snapshot_observed_at":"2026-08-07T11:35:11.679286Z","submitted_at":"2026-06-24T16:08:31Z","title":"Autodata: An agentic data scientist to create high quality synthetic data","version":3},"cited_work":{"arxiv_id":"2606.25996","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.25996","snapshot_observed_at":"2026-08-16T00:11:06.010206Z","title":"Autodata: An agentic data scientist to create high quality synthetic data","venue":"cs.AI","work_id":"5e63ab9e-4e02-4374-a191-9c7f537fe84e","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.401852Z"},"links":{"cited_paper":"/paper/2606.25996","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:b0830a09e8dd6c87fb65dd9fdabce0f6730b0160d3c0bd8daf98037bb4f617b9","observation_id":"b93fff4c-4f57-4476-85b5-bf4b9100212c","resolution":{"observed_at":"2026-08-16T00:11:06.016028Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.674195Z","title":"Many ai analysts, one dataset: Navigating the agentic data science multiverse.Proceedings of the National Academy of Sciences, 123(29):e2606495123, 2026","venue":null,"work_id":"82f497a7-5368-47d3-b207-24498ec6e561","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.406796Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:bd28fc982625e7a860c43d69a2db1f23df7c007f9d3f909bfadb9487943c9020","observation_id":"61e3b663-eceb-4065-be7b-e0846ee531c6","resolution":{"observed_at":"2026-08-16T00:11:06.679606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.28568","last_updated":"2026-07-30T17:34:01Z","snapshot_observed_at":"2026-08-19T10:38:19.888021Z","submitted_at":"2026-07-30T17:34:01Z","title":"Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering","version":1},"cited_work":{"arxiv_id":"2607.28568","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.28568","snapshot_observed_at":"2026-08-16T00:11:05.986601Z","title":"Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering","venue":"cs.CL","work_id":"33a1190b-e02e-451d-a879-fffadc8c3737","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.412479Z"},"links":{"cited_paper":"/paper/2607.28568","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:365444f4b8614109b0987162468261dbe04cf71a354c3daf3e7248666a8c2c3c","observation_id":"e294bd39-cd7a-4ec8-b399-db27afb1a928","resolution":{"observed_at":"2026-08-16T00:11:05.992329Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.658249Z","title":"First steps toward automated AI research.https://www.recursive.com/articles/ first-steps-toward-automated-ai-research, 2026","venue":null,"work_id":"b606f74f-b6a9-43b7-9d2e-d8fa241eb9d1","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.416968Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:d8c2e4cf956868736a440f6652662f6fa2c22827abaf130cf117a9df7337a6fc","observation_id":"4f3c2a86-73fa-4561-927b-0f3d5231c03a","resolution":{"observed_at":"2026-08-16T00:11:06.662919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07095","last_updated":"2025-02-26T11:57:30Z","snapshot_observed_at":"2026-08-12T16:49:10.970507Z","submitted_at":"2024-10-09T17:34:27Z","title":"MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07095","snapshot_observed_at":"2026-08-16T00:11:05.421563Z","title":"MLE-bench: Evaluating machine learning agents on machine learning engineering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.421563Z"},"links":{"cited_paper":"/paper/2410.07095","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:65ce09282c639cbf7a9c2e37edb2342fe351c08b2ffe19a3c46a1b397e85c38f","observation_id":"a45f5d05-2779-4526-9a76-dded855d8324","resolution":{"observed_at":"2026-08-16T00:11:05.421563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07703","last_updated":"2025-04-11T14:12:58Z","snapshot_observed_at":"2026-08-16T13:19:17.301957Z","submitted_at":"2024-09-12T02:08:00Z","title":"DSBench: How Far Are Data Science Agents from Becoming Data Science Experts?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07703","snapshot_observed_at":"2026-08-16T00:11:05.426462Z","title":"DSBench: How far are data science agents from becoming data science experts?arXiv preprint arXiv:2409.07703, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.426462Z"},"links":{"cited_paper":"/paper/2409.07703","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:e05de960be2115c294543de330147f083de0e3f0617e68717809aa10d646cc62","observation_id":"0505398e-866a-4ed1-b3b9-e530c2833f49","resolution":{"observed_at":"2026-08-16T00:11:05.426462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14499","last_updated":"2025-02-20T12:28:23Z","snapshot_observed_at":"2026-08-17T16:58:05.353739Z","submitted_at":"2025-02-20T12:28:23Z","title":"MLGym: A New Framework and Benchmark for Advancing AI Research Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14499","snapshot_observed_at":"2026-08-16T00:11:05.431277Z","title":"MLGym: A new framework and benchmark for advancing AI research agents.arXiv preprint arXiv:2502.14499, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.431277Z"},"links":{"cited_paper":"/paper/2502.14499","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:92a7af4264e79a01fc0db81cc3342acd1461879b86aa254e3eacebf11365942c","observation_id":"6eaa9709-9a1e-41b6-bf51-9d6997341e93","resolution":{"observed_at":"2026-08-16T00:11:05.431277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.643512Z","title":"SWE-bench: Can language models resolve real-world GitHub issues? InInternational Conference on Learning Representations, 2024","venue":null,"work_id":"760e3fd6-7e85-45a0-9359-eb6b672393c2","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.435987Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:c6e9cf6c7a36b7056fc265bb63fa5fe06283350d931fdc08f0c1ee0e1ef8ba77","observation_id":"af1390d8-b1e8-4ff5-9714-483ba9b94d05","resolution":{"observed_at":"2026-08-16T00:11:06.648357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.628926Z","title":"SWE-agent: Agent-computer interfaces enable automated software engineering","venue":null,"work_id":"a0777745-d10e-484e-ba81-44af8b896b39","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.440413Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:dc2b133b5d5c36e5bcf771dd42b817d2969d8c388709f4d5aa3060a301e4dcd5","observation_id":"b3e4f2f7-3fe1-4c38-a482-0b6eb81bba12","resolution":{"observed_at":"2026-08-16T00:11:06.633550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.614630Z","title":"OpenHands: An open platform for AI software developers as generalist agents","venue":null,"work_id":"b8ad229b-910b-44eb-a471-b0eb90e8ce9a","year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.445371Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:933141f5c730621a93a91952e08403a8224e603e7e1efa4e3f5b01ea3440e0ce","observation_id":"7dc99044-2aa0-45e3-b06e-b3a9fb5adf76","resolution":{"observed_at":"2026-08-16T00:11:06.619381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.599796Z","title":"Training software engineering agents and verifiers with SWE-Gym","venue":null,"work_id":"aa231ef9-821a-4867-b048-947945ec6383","year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.450245Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:6747cc3760bbb235a864019e24acd5cf784023837431db7ccfade183c19165e9","observation_id":"c4568b76-f7fa-40a3-b4df-164256650064","resolution":{"observed_at":"2026-08-16T00:11:06.604504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-16T00:11:05.454659Z","title":"HybridFlow: A flexible and efficient RLHF framework.arXiv preprint arXiv:2409.19256, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.454659Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:91daa3fd3353268435ef3f01f84f925d648a9f2cce55f9ce0f6b68ead03c2427","observation_id":"77e6e16d-97a1-4c87-82ff-1700845d1341","resolution":{"observed_at":"2026-08-16T00:11:05.454659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.24218","last_updated":"2026-05-22T20:59:20Z","snapshot_observed_at":"2026-08-14T22:03:51.159938Z","submitted_at":"2026-05-22T20:59:20Z","title":"QUEST: Training Frontier Deep Research Agents with Fully Synthetic Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.24218","snapshot_observed_at":"2026-08-16T00:11:05.459539Z","title":"QUEST: Training frontier deep research agents with fully synthetic tasks.arXiv preprint arXiv:2605.24218, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.459539Z"},"links":{"cited_paper":"/paper/2605.24218","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:44bc3595632d47ec4914439ea24b5f2a1773f6beb8a17512dfe363a62d0cd415","observation_id":"42822062-6128-46d8-a4c2-8edd867ce859","resolution":{"observed_at":"2026-08-16T00:11:05.459539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-18T05:01:20.543826Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-16T00:11:05.464570Z","title":"DAPO: An open-source LLM reinforcement learning system at scale.arXiv preprint arXiv:2503.14476, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.464570Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:b466953a531f245fb2495c4fa72e0633878cf06643be347d90688d6012604fc6","observation_id":"a07e5786-d97b-4376-98c6-c8452eca5218","resolution":{"observed_at":"2026-08-16T00:11:05.464570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.469995Z","title":"POPE: Learning to reason on hard problems via privileged on-policy exploration.arXiv preprint arXiv:2601.18779, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.469995Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:f8dbf1013cd09646db88b33fc7699279f1f6eefa374ce5ac9e6ec391556b37f0","observation_id":"5cc2bb77-c737-4729-b13d-ecde956b9baa","resolution":{"observed_at":"2026-08-16T00:11:05.469995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.475411Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.475411Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:8c9adad1929dcc5a56092634a27d7bf1575f21f862528dde71f8eec82fa44f29","observation_id":"0d46434a-3322-4aa5-b9c2-da49b6751cd6","resolution":{"observed_at":"2026-08-16T00:11:05.475411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.571838Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":"1000db2c-b5af-4084-98cb-a7a7792f2f50","year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.480073Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:1bcc77dd894e0eb4eff51ff07adcc9f32a6dd76d39cf782679908e205e723839","observation_id":"434dd338-9b49-4224-a160-fa6205ecd68f","resolution":{"observed_at":"2026-08-16T00:11:06.578742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.484296Z","title":"Genie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.484296Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:d9b713e5ddb03d8a6c698b60c316cc940631614bc924d2d95adb9b10d269dbc1","observation_id":"e1b38f00-1767-42d9-868a-59087a1c57fd","resolution":{"observed_at":"2026-08-16T00:11:05.484296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-16T00:11:05.488861Z","title":"Cosmos world foundation model platform for physical AI.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.488861Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:16d75f4f2256a6aaf70260bbd4a02208e8a88afd2cc0140f5a854ec46a283b4e","observation_id":"3a92242f-485b-4bb6-a579-4539cd83e6c0","resolution":{"observed_at":"2026-08-16T00:11:05.488861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.545675Z","title":"Generating code world models with large language models guided by monte carlo tree search","venue":null,"work_id":"defe401c-4f62-4541-a75d-1810dc1339e4","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.493494Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:537f6dd37647454202b846879a29c2cf8e502cb152e10550a428c7fdf379a358","observation_id":"0be95e50-7915-4645-b531-0f2bfda7f7a1","resolution":{"observed_at":"2026-08-16T00:11:06.551364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.528422Z","title":"Worldcoder, a model-based LLM agent: Building world models by writing code and interacting with the environment","venue":null,"work_id":"096c6943-e58f-4beb-a655-ef7d7591d6f6","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.497930Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:dbd0d4eea0fddab7f664703d6f0adaf498d094eebb4fb7c4b9b17e1692f9400b","observation_id":"48c3c47c-a4e5-45d4-9e33-19e18bde0b75","resolution":{"observed_at":"2026-08-16T00:11:06.534218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.512312Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":"0d98042e-3fba-4451-9eef-111b9c2de592","year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.502476Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:c55b04b2c63095a3f5e8144137edea6c9804437e74c74f4efeb7b48d7d93aea2","observation_id":"0add552b-e8ed-4733-9d3c-07bc712ab87f","resolution":{"observed_at":"2026-08-16T00:11:06.517603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.506885Z","title":"Reward model ensembles help mitigate overoptimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.506885Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:6986889e97485bebc0e439e1c81a11e27a738517f571edfb754ed31c201a024d","observation_id":"7cf83f13-c3f8-4400-bff5-fc5fbf52264a","resolution":{"observed_at":"2026-08-16T00:11:05.506885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-08-13T17:59:32.644760Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-16T00:11:05.511374Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.511374Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:a5b8dc81df5209050f7fd6b432b83ca80f06123aba8011f5adb4cc3f5959dc1e","observation_id":"a8d2a9b0-60ed-46c8-801d-1ddebbd4ebb6","resolution":{"observed_at":"2026-08-16T00:11:05.511374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.486771Z","title":"Transforming classifier scores into accurate multiclass probability estimates","venue":null,"work_id":"fd0ae3a2-0412-40c6-9fb6-03c01ed28af5","year":2002},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.516199Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:c6ab6b1861511080db1138817640fffb02b1e21fadd6e2ed58697e93e9572e09","observation_id":"40081426-dc0a-4591-b720-63c76cae791d","resolution":{"observed_at":"2026-08-16T00:11:06.491718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.471035Z","title":"Weinberger","venue":null,"work_id":"ca1855c6-6f19-4be5-a10d-22183926f016","year":2017},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.520562Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:9827e0be199d60685649d705e44d5ce35b71f16375a30e7e5b007f08afe8e431","observation_id":"e29755e3-d629-4b54-b256-905a8540f44f","resolution":{"observed_at":"2026-08-16T00:11:06.476606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.456631Z","title":"DualDICE: Behavior-agnostic estimation of dis- counted stationary distribution corrections","venue":null,"work_id":"f8510d3e-1f60-4f39-8619-71290c2b69f0","year":2019},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.525329Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:e89c21a7ed1bc90fe5ac4d46563ea38d7d576d9d38cf1bd8a14f7a8b27d0b8e4","observation_id":"22e5339a-5e71-4db2-a980-5bf5b3ec5c50","resolution":{"observed_at":"2026-08-16T00:11:06.461678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.442023Z","title":"Off-policy reinforcement learning with optimistic exploration and distribution correction","venue":null,"work_id":"73e0c285-37dc-46a6-90ab-67ff9e538a85","year":2022},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.529587Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:9d212c0949006a2ee8df2038446cee427fc619dc0e9efe14b9afcf4f9d5ac872","observation_id":"a6382609-e0a2-4fe0-8531-82afb58b13ba","resolution":{"observed_at":"2026-08-16T00:11:06.446683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23723","last_updated":"2026-04-30T19:55:27Z","snapshot_observed_at":"2026-08-14T13:12:40.014662Z","submitted_at":"2025-05-29T17:54:44Z","title":"ML-Agent: Reinforcing LLM Agents for Autonomous Machine Learning Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23723","snapshot_observed_at":"2026-08-16T00:11:05.534174Z","title":"ML-Agent: ReinforcingLLMagentsforautonomousmachinelearningengineering.arXivpreprintarXiv:2505.23723, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.534174Z"},"links":{"cited_paper":"/paper/2505.23723","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:3b6e14a7454a767d1a3be3f2f6ac3f32ce5434ea0dc61388c3532660f06eb294","observation_id":"a4f085af-e9f9-4413-b738-6e5db8a27260","resolution":{"observed_at":"2026-08-16T00:11:05.534174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.07906","last_updated":"2026-05-07T09:44:38Z","snapshot_observed_at":"2026-08-16T03:25:54.487595Z","submitted_at":"2026-02-08T10:55:03Z","title":"AceGRPO: Adaptive Curriculum Enhanced Group Relative Policy Optimization for Autonomous Machine Learning Engineering","version":5},"cited_work":{"arxiv_id":"2602.07906","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.07906","snapshot_observed_at":"2026-08-16T00:11:05.687095Z","title":"AceGRPO: Adaptive Curriculum Enhanced Group Relative Policy Optimization for Autonomous Machine Learning Engineering","venue":"cs.LG","work_id":"2798fd6a-db8b-41e6-966c-0284f1a94847","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.538765Z"},"links":{"cited_paper":"/paper/2602.07906","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:971f66571001d093213ff44d7113fa38eb76e6c2df9fa38fe94b7656a03e3ab1","observation_id":"931b5f53-4014-4541-96f2-c79484996c52","resolution":{"observed_at":"2026-08-16T00:11:05.694818Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04872","last_updated":"2026-04-06T17:19:29Z","snapshot_observed_at":"2026-07-06T22:53:46.999911Z","submitted_at":"2026-04-06T17:19:29Z","title":"Synthetic Sandbox for Training Machine Learning Engineering Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.04872","snapshot_observed_at":"2026-08-16T00:11:05.543606Z","title":"Synthetic sandbox for training machine learning engineering agents.arXiv preprint arXiv:2604.04872, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.543606Z"},"links":{"cited_paper":"/paper/2604.04872","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:18f9931880d17a1cdd875076f9b7b5d1f4543d6cd7040179b37da06a26416d7b","observation_id":"b4ebe061-87de-4c81-8d1b-b4e06b75495b","resolution":{"observed_at":"2026-08-16T00:11:05.543606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.548699Z","title":"LIBERO: Benchmarking knowledge transfer for lifelong robot learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.548699Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:68b4768d35797469f36d4bfd5f0ac613270b26051b92809d8207f06ad13afe97","observation_id":"258d2b2b-c7bb-4594-aecb-bbef8ebe5e24","resolution":{"observed_at":"2026-08-16T00:11:05.548699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.416794Z","title":"Qwen3.5.https://qwen.ai/blog?id=qwen3.5, 2026","venue":null,"work_id":"84e7562f-9c39-41f1-bd3b-fe0719f1ba22","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.553409Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:763b1e28c2d4d40b53be8ddd5ee9c42665eca41a0dadd3b2323a969ccc0f2928","observation_id":"3f722c6a-2621-4e57-b941-9299e84a6c90","resolution":{"observed_at":"2026-08-16T00:11:06.421910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.402710Z","title":"MiniVLA: A better VLA with a smaller footprint.https://github","venue":null,"work_id":"b3ac5263-ea5c-4b2e-aa7f-1cac2dc6b61f","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.557872Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:5c2a7301f7295702a00763bfebf4e6c7fa1d392026af7a8fa5f3e4d981da8c5a","observation_id":"0acf7aba-d5b9-4189-85f7-437edab02770","resolution":{"observed_at":"2026-08-16T00:11:06.407362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02115","last_updated":"2026-05-13T21:07:49Z","snapshot_observed_at":"2026-08-12T16:18:51.295325Z","submitted_at":"2026-03-02T17:38:58Z","title":"Robometer: Scaling General-Purpose Robotic Reward Models via Trajectory Comparisons","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.02115","snapshot_observed_at":"2026-08-16T00:11:05.562900Z","title":"Huang, Luke Zettlemoyer, Dieter Fox, Yu Xiang, Anqi Li, Andreea Bobu, Abhishek Gupta, Stephen Tu, Erdem Biyik, and Jesse Zhang","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.562900Z"},"links":{"cited_paper":"/paper/2603.02115","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:b2b0c21524da12e161876affbcc0a7442ff11f663dbf2038424311ad3b4a685d","observation_id":"fbe222f3-aea4-4d1b-be1b-3dc0f9e6f7ac","resolution":{"observed_at":"2026-08-16T00:11:05.562900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.387937Z","title":"OpenVLA: An open-source vision-language- action model","venue":null,"work_id":"81ff6cbe-4577-4c06-b90c-c4448f677e93","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.567664Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:da0dd7ee0b4ef3c44a8557f788c497ef0bd69e40761ff9fb4ea6ab765051cbed","observation_id":"c86dc91e-9618-40e4-a4fa-8381b0ff4eb5","resolution":{"observed_at":"2026-08-16T00:11:06.393065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-16T00:11:05.572219Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.572219Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:9defa067adca76b44810210960d4c18b5e9bcba590d508df662abac9b91fc159","observation_id":"ea2d7fe4-75e9-4aa2-b88f-26fcb03f74bc","resolution":{"observed_at":"2026-08-16T00:11:05.572219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.372303Z","title":"Latent reasoning VLA: Latent thinking and prediction for vision-language-action models","venue":null,"work_id":"9b23add2-0f84-4ce8-aa4b-c9f798915715","year":2026},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.577122Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:8ec9ed2fd79a1bd29687a7700f06d526b194834c48d7cef74ca8f02f9b2cd951","observation_id":"2a0f3628-7a74-40be-b8e6-fa3f01de429c","resolution":{"observed_at":"2026-08-16T00:11:06.378180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.581626Z","title":"Finite-time analysis of the multiarmed bandit problem.Machine Learning, 47:235–256, 2002","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.581626Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:afed244d4308e10538e06a9c79d1849a45a5f646513dd4a02635f3bc2b9bbd35","observation_id":"f4bb520c-473f-45fd-ba80-13a0355d188c","resolution":{"observed_at":"2026-08-16T00:11:05.581626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:05.586199Z","title":"Information-theoretic considerations in batch reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.586199Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:7af9bf8126f27c49efa0478768a562762177752bf9531d0f4db12885aafb1af3","observation_id":"ad29ba01-d6f6-4f79-81d8-27dbcc28f206","resolution":{"observed_at":"2026-08-16T00:11:05.586199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.338366Z","title":"Risk bounds in isotonic regression.The Annals of Statistics, 30(2):528–555, 2002","venue":null,"work_id":"a5115df7-a0cc-42ba-9d92-e0e469c0f6ad","year":2002},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.590764Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:cb0e6915f8fb30493142733e85d241b12f9703bf22d24221c890caa5e49809a5","observation_id":"29769821-e6f9-413b-bcec-bb1e428d6043","resolution":{"observed_at":"2026-08-16T00:11:06.343549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.322219Z","title":"MLE-bench: Evaluating machine learning agents on machine learning engineering.https: //openai.com/index/mle-bench/, 2024","venue":null,"work_id":"fc16c2dc-0c1b-4419-a73d-c1b19a2ff48f","year":2024},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.594916Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:fb623a8ee56a1f3ec5c82985a49d31707fba5be923afdf375cf5dddfc2f086f0","observation_id":"16bd80b9-5de1-41a1-953c-0cea028cb6e2","resolution":{"observed_at":"2026-08-16T00:11:06.327646Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.307485Z","title":null,"venue":null,"work_id":"8d9cc0c9-db3b-47ec-a061-b2c8ae79d232","year":null},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.601191Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:1c54b46ada6c3757ca597605bca7a96777f03f1bf9fff14c77aebd7287698f3c","observation_id":"e4c22bb7-b518-4a2e-befc-c756a43a7fa6","resolution":{"observed_at":"2026-08-16T00:11:06.311940Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:11:06.292291Z","title":"reason\":","venue":null,"work_id":"5e49dfb0-2044-42cf-9339-37787cf01413","year":null},"citing_paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T00:11:05.605570Z"},"links":{"citing_paper":"/paper/2608.12564"},"observation_digest":"sha256:200962de089d96c2c405f9483bbf717b6c48269ca11dfce1310709ef861589ed","observation_id":"951cc6cd-d94c-4e8e-aaf0-73d90dbd9126","resolution":{"observed_at":"2026-08-16T00:11:06.297389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.12564","last_updated":"2026-08-12T20:11:25Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T12:55:16.942066Z","submitted_at":"2026-08-12T20:11:25Z","title":"Scaling Automatic Research Agents via World Models"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":3,"verified_fuzzy":27},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2608.12564."}