{"as_of":"2026-08-09T06:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:412387cb00303ef218e14cefdf30eee2e896434c3c2d1f5309406ce6b18b511e","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:24:50.484160Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:27:50.165917Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06776","snapshot_observed_at":"2026-08-07T05:27:50.165917Z","title":"To- wards internet-scale training for agents.ArXiv, abs/2502.06776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07976","last_updated":"2025-06-10T12:50:18Z","snapshot_observed_at":"2026-08-07T20:50:35.036523Z","submitted_at":"2025-06-09T17:50:02Z","title":"Thinking vs. Doing: Agents that Reason by Scaling Test-Time Interaction","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:27:50.165917Z"},"links":{"cited_paper":"/paper/2502.06776","citing_paper":"/paper/2506.07976"},"observation_digest":"sha256:0b4a31416cb38f8aa7353a849d9d55d323572e2b4d9683dc7693da10b367f85c","observation_id":"1d96973f-8934-484e-96ed-85db71ef9fe8","resolution":{"observed_at":"2026-08-07T05:27:50.165917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"cited_work":{"arxiv_id":"2502.06776","doi":"10.48550/arxiv.2502.06776","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://doi.org/10.48550/arXiv.2502.06776","venue":"ArXiv.org","work_id":"2baee46a-1f93-42d5-bfa2-562670f49c9e","year":2025},"citing_paper":{"arxiv_id":"2601.22149","last_updated":"2026-04-17T18:27:53Z","snapshot_observed_at":"2026-08-03T05:49:10.484175Z","submitted_at":"2026-01-29T18:59:07Z","title":"DynaWeb: Model-Based Reinforcement Learning of Web Agents","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T09:33:30.444057Z"},"links":{"cited_paper":"/paper/2502.06776","citing_paper":"/paper/2601.22149"},"observation_digest":"sha256:c48890d56906b1940195cc2be8fcf93c44d26f396c82ef819b838d39b85a47be","observation_id":"fddaf0a7-6b40-4a6c-b57c-0dda691a378f","resolution":{"observed_at":"2026-05-16T09:37:41.519723Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"cited_work":{"arxiv_id":"2502.06776","doi":"10.48550/arxiv.2502.06776","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://doi.org/10.48550/arXiv.2502.06776","venue":"ArXiv.org","work_id":"2baee46a-1f93-42d5-bfa2-562670f49c9e","year":2025},"citing_paper":{"arxiv_id":"2603.05044","last_updated":"2026-04-14T08:14:14Z","snapshot_observed_at":"2026-08-03T03:21:53.279816Z","submitted_at":"2026-03-05T10:51:34Z","title":"WebFactory: Automated Compression of Foundational Language Intelligence into Grounded Web Agents","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T16:50:02.527821Z"},"links":{"cited_paper":"/paper/2502.06776","citing_paper":"/paper/2603.05044"},"observation_digest":"sha256:c941d93ee7993e5d083c25a1dfd58ca6e9138018cdefcc05ee8267994eb5928b","observation_id":"5db362cc-0231-4528-b70f-51b39367709a","resolution":{"observed_at":"2026-05-15T16:50:10.672001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"cited_work":{"arxiv_id":"2502.06776","doi":"10.48550/arxiv.2502.06776","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://doi.org/10.48550/arXiv.2502.06776","venue":"ArXiv.org","work_id":"2baee46a-1f93-42d5-bfa2-562670f49c9e","year":2025},"citing_paper":{"arxiv_id":"2603.20340","last_updated":"2026-04-15T07:34:34Z","snapshot_observed_at":"2026-07-06T22:49:57.103822Z","submitted_at":"2026-03-20T09:25:50Z","title":"ContractSkill: Repairable Contract-Based Skills for Multimodal Web Agents","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T08:58:50.947580Z"},"links":{"cited_paper":"/paper/2502.06776","citing_paper":"/paper/2603.20340"},"observation_digest":"sha256:bcc2fc0d24baedc70729d4e602323b0b9d0f0ba0c9b83e9c98adec7f56caab06","observation_id":"bc2c3cb3-33df-4191-9876-ed6ec68585d6","resolution":{"observed_at":"2026-05-15T08:59:52.986286Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"cited_work":{"arxiv_id":"2502.06776","doi":"10.48550/arxiv.2502.06776","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://doi.org/10.48550/arXiv.2502.06776","venue":"ArXiv.org","work_id":"2baee46a-1f93-42d5-bfa2-562670f49c9e","year":2025},"citing_paper":{"arxiv_id":"2605.06761","last_updated":"2026-05-07T17:17:10Z","snapshot_observed_at":"2026-07-06T23:19:10.574595Z","submitted_at":"2026-05-07T17:17:10Z","title":"Weblica: Scalable and Reproducible Training Environments for Visual Web Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-11T01:25:44.578007Z"},"links":{"cited_paper":"/paper/2502.06776","citing_paper":"/paper/2605.06761"},"observation_digest":"sha256:51cfa36558e2d69c544b03461ca5afcc9209fff39d3285425a49230635b3dc3c","observation_id":"3bd86329-3690-40a8-a34f-0320088f0b4b","resolution":{"observed_at":"2026-05-11T04:25:56.929155Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"cited_work":{"arxiv_id":"2502.06776","doi":"10.48550/arxiv.2502.06776","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://doi.org/10.48550/arXiv.2502.06776","venue":"ArXiv.org","work_id":"2baee46a-1f93-42d5-bfa2-562670f49c9e","year":2025},"citing_paper":{"arxiv_id":"2606.02031","last_updated":"2026-06-04T09:03:30Z","snapshot_observed_at":"2026-08-03T02:24:10.083746Z","submitted_at":"2026-06-01T10:20:10Z","title":"OpenWebRL: Demystifying Online Multi-turn Reinforcement Learning for Visual Web Agents","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T15:46:50.587684Z"},"links":{"cited_paper":"/paper/2502.06776","citing_paper":"/paper/2606.02031"},"observation_digest":"sha256:63bbe1a5f8cf17f7d0cbbabc8fd35a9adbcefc52ca12f5736102961fcd1eeccd","observation_id":"262c0d22-9ae3-4eaf-a79f-acb7ffbdded2","resolution":{"observed_at":"2026-07-01T22:06:16.466449Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"cited_work":{"arxiv_id":"2502.06776","doi":"10.48550/arxiv.2502.06776","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://doi.org/10.48550/arXiv.2502.06776","venue":"ArXiv.org","work_id":"2baee46a-1f93-42d5-bfa2-562670f49c9e","year":2025},"citing_paper":{"arxiv_id":"2606.12191","last_updated":"2026-06-10T15:15:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-10T15:15:01Z","title":"Agentic Environment Engineering for Large Language Models: A Survey of Environment Modeling, Synthesis, Evaluation, and Application","version":1},"reference_index":267,"source":"pdf_text","source_observed_at":"2026-06-27T09:46:30.702256Z"},"links":{"cited_paper":"/paper/2502.06776","citing_paper":"/paper/2606.12191"},"observation_digest":"sha256:f7013f2d47400e02fca399ca0f6c8748dc0ae9898badde998e074a776b34328b","observation_id":"c0103017-b7e6-426a-ae5a-27cdef8b4150","resolution":{"observed_at":"2026-07-03T10:58:02.991562Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"cited_work":{"arxiv_id":"2502.06776","doi":"10.48550/arxiv.2502.06776","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://doi.org/10.48550/arXiv.2502.06776","venue":"ArXiv.org","work_id":"2baee46a-1f93-42d5-bfa2-562670f49c9e","year":2025},"citing_paper":{"arxiv_id":"2606.17321","last_updated":"2026-06-15T22:04:11Z","snapshot_observed_at":"2026-07-06T23:52:57.359941Z","submitted_at":"2026-06-15T22:04:11Z","title":"ProCUA-SFT Technical Report","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T03:18:04.149281Z"},"links":{"cited_paper":"/paper/2502.06776","citing_paper":"/paper/2606.17321"},"observation_digest":"sha256:11f17a9e150d58ac212a4d653bac379e55d7226285c5bb7198e75c1c84eb1930","observation_id":"0ab252e1-a260-40eb-ac04-73dc2918661a","resolution":{"observed_at":"2026-07-03T18:08:46.699111Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"cited_work":{"arxiv_id":"2502.06776","doi":"10.48550/arxiv.2502.06776","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://doi.org/10.48550/arXiv.2502.06776","venue":"ArXiv.org","work_id":"2baee46a-1f93-42d5-bfa2-562670f49c9e","year":2025},"citing_paper":{"arxiv_id":"2606.27330","last_updated":"2026-06-25T17:44:48Z","snapshot_observed_at":"2026-08-03T00:40:31.745653Z","submitted_at":"2026-06-25T17:44:48Z","title":"Empowering GUI Agents via Autonomous Experience Exploration and Hindsight Experience Utilization for Task Planning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-26T03:51:51.827622Z"},"links":{"cited_paper":"/paper/2502.06776","citing_paper":"/paper/2606.27330"},"observation_digest":"sha256:a5121210041fafd397f86e539466bba7c6153becc235a92d8fc57eb949458b38","observation_id":"47e1d398-e6d2-4006-912a-9021323ea636","resolution":{"observed_at":"2026-07-04T14:29:53.385736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06776","snapshot_observed_at":"2026-07-31T02:18:01.822251Z","title":"InSTA: Towards internet-scale training for agents.arXiv preprint arXiv:2502.06776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28609","last_updated":"2026-08-06T17:55:59Z","snapshot_observed_at":"2026-08-09T06:13:04.491822Z","submitted_at":"2026-07-30T17:57:41Z","title":"OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-31T02:18:01.822251Z"},"links":{"cited_paper":"/paper/2502.06776","citing_paper":"/paper/2607.28609"},"observation_digest":"sha256:d0162357e6ddf947696586e1c8c718cf4779a0ae8e94bf28da4ebed16a038794","observation_id":"ae9c1a53-c75c-4d84-82f0-0a7ebaf1b595","resolution":{"observed_at":"2026-07-31T02:18:01.822251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.06776/citation-record","integrity":"/paper/2502.06776/integrity","json":"/paper/2502.06776/citation-record.json","paper":"/paper/2502.06776"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.283326Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.283326Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:65d2eb038f5a189de264fd3d302e3ef52ba6def5c0388bdf2f0e1f96b3b0703d","observation_id":"ee2d6038-0004-403e-9fdb-8f90a9517aaf","resolution":{"observed_at":"2026-08-08T14:24:50.283326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.288008Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.288008Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:5fd537a1b744b0ac833154fd6584f5792ef4f20ed378941f81493e30f2b19930","observation_id":"073770c8-88c3-430a-9ebf-4f4815ffca7a","resolution":{"observed_at":"2026-08-08T14:24:50.288008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.291843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.291843Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:d4697ddd10479ae849c2cba7c8308161b5c180ed809f70f6e170eda18e07030c","observation_id":"d92b4c8b-a731-4d17-a5b4-2f3b2d85bdbd","resolution":{"observed_at":"2026-08-08T14:24:50.291843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:51.333619Z","title":null,"venue":null,"work_id":"293f7a27-8039-4715-b78f-7595f4298925","year":null},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.295342Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:2f00c062034b1fb3e41532e09c872491d5be65614c83d5b3f2908b71dec0b154","observation_id":"92af65ee-1f28-4220-95d4-5948aafd16dc","resolution":{"observed_at":"2026-08-08T14:24:51.337301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.298819Z","title":"Language models as agent models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.298819Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:5c04d0622a8a896b15d3d48f52cca1aff95ce50c7a3298378a2881aa5dd5799e","observation_id":"f3921423-24e3-4645-b9ce-40b36b05b58a","resolution":{"observed_at":"2026-08-08T14:24:50.298819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.302297Z","title":"Graph of thoughts: Solving elaborate problems with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.302297Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:d2d4f5e69645815fabdfed0cea19c2e1a0420df76f4c255a9a46368d2a58fc1c","observation_id":"fbe027e7-122d-42f4-b87a-3849bd3aa532","resolution":{"observed_at":"2026-08-08T14:24:50.302297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-08T14:24:50.305890Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.305890Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:2b2c03df0d4894f5bb214334493b568ae8602a1f08dcc1416ec6c06aa40d3d52","observation_id":"cfde26e3-8a15-42c2-bd97-d056ffa81aa4","resolution":{"observed_at":"2026-08-08T14:24:50.305890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-08T14:24:50.309685Z","title":"Sparks of artificial general intelligence: Early experiments with gpt-4, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.309685Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:dee6d70fb4c017a764ea43d2f6825717831537b61a66d368415a862acecc4a77","observation_id":"0305d162-35a3-4e8b-871f-307ab708f6e6","resolution":{"observed_at":"2026-08-08T14:24:50.309685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-08T14:24:50.313595Z","title":"Fireact: Toward language agent fine-tuning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.313595Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:a9fea9f0a803ebf9b63cb2cbce6ba5b471c49dd764575f259bd9b0463bbd9ce5","observation_id":"f718996a-ad8b-406c-8ffd-65ecf8b4eb47","resolution":{"observed_at":"2026-08-08T14:24:50.313595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05467","last_updated":"2025-02-28T16:02:27Z","snapshot_observed_at":"2026-08-06T15:44:08.375632Z","submitted_at":"2024-12-06T23:43:59Z","title":"The BrowserGym Ecosystem for Web Agent Research","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05467","snapshot_observed_at":"2026-08-08T14:24:50.317546Z","title":"Xu, Siva Reddy, Quentin Cappart, Graham Neubig, Ruslan Salakhutdinov, Nicolas Chapados, and Alexandre Lacoste","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.317546Z"},"links":{"cited_paper":"/paper/2412.05467","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:cd40cef6be22f1a3e267f9220faf2f6b0b977ba26d66e0391e234ac0a59bae31","observation_id":"c110ffad-3e6e-48ed-8d41-623f533a19cd","resolution":{"observed_at":"2026-08-08T14:24:50.317546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06070","last_updated":"2023-12-09T05:57:46Z","snapshot_observed_at":"2026-07-06T15:40:50.807376Z","submitted_at":"2023-06-09T17:44:31Z","title":"Mind2Web: Towards a Generalist Agent for the Web","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06070","snapshot_observed_at":"2026-08-08T14:24:50.321613Z","title":"Mind2web: Towards a generalist agent for the web, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.321613Z"},"links":{"cited_paper":"/paper/2306.06070","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:737bf57dfbb62904052abd5998533117914a6b4daa45caeac7dc1e305a034c85","observation_id":"7ac9c8c2-f6e7-4864-9f17-db73edb8daa0","resolution":{"observed_at":"2026-08-08T14:24:50.321613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14361","last_updated":"2024-04-26T19:02:23Z","snapshot_observed_at":"2026-08-03T14:12:33.141530Z","submitted_at":"2024-04-22T17:15:32Z","title":"Better Synthetic Data by Retrieving and Transforming Existing Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14361","snapshot_observed_at":"2026-08-08T14:24:50.325236Z","title":"Better synthetic data by retrieving and transforming existing datasets, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.325236Z"},"links":{"cited_paper":"/paper/2404.14361","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:e5dbedcb1a9e6bb34bdb837ade2d7bca99ca9ea50faccf81d43a67d08ec03c0f","observation_id":"3e458e21-9821-4ed6-abe6-1515b6d431c2","resolution":{"observed_at":"2026-08-08T14:24:50.325236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T14:24:50.328784Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.328784Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:07a455940ecfb07b838156025e09f28066a2b32c99e2c9822a5559ac15af929a","observation_id":"b76ffa0c-df13-42a3-8686-41db08222d2d","resolution":{"observed_at":"2026-08-08T14:24:50.328784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.332092Z","title":"W eb V oyager: Building an end-to-end web agent with large multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.332092Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:4140679667665ef0d2a7b2ec1eec6b9f223627cd647dac1a033661ee73943ad7","observation_id":"6a45155b-e0ad-4d65-a8ba-9af526c8c928","resolution":{"observed_at":"2026-08-08T14:24:50.332092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08914","last_updated":"2024-12-27T06:56:18Z","snapshot_observed_at":"2026-07-06T17:01:40.744034Z","submitted_at":"2023-12-14T13:20:57Z","title":"CogAgent: A Visual Language Model for GUI Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08914","snapshot_observed_at":"2026-08-08T14:24:50.335297Z","title":"Cogagent: A visual language model for gui agents, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.335297Z"},"links":{"cited_paper":"/paper/2312.08914","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:0d0c84e8ab73f1d17815675bf77172285df0b608b1f503413fa65834949710ba","observation_id":"c4a373ce-8807-43ad-8fc8-84f984a0d932","resolution":{"observed_at":"2026-08-08T14:24:50.335297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-08T14:24:50.338817Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.338817Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:7d6bb2e6776cbb13e634c18eeb013140e561ac046409b4bce9cb1413888670ca","observation_id":"0ec5b2f6-a62a-446a-b3fa-fcddc1de3ada","resolution":{"observed_at":"2026-08-08T14:24:50.338817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13649","last_updated":"2024-06-06T02:01:09Z","snapshot_observed_at":"2026-08-05T16:01:54.847394Z","submitted_at":"2024-01-24T18:35:21Z","title":"VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13649","snapshot_observed_at":"2026-08-08T14:24:50.342376Z","title":"Visualwebarena: Evaluating multimodal agents on realistic visual web tasks, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.342376Z"},"links":{"cited_paper":"/paper/2401.13649","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:a6c649d1fb9dbfb15ff2b877d4b229d1d6e53abd6589af02ae4c765c08cbaf70","observation_id":"cb1cf1c8-3ec2-44c5-8a62-5c49dd361be3","resolution":{"observed_at":"2026-08-08T14:24:50.342376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.345982Z","title":"Tree search for language model agents, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.345982Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:430593d5bf053c03924c903e10ae87c46b109fe5b7bdc3e2fee0968a26c00cfa","observation_id":"e0ff1980-b081-4620-a325-683c051163b1","resolution":{"observed_at":"2026-08-08T14:24:50.345982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06180","last_updated":"2023-09-12T12:50:04Z","snapshot_observed_at":"2026-08-02T09:51:08.145755Z","submitted_at":"2023-09-12T12:50:04Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06180","snapshot_observed_at":"2026-08-08T14:24:50.349153Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.349153Z"},"links":{"cited_paper":"/paper/2309.06180","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:0e9ef64c8979a06e29c523e27251d083f2013e33d18531cca4f1b937d15767d0","observation_id":"7749ecf6-5cff-41c9-a5e2-29246ca3984c","resolution":{"observed_at":"2026-08-08T14:24:50.349153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00267","last_updated":"2024-09-03T14:01:54Z","snapshot_observed_at":"2026-07-06T16:13:07.384791Z","submitted_at":"2023-09-01T05:53:33Z","title":"RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00267","snapshot_observed_at":"2026-08-08T14:24:50.352547Z","title":"Rlaif vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.352547Z"},"links":{"cited_paper":"/paper/2309.00267","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:b5c042e5f218cc6783452e4291766e46b4baf79851d01fd2efd4591b62036f36","observation_id":"9dade60d-eb87-49f7-b28b-630132912a4c","resolution":{"observed_at":"2026-08-08T14:24:50.352547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.355887Z","title":"From generation to judgment: Opportunities and challenges of llm-as-a-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.355887Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:609cd89aade5279241bfc5b5e46276476d3e39861153d587090c76fa2107cafb","observation_id":"958df537-a72c-4b84-9e31-a83b5e9c13de","resolution":{"observed_at":"2026-08-08T14:24:50.355887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05955","last_updated":"2024-04-09T02:29:39Z","snapshot_observed_at":"2026-07-06T17:57:31.912970Z","submitted_at":"2024-04-09T02:29:39Z","title":"VisualWebBench: How Far Have Multimodal LLMs Evolved in Web Page Understanding and Grounding?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05955","snapshot_observed_at":"2026-08-08T14:24:50.359070Z","title":"Visualwebbench: How far have multimodal llms evolved in web page understanding and grounding?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.359070Z"},"links":{"cited_paper":"/paper/2404.05955","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:e2c15edf913a69c52c4218019390eb9c5d83a617d68a70554ebb0afe6c9e8a9e","observation_id":"cbf8049c-5d5b-4b04-ac59-83bd09176a9c","resolution":{"observed_at":"2026-08-08T14:24:50.359070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.362660Z","title":"Weblinx: Real-world website navigation with multi-turn dialogue, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.362660Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:eb2b39b4f884527e4a7819370205ae95420071b3140bd2b37c1218e9b7b377b0","observation_id":"987e6e94-0ef5-4376-b55a-a3221f83c769","resolution":{"observed_at":"2026-08-08T14:24:50.362660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.366344Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.366344Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:3c58f98e2d318e15cf9b527a3813c5bd086b7d06962300f8faeec1d4ce8cdc84","observation_id":"8188a3af-9600-4974-92aa-d068b7e3e320","resolution":{"observed_at":"2026-08-08T14:24:50.366344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:51.315809Z","title":"Playwright","venue":null,"work_id":"1160fb00-1bc7-4b60-845b-64b9a021739a","year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.369944Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:9a82c13446628b2a5d53486695b643cafb8ffb595bce050b8334f558cb9cba48","observation_id":"d2886aef-e7e6-4380-a9f6-3128d5b9fb03","resolution":{"observed_at":"2026-08-08T14:24:51.319624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03502","last_updated":"2024-07-03T21:01:12Z","snapshot_observed_at":"2026-08-07T20:57:52.466823Z","submitted_at":"2024-07-03T21:01:12Z","title":"AgentInstruct: Toward Generative Teaching with Agentic Flows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03502","snapshot_observed_at":"2026-08-08T14:24:50.373086Z","title":"Agentinstruct: Toward generative teaching with agentic flows, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.373086Z"},"links":{"cited_paper":"/paper/2407.03502","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:fd4d83da4dd63de88032a9977e9fb68baddc2f57703480fb8fb6bb3a876946df","observation_id":"c6b20d75-769c-4c46-a53b-29305c4a39d9","resolution":{"observed_at":"2026-08-08T14:24:50.373086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02907","last_updated":"2025-02-05T18:56:51Z","snapshot_observed_at":"2026-07-06T19:27:20.458797Z","submitted_at":"2024-10-03T18:56:51Z","title":"NNetNav: Unsupervised Learning of Browser Agents Through Environment Interaction in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02907","snapshot_observed_at":"2026-08-08T14:24:50.376394Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.376394Z"},"links":{"cited_paper":"/paper/2410.02907","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:18993d622e34cdb99bd16c4743d9f4219a6383122af72d145db5b9c10314f741","observation_id":"0f3e2a0f-c667-495f-8232-719fab758aa1","resolution":{"observed_at":"2026-08-08T14:24:50.376394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15637","last_updated":"2024-11-27T16:34:52Z","snapshot_observed_at":"2026-08-01T11:27:27.901748Z","submitted_at":"2024-09-24T00:51:45Z","title":"Synatra: Turning Indirect Knowledge into Direct Demonstrations for Digital Agents at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15637","snapshot_observed_at":"2026-08-08T14:24:50.379591Z","title":"Xu, Aman Madaan, Jiarui Liu, Robert Lo, Abishek Sridhar, Sudipta Sengupta, Dan Roth, Graham Neubig, and Shuyan Zhou","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.379591Z"},"links":{"cited_paper":"/paper/2409.15637","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:764273b751da01ccf8749cf09642061f6a9d427e3206417b7670b42c91e7c485","observation_id":"b0678889-2d91-4977-9eb7-b206f822a189","resolution":{"observed_at":"2026-08-08T14:24:50.379591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:51.304545Z","title":null,"venue":null,"work_id":"bed3b8dc-b457-460c-9e3f-ef0837ba1307","year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.382859Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:5857bf76e977ebd3e4412719fc312a24e04949b911ecb474e1c2b6a195f16265","observation_id":"c7bc3b97-9d02-4cb0-a086-90a438797921","resolution":{"observed_at":"2026-08-08T14:24:51.308230Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20309","last_updated":"2024-10-01T21:28:29Z","snapshot_observed_at":"2026-07-06T18:22:53.072592Z","submitted_at":"2024-05-30T17:52:36Z","title":"Large Language Models Can Self-Improve At Web Agent Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20309","snapshot_observed_at":"2026-08-08T14:24:50.385849Z","title":"Large language models can self-improve at web agent tasks, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.385849Z"},"links":{"cited_paper":"/paper/2405.20309","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:556488a5712ae798b036e9bf8342aa150163941d18970678b3d8e6a7154ff213","observation_id":"0a7fb9ba-df97-4fc1-9ade-367acd1a7d3a","resolution":{"observed_at":"2026-08-08T14:24:50.385849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:51.292683Z","title":"REFINER : Reasoning feedback on intermediate representations","venue":null,"work_id":"9925060a-8b88-4f4c-a1bc-5acdc6b170a9","year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.389101Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:ef1180d58fb41d0b80ce9739f0aba9171a49c8dfc6e2258af40a787dcbff9a5f","observation_id":"da1d925a-a9bc-4dc7-84a9-52a65ff6659e","resolution":{"observed_at":"2026-08-08T14:24:51.297090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07199","last_updated":"2024-08-13T20:52:13Z","snapshot_observed_at":"2026-08-01T22:07:45.419539Z","submitted_at":"2024-08-13T20:52:13Z","title":"Agent Q: Advanced Reasoning and Learning for Autonomous AI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07199","snapshot_observed_at":"2026-08-08T14:24:50.392087Z","title":"Agent q: Advanced reasoning and learning for autonomous ai agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.392087Z"},"links":{"cited_paper":"/paper/2408.07199","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:2ecefc8ab926dc88f643ea2f96518bf7804b876b12e16d3b7332808076761f9f","observation_id":"34ab8fa1-d648-4230-803b-51f16d13253b","resolution":{"observed_at":"2026-08-08T14:24:50.392087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:51.281868Z","title":"Language models are unsupervised multitask learners, 2019","venue":null,"work_id":"18eb5210-a958-4536-aaf7-8974060e8709","year":2019},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.396681Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:77aedcefe0107f8c111be79efe6f9b191daf8344ac42c78d8f9475ee54cb3a78","observation_id":"5aefd61b-c7af-4b15-8c25-9615a88aa8b0","resolution":{"observed_at":"2026-08-08T14:24:51.285581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10088","last_updated":"2023-10-27T14:24:31Z","snapshot_observed_at":"2026-08-09T00:36:46.955355Z","submitted_at":"2023-07-19T15:57:24Z","title":"Android in the Wild: A Large-Scale Dataset for Android Device Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10088","snapshot_observed_at":"2026-08-08T14:24:50.399754Z","title":"Android in the wild: A large-scale dataset for android device control, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.399754Z"},"links":{"cited_paper":"/paper/2307.10088","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:45c2a01bcac99508a19032cb597e7fba0be3c0e0026b3758ca5772b0771c736a","observation_id":"96067855-455f-4833-a61d-1ab51bf68fb0","resolution":{"observed_at":"2026-08-08T14:24:50.399754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.403052Z","title":"Toolformer: Language models can teach themselves to use tools","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.403052Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:75b6e2b3440654e8d6dea0925bb2b7fdf8bfcd14fa1a31e584e9d1d1e12abfff","observation_id":"a3f733c7-5748-4101-aabc-2baffffc950e","resolution":{"observed_at":"2026-08-08T14:24:50.403052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14532","last_updated":"2024-06-20T17:45:54Z","snapshot_observed_at":"2026-08-05T15:19:41.420073Z","submitted_at":"2024-06-20T17:45:54Z","title":"RL on Incorrect Synthetic Data Scales the Efficiency of LLM Math Reasoning by Eight-Fold","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14532","snapshot_observed_at":"2026-08-08T14:24:50.406158Z","title":"Rl on incorrect synthetic data scales the efficiency of llm math reasoning by eight-fold, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.406158Z"},"links":{"cited_paper":"/paper/2406.14532","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:98d49d34dc306d0280a9308eeb791426564595b66319d4a7ca8946ef2e9053bd","observation_id":"0206bbf1-b54a-4626-bcb5-a65cff803769","resolution":{"observed_at":"2026-08-08T14:24:50.406158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15004","last_updated":"2024-12-05T02:00:07Z","snapshot_observed_at":"2026-08-05T16:22:08.749834Z","submitted_at":"2024-11-22T15:26:23Z","title":"ScribeAgent: Towards Specialized Web Agents Using Production-Scale Workflow Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15004","snapshot_observed_at":"2026-08-08T14:24:50.409647Z","title":"Scribeagent: Towards specialized web agents using production-scale workflow data, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.409647Z"},"links":{"cited_paper":"/paper/2411.15004","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:a86ecd38f760664e812624b54d5c568a372922ea4f8de063bd76ab99eef8f5df","observation_id":"17a875e4-7a63-453b-a9c5-d12662c1baf5","resolution":{"observed_at":"2026-08-08T14:24:50.409647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-08T14:24:50.413143Z","title":"Scaling llm test-time compute optimally can be more effective than scaling model parameters, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.413143Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:ef085fca77a1add8b99e29872305cebb7f8d4635655d0963e3ea7ad0f88ad802","observation_id":"5a806af7-f919-47b1-bf23-6c8b369eeed3","resolution":{"observed_at":"2026-08-08T14:24:50.413143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.416715Z","title":"Fast best-of-n decoding via speculative rejection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.416715Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:c45cc6901a4777870f86d7b77575e510d3debbd1ebfd81ce02b6b82d74ae4e4e","observation_id":"5c808863-c9dd-4d0d-b6e7-358c2c4dc874","resolution":{"observed_at":"2026-08-08T14:24:50.416715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14367","last_updated":"2024-06-02T22:00:42Z","snapshot_observed_at":"2026-07-06T18:03:51.687441Z","submitted_at":"2024-04-22T17:20:18Z","title":"Preference Fine-Tuning of LLMs Should Leverage Suboptimal, On-Policy Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14367","snapshot_observed_at":"2026-08-08T14:24:50.420177Z","title":"Preference fine-tuning of llms should leverage suboptimal, on-policy data, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.420177Z"},"links":{"cited_paper":"/paper/2404.14367","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:f17a8e694060f370a9c3f6cf7d9228c0aaa2015d6d57e9b31829fb1ed0c9b01b","observation_id":"8338de25-381f-4e0e-9505-09ee70966e48","resolution":{"observed_at":"2026-08-08T14:24:50.420177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:51.259263Z","title":"Common crawl, 2025","venue":null,"work_id":"cb6d0d35-e711-417a-ba31-1040e11c0f89","year":2025},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.424981Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:3528b5c06b0195d12d89d4c5dae1009195f33c50c765c318c00d643a14bc4150","observation_id":"da041530-0d95-4601-be8a-97927d1ea3e8","resolution":{"observed_at":"2026-08-08T14:24:51.262720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-08T14:24:50.428386Z","title":"Llama: Open and efficient foundation language models, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.428386Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:5558dc78a8cd2dbdf8f2511952b8d1bf24f1e978e99dfd3710af0f18aab2d383","observation_id":"ea94054e-d6a4-4c35-a502-8de8f602f350","resolution":{"observed_at":"2026-08-08T14:24:50.428386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-08T14:24:50.432100Z","title":"Llama 2: Open foundation and fine-tuned chat models, 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.432100Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:79e74347d49a86fce04fd5e83b16e02670f7246b0d95c6f8c23bb6e7c550244f","observation_id":"4a3f1095-6f52-4036-bae6-8e4e41e07a58","resolution":{"observed_at":"2026-08-08T14:24:50.432100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:51.245091Z","title":"Effective data augmentation with diffusion models","venue":null,"work_id":"f1967866-bcc8-4d74-93ca-fa9e9011f89e","year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.435592Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:aa4a3ae93aeb7c56120f444925bfcc60cd841c0410853ea58ed31488075f812a","observation_id":"d0d07af5-0d1b-4b56-9522-de72f1c5921c","resolution":{"observed_at":"2026-08-08T14:24:51.251327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-07-06T19:18:41.002837Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-08T14:24:50.439003Z","title":"Llms still can't plan; can lrms? a preliminary evaluation of openai's o1 on planbench, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.439003Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:89c85a4f394355a174b04d09189476535cd68314f72365bcbe3ed0f585c77325","observation_id":"e2581515-9656-4d94-8da8-fefae582a480","resolution":{"observed_at":"2026-08-08T14:24:50.439003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.442840Z","title":"A survey on large language model based autonomous agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.442840Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:793190ef2f96a3100a065b2aa42251f993464f4f7bd2784d94b1d3410816a94b","observation_id":"ea5f47ac-2bc3-41b6-b0a4-1ba017f59dd5","resolution":{"observed_at":"2026-08-08T14:24:50.442840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15116","last_updated":"2024-02-23T06:04:23Z","snapshot_observed_at":"2026-07-06T17:34:24.337596Z","submitted_at":"2024-02-23T06:04:23Z","title":"Large Multimodal Agents: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15116","snapshot_observed_at":"2026-08-08T14:24:50.446116Z","title":"Large multimodal agents: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.446116Z"},"links":{"cited_paper":"/paper/2402.15116","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:a0b08ff4460f70a2ecdcf4f42599cc8e79f543c89399c32da991b03d500240fe","observation_id":"6b8baf50-50fc-4489-ac81-7eccc8655f94","resolution":{"observed_at":"2026-08-08T14:24:50.446116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.449690Z","title":"An illusion of progress? assessing the current state of web agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.449690Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:dc4ddbcab4c7e56e9463fa9b54f43636fb4474430205b763fabe51b847e6457b","observation_id":"b2c28686-933b-49a4-ad6b-4da85fece042","resolution":{"observed_at":"2026-08-08T14:24:50.449690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.01206","last_updated":"2023-02-08T01:39:30Z","snapshot_observed_at":"2026-07-06T13:27:22.300465Z","submitted_at":"2022-07-04T05:30:22Z","title":"WebShop: Towards Scalable Real-World Web Interaction with Grounded Language Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.01206","snapshot_observed_at":"2026-08-08T14:24:50.453058Z","title":"Webshop: Towards scalable real-world web interaction with grounded language agents, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.453058Z"},"links":{"cited_paper":"/paper/2207.01206","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:3b856621fe54911f3b7fafab42467ba827834168f22cdbe5e8cb3ef3884b3ea5","observation_id":"d0ef471f-fea3-455e-ad14-3d8b99bed1b8","resolution":{"observed_at":"2026-08-08T14:24:50.453058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10601","last_updated":"2023-12-03T22:50:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T23:16:17Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10601","snapshot_observed_at":"2026-08-08T14:24:50.456513Z","title":"Griffiths, Yuan Cao, and Karthik Narasimhan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.456513Z"},"links":{"cited_paper":"/paper/2305.10601","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:60bcb3160b7fdca621899f2400e4314ba153c0b3e61f89cf3038477d6565836a","observation_id":"acbe7994-16b6-4212-8d0f-8f4c6a3e901b","resolution":{"observed_at":"2026-08-08T14:24:50.456513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07496","last_updated":"2024-06-11T17:32:21Z","snapshot_observed_at":"2026-07-06T18:29:04.294349Z","submitted_at":"2024-06-11T17:32:21Z","title":"TextGrad: Automatic \"Differentiation\" via Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07496","snapshot_observed_at":"2026-08-08T14:24:50.460002Z","title":"differentiation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.460002Z"},"links":{"cited_paper":"/paper/2406.07496","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:abd654170f8509f115cd676beda7b54422f30d2553c87bee16b5ab769242546d","observation_id":"2510f647-cff4-4bc5-b7cb-2071f36393f2","resolution":{"observed_at":"2026-08-08T14:24:50.460002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12823","last_updated":"2023-10-22T16:19:16Z","snapshot_observed_at":"2026-08-07T22:31:11.195198Z","submitted_at":"2023-10-19T15:19:53Z","title":"AgentTuning: Enabling Generalized Agent Abilities for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12823","snapshot_observed_at":"2026-08-08T14:24:50.463527Z","title":"Agenttuning: Enabling generalized agent abilities for llms, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.463527Z"},"links":{"cited_paper":"/paper/2310.12823","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:a208e8249c8693c2237d4afafe8b84d932f4834b50d05c9894bd877ab7726556","observation_id":"97aee2eb-ff82-439a-8d43-3c209c1b7716","resolution":{"observed_at":"2026-08-08T14:24:50.463527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13771","last_updated":"2026-07-05T07:51:04Z","snapshot_observed_at":"2026-08-04T19:11:48.797552Z","submitted_at":"2023-12-21T11:52:45Z","title":"AppAgent: Multimodal Agents as Smartphone Users","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13771","snapshot_observed_at":"2026-08-08T14:24:50.466991Z","title":"Appagent: Multimodal agents as smartphone users, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.466991Z"},"links":{"cited_paper":"/paper/2312.13771","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:37ae517b9561c88f4775da3db94167b905b097efed50af9af12cff46abb7369c","observation_id":"3d2010d8-6618-476a-9996-5423180fbf08","resolution":{"observed_at":"2026-08-08T14:24:50.466991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15240","last_updated":"2025-02-22T10:21:46Z","snapshot_observed_at":"2026-07-06T19:06:41.697671Z","submitted_at":"2024-08-27T17:57:45Z","title":"Generative Verifiers: Reward Modeling as Next-Token Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15240","snapshot_observed_at":"2026-08-08T14:24:50.470275Z","title":"Generative verifiers: Reward modeling as next-token prediction, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.470275Z"},"links":{"cited_paper":"/paper/2408.15240","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:f569c1c8254a1c47364ae6ad6f57068cd307b7a30f4aa923bf773221291d74ff","observation_id":"bcceb7ae-022a-48ce-9579-cae963cd1bde","resolution":{"observed_at":"2026-08-08T14:24:50.470275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:24:50.473513Z","title":"Evaluation of openai o1: Opportunities and challenges of agi, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.473513Z"},"links":{"citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:93d05e2b300fde29a3aaf96e0ce628fcac119d8882572d088a3af1ec4f1a69d6","observation_id":"fb46c824-8ea4-407c-b44e-585b13b8234f","resolution":{"observed_at":"2026-08-08T14:24:50.473513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04406","last_updated":"2024-06-06T02:51:17Z","snapshot_observed_at":"2026-08-06T23:53:10.606737Z","submitted_at":"2023-10-06T17:55:11Z","title":"Language Agent Tree Search Unifies Reasoning Acting and Planning in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04406","snapshot_observed_at":"2026-08-08T14:24:50.477162Z","title":"Language agent tree search unifies reasoning acting and planning in language models, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.477162Z"},"links":{"cited_paper":"/paper/2310.04406","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:6fd0e2f87be84af04fbcebf7b34732b273283570aa61ee5c72bd2b4b27849e6e","observation_id":"07220155-d6cb-4580-83c9-87aaf38fee44","resolution":{"observed_at":"2026-08-08T14:24:50.477162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-08T14:24:50.480712Z","title":"Xu, Hao Zhu, Xuhui Zhou, Robert Lo, Abishek Sridhar, Xianyi Cheng, Tianyue Ou, Yonatan Bisk, Daniel Fried, Uri Alon, and Graham Neubig","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.480712Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:4f2be1bcff51f9b00cffde38c1d52f2b4cc9f0c29fdcf3f5c4876494a8825191","observation_id":"0cd18ca5-7ec3-4e6a-b14c-98211eedf41f","resolution":{"observed_at":"2026-08-08T14:24:50.480712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13194","last_updated":"2024-12-17T18:59:50Z","snapshot_observed_at":"2026-08-03T11:34:22.888935Z","submitted_at":"2024-12-17T18:59:50Z","title":"Proposer-Agent-Evaluator(PAE): Autonomous Skill Discovery For Foundation Model Internet Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13194","snapshot_observed_at":"2026-08-08T14:24:50.484160Z","title":"Proposer-agent-evaluator(pae): Autonomous skill discovery for foundation model internet agents, 2024 c","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.484160Z"},"links":{"cited_paper":"/paper/2412.13194","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:22965bc1b212ce5a39356e359e347c327c4fdffa024e31a93eb55a07561c669d","observation_id":"6a5421f1-b069-40e7-97eb-1429e6bd533f","resolution":{"observed_at":"2026-08-08T14:24:50.484160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 10 inbound Pith citation observations for arXiv:2502.06776."}