{"as_of":"2026-08-05T22:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:814532be33597578dcb3ee23029816b9eed26f648d65f6970a188d76e2e90e28","coverage":[{"denominator":90,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":90,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T10:13:58.774968Z","state":"measured"},{"denominator":170,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":170,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":80,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:03:39.391482Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":31,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-04T09:03:39.391482Z","title":"Ui-tars-2 technical report: Advancing gui agent with multi-turn reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17790","last_updated":"2026-05-26T11:29:37Z","snapshot_observed_at":"2026-08-04T09:03:36.135394Z","submitted_at":"2025-10-20T17:48:26Z","title":"UltraCUA: A Foundation Model for Computer Use Agents with Hybrid Action","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T09:03:39.391482Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2510.17790"},"observation_digest":"sha256:b4cb8f92ce094c57d3fb579fc2acb6f8a8f8e1bfaf603a7b98d46cca459ae2e3","observation_id":"22e84a3f-2680-4883-bcbe-c72e9efddaef","resolution":{"observed_at":"2026-08-04T09:03:39.391482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-03T17:30:52.482488Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.09706","last_updated":"2026-06-04T08:39:05Z","snapshot_observed_at":"2026-08-03T17:30:48.794017Z","submitted_at":"2025-12-10T14:52:29Z","title":"Training One Model to Master Cross-Level Agentic Actions via Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T17:30:52.482488Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2512.09706"},"observation_digest":"sha256:9f3b8fe08ab40bbe803e14fd6dcc43326b61d3b7c2193cf81ca07a8bfd218c83","observation_id":"2ec08c40-cb89-4650-908c-9bf4befba1d3","resolution":{"observed_at":"2026-08-03T17:30:52.482488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2512.10371","last_updated":"2026-05-08T09:40:02Z","snapshot_observed_at":"2026-07-06T22:38:40.044448Z","submitted_at":"2025-12-11T07:37:38Z","title":"AgentProg: Empowering Long-Horizon GUI Agents with Program-Guided Context Management","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T23:42:25.086602Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2512.10371"},"observation_digest":"sha256:968499220db41b862b1239d23c4b37061ec92eb60f38b31002a833affc6c353d","observation_id":"0c1bdfb4-9d4b-486d-8d94-bd7e8ec3c024","resolution":{"observed_at":"2026-05-16T23:43:42.332690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2601.18842","last_updated":"2026-05-13T07:11:36Z","snapshot_observed_at":"2026-08-01T18:25:13.403669Z","submitted_at":"2026-01-26T11:33:40Z","title":"GUIGuard-Bench: Toward a General Evaluation for Privacy-Preserving GUI Agents","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T11:31:16.087579Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2601.18842"},"observation_digest":"sha256:7aa2ce2891ff8a9c5f865a2afce59142581efb5704cbaab8d3a36155e7873700","observation_id":"3daea074-dd6b-45c1-b3b6-49926c3eb257","resolution":{"observed_at":"2026-05-16T11:32:48.323772Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2602.12430","last_updated":"2026-06-02T16:14:54Z","snapshot_observed_at":"2026-08-02T23:50:43.512282Z","submitted_at":"2026-02-12T21:33:25Z","title":"Agent Skills for Large Language Models: Architecture, Acquisition, Security, and the Path Forward","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T07:39:45.272421Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2602.12430"},"observation_digest":"sha256:29f3c2ab6cd37553ccb5faf704d75e40fa84051dcd7b91fe33b5dee449a3c92a","observation_id":"ec197a47-1211-4fa5-8657-ee18f9a693f0","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-02T23:50:45.688267Z","title":"UI-TARS-2 technical report: Advancing GUI agent with multi-turn reinforcement learning.arXiv preprint arXiv:2509.02544, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.12430","last_updated":"2026-06-02T16:14:54Z","snapshot_observed_at":"2026-08-02T23:50:43.512282Z","submitted_at":"2026-02-12T21:33:25Z","title":"Agent Skills for Large Language Models: Architecture, Acquisition, Security, and the Path Forward","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T23:50:45.688267Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2602.12430"},"observation_digest":"sha256:e1cb6af39bbe6b02a39a4e6a371fd3dc44a256bf13a7442ffe04560eb0d22ded","observation_id":"87a6a619-899d-40c3-8372-6c59c8a8604f","resolution":{"observed_at":"2026-08-02T23:50:45.688267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-02T20:51:44.108333Z","title":"Ui-tars-2 technical report: Advancing gui agent with multi-turn reinforcement learning, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-02T20:51:33.578240Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.108333Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:7da230680db6d94e6c50b6f81ffb8a9f0749b1fb4cc6a97f0c6a7259bc63ba85","observation_id":"3b732d0d-0c29-4eba-98fa-75812375cd22","resolution":{"observed_at":"2026-08-02T20:51:44.108333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2603.05295","last_updated":"2026-04-14T08:41:56Z","snapshot_observed_at":"2026-07-30T11:26:33.784873Z","submitted_at":"2026-03-05T15:37:34Z","title":"WebChain: A Large-Scale Human-Annotated Dataset of Real-World Web Interaction Traces","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T16:33:58.746944Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2603.05295"},"observation_digest":"sha256:515ff5d13181de982662f1ed179e58b723c57ab7ef9cd20bf8d09f1ca645f55d","observation_id":"716cf421-b31f-43c4-8004-eda73b532bb6","resolution":{"observed_at":"2026-05-15T16:36:17.512296Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2604.02345","last_updated":"2026-02-11T17:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-11T17:02:38Z","title":"UI-Oceanus: Scaling GUI Agents with Synthetic Environmental Dynamics","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-16T02:59:27.807789Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.02345"},"observation_digest":"sha256:99445d4e954a039bab8ea7cf3e8912d90840090292d7c23a8e57f15dc5f5b761","observation_id":"5e90e0a7-cdd2-4b50-82c6-f726033d0aa3","resolution":{"observed_at":"2026-05-16T03:00:31.594427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2604.07831","last_updated":"2026-04-09T05:32:34Z","snapshot_observed_at":"2026-08-02T13:15:13.204183Z","submitted_at":"2026-04-09T05:32:34Z","title":"Are GUI Agents Focused Enough? Automated Distraction via Semantic-level UI Element Injection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:27.373741Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.07831"},"observation_digest":"sha256:87a3cbfd0c250dc7dcc06a79bbfc51a8960508f8884e0e9ef6ad2112c12eb047","observation_id":"4cf683ed-4773-490d-8877-f19e112cd5a0","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2604.08516","last_updated":"2026-04-09T17:54:02Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:54:02Z","title":"MolmoWeb: Open Visual Web Agent and Open Data for the Open Web","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T18:00:34.401698Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.08516"},"observation_digest":"sha256:d8a5a7cc6c1300709fbc85de097ba449a7b54610aea1c77150aa9813de622560","observation_id":"c7c82b1d-a33a-4814-88b3-60366538fc15","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2604.09781","last_updated":"2026-06-29T09:07:17Z","snapshot_observed_at":"2026-07-12T23:07:19.301563Z","submitted_at":"2026-04-10T18:06:02Z","title":"Text-Guided 6D Object Pose Rearrangement via Closed-Loop VLM Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T16:55:48.506049Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.09781"},"observation_digest":"sha256:673a90cf34189063f3a777ffb8006fdaa35fe4ebf3fd9a58358be481d0a90d68","observation_id":"7a8887ca-c3ef-4cfa-a792-be6318c1445c","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-07-12T23:07:40.699400Z","title":"arXiv:2509.02544 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.09781","last_updated":"2026-06-29T09:07:17Z","snapshot_observed_at":"2026-07-12T23:07:19.301563Z","submitted_at":"2026-04-10T18:06:02Z","title":"Text-Guided 6D Object Pose Rearrangement via Closed-Loop VLM Agents","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-12T23:07:40.699400Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.09781"},"observation_digest":"sha256:86b61beeb0026dd4f3efe4ce9263dff97a40b58b3fa80d88376c5831b57ca584","observation_id":"6dae6368-e8a8-461c-a76d-aabaaf608fec","resolution":{"observed_at":"2026-07-12T23:07:40.699400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2604.13531","last_updated":"2026-04-15T06:27:49Z","snapshot_observed_at":"2026-07-06T23:01:32.542040Z","submitted_at":"2026-04-15T06:27:49Z","title":"RiskWebWorld: A Realistic Interactive Benchmark for GUI Agents in E-commerce Risk Management","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T13:40:55.540869Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.13531"},"observation_digest":"sha256:151812b6bbd05bb6ba415a0038e8709f8c9f61dcdea6fb2a499a112bdda78196","observation_id":"6d295fb4-bc6f-4f2d-9444-1cf534063f8f","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2604.17284","last_updated":"2026-04-19T06:55:59Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T06:55:59Z","title":"HalluClear: Diagnosing, Evaluating and Mitigating Hallucinations in GUI Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T06:27:19.717895Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.17284"},"observation_digest":"sha256:3d2aa9c91b682a43d4c861217bdb8b1aefe416262bbf914e2ca60f44f471f143","observation_id":"0644b139-8f8f-47ba-8ab0-173250a0fbf0","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2604.19750","last_updated":"2026-03-14T05:40:30Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-14T05:40:30Z","title":"Coding with Eyes: Visual Feedback Unlocks Reliable GUI Code Generating and Debugging","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T12:06:50.635891Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.19750"},"observation_digest":"sha256:df1357c9c799287f28f5029d4ebd153d3754700b6ec88efcce2e8f71bbae1a9b","observation_id":"3c4b806e-8a9e-47e4-bb89-f3e74a1cec06","resolution":{"observed_at":"2026-05-15T12:09:59.957333Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2604.20279","last_updated":"2026-04-23T03:36:10Z","snapshot_observed_at":"2026-08-03T04:18:43.851801Z","submitted_at":"2026-04-22T07:27:21Z","title":"AgentLens: Adaptive Visual Modalities for Human-Agent Interaction in Mobile GUI Agents","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-09T23:58:12.704566Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.20279"},"observation_digest":"sha256:bbeb811b09a25ccd38da8b9e7062b0809280b60939e47995c63069fa625891e4","observation_id":"ed4adf55-a94e-4a39-9156-6a7395238083","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2604.21375","last_updated":"2026-04-24T17:01:08Z","snapshot_observed_at":"2026-08-02T05:47:52.335425Z","submitted_at":"2026-04-23T07:42:37Z","title":"VLAA-GUI: Knowing When to Stop, Recover, and Search, A Modular Framework for GUI Automation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-09T22:24:45.045405Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.21375"},"observation_digest":"sha256:06ffbbf24cbc977630d89a617d2b573a237b74a011b556d03b48279780961caf","observation_id":"e9d3e4ba-ebca-4457-8ea2-1a355c1042ba","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-07-12T18:39:55.906516Z","title":"Ui-tars-2 technical report: Advancing gui agent with multi-turn reinforcement learning.arXiv preprint arXiv:2509.02544, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.21405","last_updated":"2026-07-08T08:18:54Z","snapshot_observed_at":"2026-07-12T18:39:55.261528Z","submitted_at":"2026-04-23T08:20:42Z","title":"Supermassive Black Hole Winds in X-rays: SUBWAYS IV. Tracing Radio Emission and Unveiling the Role of Winds","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T18:39:55.906516Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.21405"},"observation_digest":"sha256:34b973f6aecd645ecb0222c162d8783082059cb5278b75ce0fcbd934fbc5184f","observation_id":"587f851c-727f-4d67-b961-4fcd22577b0e","resolution":{"observed_at":"2026-07-12T18:39:55.906516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2604.21409","last_updated":"2026-04-23T08:23:25Z","snapshot_observed_at":"2026-08-03T14:07:48.355881Z","submitted_at":"2026-04-23T08:23:25Z","title":"S1-VL: Scientific Multimodal Reasoning Model with Thinking-with-Images","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-09T22:26:03.080281Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.21409"},"observation_digest":"sha256:5c9b8e79bb4dff7c58d5cbe56db48152ed1e50ba872aab2aec2bb3fc4c2ab89a","observation_id":"a5b68a6b-ce38-455e-858e-e8846c863f11","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2604.25562","last_updated":"2026-04-28T12:32:21Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:32:21Z","title":"SnapGuard: Lightweight Prompt Injection Detection for Screenshot-Based Web Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-07T15:48:28.869796Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.25562"},"observation_digest":"sha256:6ea2d006dcc9a3331f889bf59a677993dd5c4b9d73c5a11cd3f6eee8df5c4669","observation_id":"83e4936c-8eb8-448e-b159-49288ca75470","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2604.27955","last_updated":"2026-04-30T14:51:49Z","snapshot_observed_at":"2026-07-06T23:13:20.516759Z","submitted_at":"2026-04-30T14:51:49Z","title":"GUI Agents with Reinforcement Learning: Toward Digital Inhabitants","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-07T05:48:00.486572Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2604.27955"},"observation_digest":"sha256:05e2878a6f9fccc1538ae1dc3fd3e1c7b76ffbad8390bc9e1ee9cafee7c98f6f","observation_id":"19542d3e-4b13-4b8f-a200-85ec055f4c5e","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.01208","last_updated":"2026-05-02T02:54:36Z","snapshot_observed_at":"2026-07-06T23:14:29.125042Z","submitted_at":"2026-05-02T02:54:36Z","title":"Faithful Mobile GUI Agents with Guided Advantage Estimator","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T15:17:05.477466Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.01208"},"observation_digest":"sha256:87d14b0c34af28e328f99ab1698e5fe45a5045e964d0c5171f9bc95e63ab1a9c","observation_id":"28557078-8ceb-4463-bd2b-e378c8b9bf24","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.02572","last_updated":"2026-05-04T13:25:05Z","snapshot_observed_at":"2026-07-06T23:15:37.099197Z","submitted_at":"2026-05-04T13:25:05Z","title":"On Training Large Language Models for Long-Horizon Tasks: An Empirical Study of Horizon Length","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-08T18:13:25.735085Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.02572"},"observation_digest":"sha256:9544c0a64bcfc36f853eca172f546ca2f280e21488f70a7524d432cde3c596ca","observation_id":"274bd553-e222-4cc3-b0f2-3d7c3119970b","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.06761","last_updated":"2026-05-07T17:17:10Z","snapshot_observed_at":"2026-07-06T23:19:10.574595Z","submitted_at":"2026-05-07T17:17:10Z","title":"Weblica: Scalable and Reproducible Training Environments for Visual Web Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-11T01:25:44.578007Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.06761"},"observation_digest":"sha256:2a845e1b48e8dffde1f0117180f4831b287841cda5d5003856abe21267e90d3a","observation_id":"622f0497-0040-41a1-8772-6d8f62d32762","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.07110","last_updated":"2026-05-08T01:38:46Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:38:46Z","title":"Securing Computer-Use Agents: A Unified Architecture-Lifecycle Framework for Deployment-Grounded Reliability","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-11T01:15:19.239355Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.07110"},"observation_digest":"sha256:0f25c20a00bba469e9aac627a6f1cb1bc28aa235ecd9da50a822867865f48d26","observation_id":"c4adde78-d67f-45b1-a84f-34f959825199","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.08978","last_updated":"2026-05-12T02:23:49Z","snapshot_observed_at":"2026-07-31T07:00:51.285601Z","submitted_at":"2026-05-09T14:44:18Z","title":"Learning to Explore: Scaling Agentic Reasoning via Exploration-Aware Policy Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T03:00:01.549385Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.08978"},"observation_digest":"sha256:935d2c6788d63d102e6b78de6303f05075c4c45cb410af5d9f4de619229e2065","observation_id":"689b7449-db70-4b29-abb6-4629f00329df","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.08978","last_updated":"2026-05-12T02:23:49Z","snapshot_observed_at":"2026-07-31T07:00:51.285601Z","submitted_at":"2026-05-09T14:44:18Z","title":"Learning to Explore: Scaling Agentic Reasoning via Exploration-Aware Policy Optimization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T00:58:25.205386Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.08978"},"observation_digest":"sha256:d9295a17648e73c4a85b93186f00f3bc5609ff0f82261cb43b3100e853ea116c","observation_id":"26176fcb-ca42-42e7-a80a-b631adf5a1b6","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.09965","last_updated":"2026-05-12T15:54:46Z","snapshot_observed_at":"2026-07-06T23:21:59.096464Z","submitted_at":"2026-05-11T04:16:41Z","title":"Towards Generalist Game Players: An Investigation of Foundation Models in the Game Multiverse","version":1},"reference_index":176,"source":"pdf_text","source_observed_at":"2026-05-12T03:25:24.844859Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.09965"},"observation_digest":"sha256:64d7ef7c4fa50a34d899bbd18044a7a6b7abf48042a200c5cb12d3452ea5025e","observation_id":"776e3726-0ad3-41da-8ae9-acf41f2fbc81","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.09965","last_updated":"2026-05-12T15:54:46Z","snapshot_observed_at":"2026-07-06T23:21:59.096464Z","submitted_at":"2026-05-11T04:16:41Z","title":"Towards Generalist Game Players: An Investigation of Foundation Models in the Game Multiverse","version":2},"reference_index":176,"source":"pdf_text","source_observed_at":"2026-05-13T06:44:28.552513Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.09965"},"observation_digest":"sha256:ee7508ebbb9b59fd7849e60a3ca1202345edd861dc29615a94767ef36dec04d5","observation_id":"f3a1372f-0a50-43d6-9f27-512be323ea65","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.10347","last_updated":"2026-05-22T05:43:30Z","snapshot_observed_at":"2026-07-06T23:22:18.704329Z","submitted_at":"2026-05-11T10:49:31Z","title":"How Mobile World Model Guides GUI Agents?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T04:28:34.562344Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.10347"},"observation_digest":"sha256:b01cbb9154a08faa37c3cb8742c07f022484198a12aa760df0b943518e5db660","observation_id":"64dcf418-87f0-4cbe-b885-64871c049ceb","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.10347","last_updated":"2026-05-22T05:43:30Z","snapshot_observed_at":"2026-07-06T23:22:18.704329Z","submitted_at":"2026-05-11T10:49:31Z","title":"How Mobile World Model Guides GUI Agents?","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T06:00:34.560405Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.10347"},"observation_digest":"sha256:ebad499141e84e63a40078a3c15b81dfff9dbeac661b8d8e647e90893dcd6523","observation_id":"bb1fa078-1b11-4f65-86f6-2df62fbdbb15","resolution":{"observed_at":"2026-05-25T06:05:27.283138Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.11212","last_updated":"2026-06-05T22:18:46Z","snapshot_observed_at":"2026-07-06T23:23:06.755816Z","submitted_at":"2026-05-11T20:27:54Z","title":"ReVision: Scaling Computer-Use Agents via Temporal Visual Redundancy Reduction","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-13T02:12:42.449883Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.11212"},"observation_digest":"sha256:647324d0c7af6035e41a7548e7ad2fb960ecdf31bfc8fb8d9afcd55ef39e3d5a","observation_id":"1b07ec9d-ecdd-4142-a904-4399555431db","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.11212","last_updated":"2026-06-05T22:18:46Z","snapshot_observed_at":"2026-07-06T23:23:06.755816Z","submitted_at":"2026-05-11T20:27:54Z","title":"ReVision: Scaling Computer-Use Agents via Temporal Visual Redundancy Reduction","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-14T20:56:56.216287Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.11212"},"observation_digest":"sha256:ec5597728dec500b2dca00c81492ad5482ce0a2d0aac13d0cd03c2082f1c0b68","observation_id":"e4074840-7a5e-41ed-b3e3-b55e3f173dec","resolution":{"observed_at":"2026-05-14T20:57:59.129990Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.11223","last_updated":"2026-05-11T20:33:48Z","snapshot_observed_at":"2026-07-06T23:23:06.755816Z","submitted_at":"2026-05-11T20:33:48Z","title":"Do Vision-Language-Models show human-like logical problem-solving capability in point and click puzzle games?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-13T01:58:39.476408Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.11223"},"observation_digest":"sha256:1d69fe969d966fa476d46c4e433f2c063e55a88cfb1c35a2767928b352d64286","observation_id":"cbb15daf-f61a-4bc9-9529-53a8572cd99b","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.12481","last_updated":"2026-05-12T17:57:04Z","snapshot_observed_at":"2026-07-06T23:24:08.763444Z","submitted_at":"2026-05-12T17:57:04Z","title":"ToolCUA: Towards Optimal GUI-Tool Path Orchestration for Computer Use Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T03:51:54.401200Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.12481"},"observation_digest":"sha256:215dee1052b799e5f982aed8e529e92d2a5aafaff466b0367eb34a2dab5e06ea","observation_id":"fa28f032-804b-43a1-8fe3-277d565b71ee","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.12501","last_updated":"2026-05-12T17:59:58Z","snapshot_observed_at":"2026-08-02T22:39:49.566685Z","submitted_at":"2026-05-12T17:59:58Z","title":"Covering Human Action Space for Computer Use: Data Synthesis and Benchmark","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T05:18:23.310925Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.12501"},"observation_digest":"sha256:ce5ec0bc9b5986490c614b55b992e35d88280f1c6bd2eac7c326d6c8efafebe3","observation_id":"c64de1d5-80ae-44a1-a6d5-82e1bc2feb51","resolution":{"observed_at":"2026-05-13T10:13:59.321363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.14311","last_updated":"2026-05-15T06:09:21Z","snapshot_observed_at":"2026-07-06T23:25:44.508166Z","submitted_at":"2026-05-14T03:23:44Z","title":"Beyond Binary: Reframing GUI Critique as Continuous Semantic Alignment","version":1},"reference_index":110,"source":"arxiv_source","source_observed_at":"2026-05-15T01:58:19.295247Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.14311"},"observation_digest":"sha256:689870f54ccbfaf526acdcc430a0c13c5e357c6bdf3151cdbf1b3d95375345f0","observation_id":"430a40b0-0bcd-4b6b-830b-a34a521b90d5","resolution":{"observed_at":"2026-05-15T01:58:28.795280Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.14311","last_updated":"2026-05-15T06:09:21Z","snapshot_observed_at":"2026-07-06T23:25:44.508166Z","submitted_at":"2026-05-14T03:23:44Z","title":"Beyond Binary: Reframing GUI Critique as Continuous Semantic Alignment","version":2},"reference_index":110,"source":"arxiv_source","source_observed_at":"2026-05-19T16:45:16.963802Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.14311"},"observation_digest":"sha256:ab9dc21a0c2583a827fc16dee42b9b6c750d5fbd04225d956c67bcb07594ebe8","observation_id":"fb8f7c68-e46d-4557-ba54-0414c7fbbde8","resolution":{"observed_at":"2026-05-19T16:47:40.395327Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.15030","last_updated":"2026-05-14T16:26:27Z","snapshot_observed_at":"2026-07-06T23:26:23.179482Z","submitted_at":"2026-05-14T16:26:27Z","title":"WARD: Adversarially Robust Defense of Web Agents Against Prompt Injections","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-30T20:16:13.413064Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.15030"},"observation_digest":"sha256:b3b0ce3674a8299dfdca8432e36dd7664c2e55185e92bab891ba419f38bc73ad","observation_id":"e3bc0aec-27b4-4b2f-9c0f-42bb85553c82","resolution":{"observed_at":"2026-07-01T14:45:49.512095Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.16402","last_updated":"2026-05-13T02:48:52Z","snapshot_observed_at":"2026-07-06T23:27:34.514541Z","submitted_at":"2026-05-13T02:48:52Z","title":"WinDeskGround: A Benchmark for Robust GUI Grounding in Complex Multi-Window Desktop Environments","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T22:17:22.560632Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.16402"},"observation_digest":"sha256:52e6805a296445a2af4f5e206e03810fe86d0dc526dca66fc52a4ee578bf2f8c","observation_id":"a7e987ca-5414-4fc1-8154-2366ddbe870c","resolution":{"observed_at":"2026-05-20T22:19:07.600603Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.16883","last_updated":"2026-05-16T08:51:57Z","snapshot_observed_at":"2026-08-03T03:43:27.806285Z","submitted_at":"2026-05-16T08:51:57Z","title":"SE-GA: Memory-Augmented Self-Evolution for GUI Agents","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-19T20:38:37.264654Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.16883"},"observation_digest":"sha256:335b679273b715e1eee6caa3e6bafcf2ef9cbe8886cdb4d925e058394ae5d4b1","observation_id":"7a7ce9c3-5de4-4de5-a7e0-c99cb9ead3fa","resolution":{"observed_at":"2026-05-19T20:42:46.390420Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":226,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:388fb8ea3f3a6926fb17e8ce1b605f4ee2663b10802483c534b3f5f78a5b19a4","observation_id":"2538ddc5-c0bd-4865-8ea8-b9e11477b1c0","resolution":{"observed_at":"2026-05-20T10:58:14.520774Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.19352","last_updated":"2026-05-19T04:40:14Z","snapshot_observed_at":"2026-07-06T23:30:06.876413Z","submitted_at":"2026-05-19T04:40:14Z","title":"Brain alignment of reasoning and action representations from vision-language and action models during naturalistic gameplay","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T02:42:24.746442Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.19352"},"observation_digest":"sha256:c0c94e39c9f02512f33d41128ac8952d2b5340b98e4f8d1ab20a9f026454fe26","observation_id":"b7d9a004-dcaa-48ac-93e6-a0b34ee58850","resolution":{"observed_at":"2026-05-20T02:42:59.307518Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.19538","last_updated":"2026-05-19T08:38:44Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T08:38:44Z","title":"CaptchaMind: Training CAPTCHA Solvers via Reinforcement Learning with Explicit Reasoning Supervision","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-20T06:14:43.288597Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.19538"},"observation_digest":"sha256:9588a10d59627a4195f5d8d90906821c3f1cf9c4f46a268bd3ecdf2bbcd8411d","observation_id":"528f3253-1bbd-4475-b670-7e364a09efa8","resolution":{"observed_at":"2026-05-20T06:18:05.543191Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.24785","last_updated":"2026-05-26T04:25:32Z","snapshot_observed_at":"2026-08-01T11:48:24.416936Z","submitted_at":"2026-05-24T00:07:25Z","title":"PANDO: Efficient Multimodal AI Agents via Online Skill Distillation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T12:02:31.227405Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.24785"},"observation_digest":"sha256:dc6080e171cfcf13b3b2336d45458ed7106e0e5581acd52a004347a341f9c271","observation_id":"68497067-71c7-424c-9026-714cd0cb1ecf","resolution":{"observed_at":"2026-06-30T12:04:38.748410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.25624","last_updated":"2026-06-08T08:32:35Z","snapshot_observed_at":"2026-08-04T20:10:29.546282Z","submitted_at":"2026-05-25T09:28:03Z","title":"CUA-Gym: Scaling Verifiable Training Environments and Tasks for Computer-Use Agents","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T21:40:36.033696Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.25624"},"observation_digest":"sha256:c7945b5629125f1a50c4a696b5382088453d53dc6409a01d50a84d93b7e4e9fa","observation_id":"ce3ba494-d484-4fee-88ff-f4734119a684","resolution":{"observed_at":"2026-06-29T21:43:59.220893Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.26546","last_updated":"2026-05-26T04:53:53Z","snapshot_observed_at":"2026-08-04T03:38:32.486589Z","submitted_at":"2026-05-26T04:53:53Z","title":"MobileExplorer: Accelerating On-Device Inference for Mobile GUI Agents via Online Exploration","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T18:33:42.199405Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.26546"},"observation_digest":"sha256:190b640a59b5fb27645b71b65c2dff7fad7702991c543b29f949685b3d16ec35","observation_id":"1f334b2d-df65-4715-a031-ddf6748762e2","resolution":{"observed_at":"2026-06-29T18:33:50.068791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.28732","last_updated":"2026-07-16T08:06:40Z","snapshot_observed_at":"2026-08-02T12:58:35.077880Z","submitted_at":"2026-05-27T16:53:53Z","title":"MemTrace: Tracing and Attributing Errors in Large Language Model Memory Systems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T12:25:26.177071Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.28732"},"observation_digest":"sha256:07c628f23a42e93c4fab913aa96d3871af812d46694b483dd67c7f807b86fb74","observation_id":"ae8ed666-5841-47ba-a8c6-d33d333b113f","resolution":{"observed_at":"2026-06-29T12:33:24.884989Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-02T12:58:48.617757Z","title":"InThe Twelfth International Conference on Learning Representations, ICLR 2024, Vienna, Austria, May 7-11, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28732","last_updated":"2026-07-16T08:06:40Z","snapshot_observed_at":"2026-08-02T12:58:35.077880Z","submitted_at":"2026-05-27T16:53:53Z","title":"MemTrace: Tracing and Attributing Errors in Large Language Model Memory Systems","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T12:58:48.617757Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.28732"},"observation_digest":"sha256:2d4fddcc0c33c804c6940f46421ee759c9b3ea8f171bcb87565f9aa37da283a4","observation_id":"4dd3407a-b8e7-4496-be85-87767697246d","resolution":{"observed_at":"2026-08-02T12:58:48.617757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.28775","last_updated":"2026-05-27T17:37:00Z","snapshot_observed_at":"2026-07-06T23:38:19.096349Z","submitted_at":"2026-05-27T17:37:00Z","title":"Learn from Weaknesses: Automated Domain Specialization for Small Computer-Use Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T14:15:55.180284Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.28775"},"observation_digest":"sha256:a91d5bf3de4f79b8ecda709ed21862c407ade6b4463a22910ec6a424e5449ff1","observation_id":"80d68cab-5d84-4325-be18-4c6757b14be5","resolution":{"observed_at":"2026-06-29T14:23:30.866947Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2605.29486","last_updated":"2026-05-28T07:14:15Z","snapshot_observed_at":"2026-07-06T23:38:56.014434Z","submitted_at":"2026-05-28T07:14:15Z","title":"PhoneWorld: Scaling Phone-Use Agent Environments","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T07:41:20.001845Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2605.29486"},"observation_digest":"sha256:a59784b51d13e712ad75efb63b50002349461235f8cd3acf602a3fd1c8045ac5","observation_id":"187d3462-8be0-4600-ac16-127bbdd1bff8","resolution":{"observed_at":"2026-06-29T07:43:13.439917Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.01936","last_updated":"2026-06-01T09:02:33Z","snapshot_observed_at":"2026-07-06T23:42:26.018647Z","submitted_at":"2026-06-01T09:02:33Z","title":"What to Format and How: A Benchmark and Workflow Approach for Document Formatting","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-28T14:21:53.716738Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.01936"},"observation_digest":"sha256:0bf40654d025f58ef4f0cc5e79ab25f4c19d500411d69994fa58fc0c2e1d9279","observation_id":"a834332c-8069-405b-9012-3c03c1f089ba","resolution":{"observed_at":"2026-07-01T23:26:22.665054Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.02031","last_updated":"2026-06-04T09:03:30Z","snapshot_observed_at":"2026-08-03T02:24:10.083746Z","submitted_at":"2026-06-01T10:20:10Z","title":"OpenWebRL: Demystifying Online Multi-turn Reinforcement Learning for Visual Web Agents","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T15:46:50.587684Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.02031"},"observation_digest":"sha256:f624f1859536d96366fa4425c57ece9287065f608fa86c910b43e40611384a96","observation_id":"a813d14d-4c60-4e1e-8b10-d9d48d09dc68","resolution":{"observed_at":"2026-07-01T22:06:16.448597Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.03951","last_updated":"2026-06-02T17:39:07Z","snapshot_observed_at":"2026-08-03T02:09:58.081901Z","submitted_at":"2026-06-02T17:39:07Z","title":"Demo2Tutorial: From Human Experience to Multimodal Software Tutorials","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T10:33:26.954959Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.03951"},"observation_digest":"sha256:8d913f609de7f3b6d2dbd6f0c8f2b852813bdc2d552e408f4270aaeaace5fb47","observation_id":"207b66e6-4f6d-4c6f-a11a-d052bbde2d00","resolution":{"observed_at":"2026-07-02T02:56:28.739173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.05597","last_updated":"2026-06-08T19:54:19Z","snapshot_observed_at":"2026-08-02T12:57:05.056812Z","submitted_at":"2026-06-04T02:18:44Z","title":"AsyncWebRL: Efficient Multi-Step RL for Visual Web Agents","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-28T02:45:25.694378Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.05597"},"observation_digest":"sha256:b262b2f895b7dea613ea8866dcc45036365e89eddfccbd3ed01768ba1a76d3d2","observation_id":"8be8acd6-2d8b-4747-bf27-bdfbdde802f6","resolution":{"observed_at":"2026-07-02T11:56:55.509350Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.05622","last_updated":"2026-07-09T05:22:20Z","snapshot_observed_at":"2026-08-02T06:02:59.494890Z","submitted_at":"2026-06-04T02:47:29Z","title":"AdaPlanBench: Evaluating Adaptive Planning in Large Language Model Agents under World and User Constraints","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.05622"},"observation_digest":"sha256:a08f2924f3638b0531f03d8c1ff5174f50be020f8b5ee227b09e0ae3a3849361","observation_id":"2b7e993e-1c70-442c-a279-94e2834f144f","resolution":{"observed_at":"2026-06-28T01:51:29.260143Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-07-12T15:06:31.394162Z","title":"Huaxiaoyue Wang, Nathaniel Chin, Gonzalo Gonzalez-Pumariega, Xiangwan Sun, Neha Sunkara, Maximus Adrian Pace, Jeannette Bohg, and Sanjiban Choudhury","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05622","last_updated":"2026-07-09T05:22:20Z","snapshot_observed_at":"2026-08-02T06:02:59.494890Z","submitted_at":"2026-06-04T02:47:29Z","title":"AdaPlanBench: Evaluating Adaptive Planning in Large Language Model Agents under World and User Constraints","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T15:06:31.394162Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.05622"},"observation_digest":"sha256:3ad8d30a13073a76bd7fdf388905374fe2e094ca111c2fd3f67fbccfcfd3d292","observation_id":"b164bc1c-f59b-4dec-a95d-359f19b60087","resolution":{"observed_at":"2026-07-12T15:06:31.394162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.06322","last_updated":"2026-06-04T15:57:29Z","snapshot_observed_at":"2026-08-02T19:13:51.313136Z","submitted_at":"2026-06-04T15:57:29Z","title":"DragOn: A Benchmark and Dataset for Drag-Based GUI Interactions","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-28T01:37:45.812577Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.06322"},"observation_digest":"sha256:ded413a39a3fc66edfee68adc3f83c9660b2cba93104cfbfe3e5c07b201380ee","observation_id":"8dbee079-90b8-42c5-9699-dfde25b82da4","resolution":{"observed_at":"2026-06-28T01:41:29.394778Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.07027","last_updated":"2026-06-05T08:17:28Z","snapshot_observed_at":"2026-08-01T08:01:00.499508Z","submitted_at":"2026-06-05T08:17:28Z","title":"StainFlow: Entity-Stain Tracking and Evidence Linking for Process Rewards in GUI Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T22:24:41.353303Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.07027"},"observation_digest":"sha256:8c1639c4d9f5f39d81180f6bac600bfead183da3d90c214bef17c5838c336d19","observation_id":"61b87412-0c23-4e34-ba98-37a358088fd5","resolution":{"observed_at":"2026-07-02T16:47:09.711345Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.09447","last_updated":"2026-06-08T12:55:42Z","snapshot_observed_at":"2026-07-06T23:48:48.962930Z","submitted_at":"2026-06-08T12:55:42Z","title":"AliyunConsoleAgent: Training Web Agents in Real-World Cloud Environments via Distillation and Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T16:22:05.424293Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.09447"},"observation_digest":"sha256:b4b8079131349d2bdc0b7af4a96d9cdffaf08a28326d2ee9b23cf9a1f93147bb","observation_id":"b7733ab8-6c72-41d3-afda-9fcf7eb762aa","resolution":{"observed_at":"2026-07-03T01:47:31.132295Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.09669","last_updated":"2026-06-08T15:51:51Z","snapshot_observed_at":"2026-08-02T20:17:41.727375Z","submitted_at":"2026-06-08T15:51:51Z","title":"SpatialWorld: Benchmarking Interactive Spatial Reasoning of Multimodal Agents in Real-World Tasks","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-27T16:35:14.099586Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.09669"},"observation_digest":"sha256:1ac7d02530506ccbe90c8cf1dadfd079e63b2b1a02bea6711436c0dedded7f60","observation_id":"3b536508-5ced-4349-901c-1d1cfa4170e4","resolution":{"observed_at":"2026-07-03T01:27:30.662721Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.11042","last_updated":"2026-06-09T16:10:16Z","snapshot_observed_at":"2026-07-06T23:50:11.160843Z","submitted_at":"2026-06-09T16:10:16Z","title":"Workflow-GYM: Towards Long-Horizon Evaluation of Computer-use Agentic tasks in Real-World Professional Fields","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T13:28:05.021411Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.11042"},"observation_digest":"sha256:ec1225e97f2e51f74da41f8ec2f88aa827621fbb6ec53fc61128d6186072ddce","observation_id":"4b4a3584-ce2e-4e57-af1c-679cc85e6fd8","resolution":{"observed_at":"2026-07-03T05:07:38.654126Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.19388","last_updated":"2026-06-16T02:36:22Z","snapshot_observed_at":"2026-07-06T23:54:41.980696Z","submitted_at":"2026-06-16T02:36:22Z","title":"Beyond the GUI Paradigm: Do Mobile Agents Need the Phone Screen?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T00:23:37.068764Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.19388"},"observation_digest":"sha256:4f20cf797c76e851a0a7280f7ab801b3a8582881a26d9a2992395f232dfbe499","observation_id":"edde6dd7-3a4d-4390-bcbc-b06f366838ab","resolution":{"observed_at":"2026-07-03T21:38:58.305205Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.21654","last_updated":"2026-06-19T18:00:14Z","snapshot_observed_at":"2026-08-04T06:52:55.694202Z","submitted_at":"2026-06-19T18:00:14Z","title":"ChainWorld: Composing Long-Horizon Desktop Workloads from Atomic OSWorld Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T14:05:28.423719Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.21654"},"observation_digest":"sha256:940b3e82ce8c31d4d3f932dbd16474ee8c78790b2791b0a5d27b35f9b6d9f6f8","observation_id":"f42e3eb9-715c-4ca7-a37f-780200ad97ba","resolution":{"observed_at":"2026-07-04T06:49:38.859596Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.23049","last_updated":"2026-06-24T02:20:35Z","snapshot_observed_at":"2026-07-06T23:57:53.101659Z","submitted_at":"2026-06-22T08:57:54Z","title":"PhoneBuddy: Training Open Models for Agentic Phone Use","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-06-26T08:15:49.428124Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.23049"},"observation_digest":"sha256:b078af8cec445ffdc4dd25ee1453dceb6cc20e4a88e0015c6fcb5e12b6442c9d","observation_id":"8b64f3ab-5de9-4220-883e-507c9005d6c8","resolution":{"observed_at":"2026-07-04T10:59:46.445801Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.28514","last_updated":"2026-06-26T18:09:36Z","snapshot_observed_at":"2026-07-07T00:02:33.644076Z","submitted_at":"2026-06-26T18:09:36Z","title":"GPTNT: Benchmarking Real-Time Collaboration Between Multimodal Agents on Keep Talking And Nobody Explodes","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.28514"},"observation_digest":"sha256:539f13c99b3ba55baad2b7c94ecc6248d1d210e7422223d0e19572d0a05a8110","observation_id":"12934652-4122-4f44-b0b1-fe64b0bcd911","resolution":{"observed_at":"2026-06-30T01:44:09.321015Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.29472","last_updated":"2026-06-28T15:59:31Z","snapshot_observed_at":"2026-08-01T16:45:40.105247Z","submitted_at":"2026-06-28T15:59:31Z","title":"Agent-Computer Observation Interfaces Enable Dynamic Computer Use","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T06:59:20.295818Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.29472"},"observation_digest":"sha256:33a7fca3519b6e7d2eb271cf76e852911149d9b8d075f1e2fb4d05c1989c9dde","observation_id":"4a0bb389-216f-4111-b4a6-2e1f9a323639","resolution":{"observed_at":"2026-06-30T07:04:21.282341Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.29537","last_updated":"2026-07-13T10:30:17Z","snapshot_observed_at":"2026-07-17T23:18:06.822637Z","submitted_at":"2026-06-28T17:59:17Z","title":"OSWorld 2.0: Benchmarking Computer Use Agents on Long-Horizon Real-World Tasks","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-30T07:10:38.909339Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.29537"},"observation_digest":"sha256:a93e63acbe64af01c78f08fd886adf0c1762a0ddb33993ffcf7258830891f0d5","observation_id":"42d9e712-ea09-4402-bf03-080fd076cd74","resolution":{"observed_at":"2026-06-30T07:14:21.222921Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-07-15T10:24:53.345620Z","title":"UI-TARS-2 technical report: Advancing GUI agent with multi-turn reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29537","last_updated":"2026-07-13T10:30:17Z","snapshot_observed_at":"2026-07-17T23:18:06.822637Z","submitted_at":"2026-06-28T17:59:17Z","title":"OSWorld 2.0: Benchmarking Computer Use Agents on Long-Horizon Real-World Tasks","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-15T10:24:53.345620Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.29537"},"observation_digest":"sha256:ee0002ee795311a801a417e70656073b34097cefbd34acb6813e09738e7023d7","observation_id":"dacf9851-5ddc-4f1e-938f-8d69895c8b3b","resolution":{"observed_at":"2026-07-15T10:24:53.345620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.29705","last_updated":"2026-06-29T02:16:21Z","snapshot_observed_at":"2026-08-01T21:20:53.464369Z","submitted_at":"2026-06-29T02:16:21Z","title":"GUICrafter: Weakly-Supervised GUI Agent Leveraging Massive Unannotated Screenshots","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T06:39:12.591090Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.29705"},"observation_digest":"sha256:28117330d37ebf864cd818d565d26bc843f5a164682378354cadb42c68b6930d","observation_id":"06b788bd-9d91-427d-8e49-dff4d90a12af","resolution":{"observed_at":"2026-06-30T06:44:19.210310Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.30084","last_updated":"2026-06-29T10:20:39Z","snapshot_observed_at":"2026-08-05T10:34:24.326234Z","submitted_at":"2026-06-29T10:20:39Z","title":"One Forward Beats Two: InnerZoom for Accurate and Efficient GUI Grounding","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-06-30T06:58:01.734975Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.30084"},"observation_digest":"sha256:46b6688ea9b2420ce09762ef2411462da25b1277716acac846ef53f980d170b3","observation_id":"bfa6bb6d-0d89-4410-8ef1-ccbada18e4f0","resolution":{"observed_at":"2026-06-30T07:04:21.757698Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.31410","last_updated":"2026-07-01T03:59:21Z","snapshot_observed_at":"2026-07-07T00:05:07.912609Z","submitted_at":"2026-06-30T09:36:35Z","title":"Xiaomi-GUI-0 Technical Report","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-01T06:07:48.137351Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.31410"},"observation_digest":"sha256:b0b7b34f0e6ad2bd543e9e824b62db290636fcd2378d203eb7f5dbf38b20cdb9","observation_id":"6f5dbbed-4510-4e5f-9b7c-f65b47514306","resolution":{"observed_at":"2026-07-01T09:55:40.316053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.31410","last_updated":"2026-07-01T03:59:21Z","snapshot_observed_at":"2026-07-07T00:05:07.912609Z","submitted_at":"2026-06-30T09:36:35Z","title":"Xiaomi-GUI-0 Technical Report","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-02T19:37:49.661596Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.31410"},"observation_digest":"sha256:83cc7176461da78f6911d3839f7f67af51ec35cde671d93ed3d8c723b5e98ca4","observation_id":"662f5640-c0f2-4a86-bb35-3ed66badfccd","resolution":{"observed_at":"2026-07-02T19:47:18.996918Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.31612","last_updated":"2026-07-02T06:42:39Z","snapshot_observed_at":"2026-08-02T11:25:34.061644Z","submitted_at":"2026-06-30T13:01:19Z","title":"What Memory Do GUI Agents Really Need? From Passive Records to Active Task-Driving States","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-07-01T05:26:53.441833Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.31612"},"observation_digest":"sha256:6f23bef07ad66ab972501f3a87bf6c6bc9deb8c4c51fd0094d3770df4b9403b4","observation_id":"698230d0-796e-4c86-8307-9caf40dc4127","resolution":{"observed_at":"2026-07-01T10:25:42.425459Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.02544","doi":"10.1037/xlm0000535","metadata_source":"pith","pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","venue":"cs.AI","work_id":"422846c6-e6e2-47c9-9065-85cc09c07cd6","year":2025},"citing_paper":{"arxiv_id":"2606.31612","last_updated":"2026-07-02T06:42:39Z","snapshot_observed_at":"2026-08-02T11:25:34.061644Z","submitted_at":"2026-06-30T13:01:19Z","title":"What Memory Do GUI Agents Really Need? From Passive Records to Active Task-Driving States","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-07-03T22:03:26.625209Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2606.31612"},"observation_digest":"sha256:945474ca56375aa2069747e3d1006f288d72b4708afa9725c78be49743e5c58d","observation_id":"2215a800-d821-457c-b693-f2b28e98b87d","resolution":{"observed_at":"2026-07-03T22:08:58.620596Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Ui-tars-2 technical report: Advancing gui agent with multi-turn reinforcement learning.arXiv preprint arXiv:2509.02544, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:36ff5be5048f61d297467631484e186ffeb7da75f3e25bed35a7016d451ad5e8","observation_id":"3d42dae9-7f89-4a89-8db2-12c2e3b14198","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-07-14T06:25:23.264527Z","title":"Ui-tars-2 technical report: Advancing gui agent with multi-turn reinforcement learning.arXiv preprint arXiv:2509.02544, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11185","last_updated":"2026-07-13T07:32:35Z","snapshot_observed_at":"2026-07-16T23:19:14.868685Z","submitted_at":"2026-07-13T07:32:35Z","title":"SCALECUA: Scaling Computer Use Agents with Verifiable Task Synthesis and Efficient Online RL","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T06:25:23.264527Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2607.11185"},"observation_digest":"sha256:fb27e3694fb03b00e9568a8e02b449f9046322c11de6474a6916bb0e01e0f18c","observation_id":"b74c6ba6-0d27-49b2-b84d-a9b00bd6fbf5","resolution":{"observed_at":"2026-07-14T06:25:23.264527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-07-31T23:58:28.708772Z","title":"arXiv preprint arXiv:2509.02544 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23263","last_updated":"2026-07-25T16:00:45Z","snapshot_observed_at":"2026-07-31T23:58:25.002710Z","submitted_at":"2026-07-25T16:00:45Z","title":"SeekJudge: A Practical Reward Framework for Reinforcement Learning in Computer-Use Agents","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-31T23:58:28.708772Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2607.23263"},"observation_digest":"sha256:ab43986210b23c60bd14927fa97d513844a5aeb2cf815ab6d26d7fd4b36708fa","observation_id":"ea7e4970-021d-4755-9be3-c5cce40bb408","resolution":{"observed_at":"2026-07-31T23:58:28.708772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-07-31T14:04:44.771905Z","title":"arXiv preprint arXiv:2509.02544 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28227","last_updated":"2026-07-30T13:58:41Z","snapshot_observed_at":"2026-08-04T06:59:54.896655Z","submitted_at":"2026-07-30T13:58:41Z","title":"Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-07-31T14:04:44.771905Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2607.28227"},"observation_digest":"sha256:be4d87dfff9248bf3c5ced59f197ef043346be9cde626819ef31e78ca3033073","observation_id":"d20070ad-eb74-4861-96d7-f33af5dcc337","resolution":{"observed_at":"2026-07-31T14:04:44.771905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.02544/citation-record","integrity":"/paper/2509.02544/integrity","json":"/paper/2509.02544/citation-record.json","paper":"/paper/2509.02544"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing the model context protocol","venue":null,"work_id":"76a54afd-9ea5-4227-82d4-895b22064898","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:92099ec9f840ce5c5797f6ecdf82fcb86d32c496cc75f42fe4d76967684e809e","observation_id":"de3d4e3a-9a2a-4cfa-aa79-ef2c6740547d","resolution":{"observed_at":"2026-05-13T10:13:59.284826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Developing a computer use model.https://www.anthropic.com/news/developing-computer-use","venue":null,"work_id":"caabce93-ca86-4591-9b22-d17f67b8741f","year":null},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:dc01c2f7df651fd7a8543155d745055eb5dc4955eaa69952eadaeb4082138dea","observation_id":"a5f31d35-4d4e-4790-89e2-d5bd1c744ccc","resolution":{"observed_at":"2026-05-13T10:13:59.193462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4d2efd78-a0ca-4820-89e3-11f71eb17bb0","year":null},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:2694790672cc5d0ffdad7da1c8906d4153858e2f8298c00f7d3c500c0c8947fd","observation_id":"dc912f36-e514-47f7-a022-426085393707","resolution":{"observed_at":"2026-05-13T10:13:59.197868Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Claude 3.7 sonnet system card","venue":null,"work_id":"c03ad2ab-948d-4485-b8e1-c1f09252a581","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:1d8516695146ead331c428b02b41d217855bbc536a8a69d15739ad717b4dddf8","observation_id":"fb943cd8-d57c-4b1e-9693-70659930bdf8","resolution":{"observed_at":"2026-05-13T10:13:59.202053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Claude’s extended thinking","venue":null,"work_id":"604b5fae-2b6c-42d3-a403-f342a8a5a875","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:26436720a2c62db30aabe49e0bff016eb7d7bb231c930f0a4404bfbe76243096","observation_id":"95e7cf4f-282a-4cf2-87c9-7b9a89a0c899","resolution":{"observed_at":"2026-05-13T10:13:59.206172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing claude 4","venue":null,"work_id":"5a8122e2-1394-4b2a-95e9-68cb7708d8a7","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:f45d3c218bc1d3781b312d4e86ba2704a712942e7ff35a17064a8a8263d7b2b5","observation_id":"5726bbdd-ce81-49b8-93a0-532a3664fd6e","resolution":{"observed_at":"2026-05-13T10:13:59.210724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling data collection for training software engineering agents.Nebius blog","venue":null,"work_id":"71a60217-c9bf-4fcb-b037-0cf47844eed6","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:58ec4650028c03e408419ac25783c4a3c48b21186b1724253851dd97bb22aaf9","observation_id":"59ff5609-7a39-4fa1-b975-cd340c4e02c8","resolution":{"observed_at":"2026-05-13T10:13:59.215282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.20411","doi":"10.48550/arxiv.2505.20411","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-rebench: An Automated Pipeline for Task Collection and Decontaminated Evaluation of Software Engineering Agents","venue":"ArXiv.org","work_id":"c819f5fe-32b6-41d1-aeb5-2d80c6fa8474","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:ddc119a7cfa889b2996c93e4b6db197178fa1ced2096366e95e3f320e89a038a","observation_id":"a733e41c-1e01-4974-a726-211e4251776a","resolution":{"observed_at":"2026-05-13T10:13:59.066796Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:50:48.545398+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:50:48.545398+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video pretraining (vpt): Learning to act by watching unlabeled online videos.Advances in Neural Information Processing Systems, 35:24639–24654","venue":null,"work_id":"bf094d80-b997-40de-ad5d-6097af817e8f","year":2022},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:5c2b30af6ca0ca1db6a6a427c95a9786bf9d3c02c1a8191771cfa8f557f6a5ae","observation_id":"a3e7f836-8647-43ef-96d6-d0883fdd8915","resolution":{"observed_at":"2026-05-13T10:13:59.220414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T11:00:59.359536Z","title":"The arcade learning environment: An evaluation platform for general agents.Journal of artificial intelligence research, 47:253–279","venue":null,"work_id":"1b528d13-8cd3-4092-b953-86e5fc2b471e","year":2013},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:dbf71ab1b97e1cf976882cf98dee69f7900e090e0c9b1f0b34cc2eaa62384545","observation_id":"70f7b388-d9fe-4fa4-bcf8-c349a60ff57b","resolution":{"observed_at":"2026-05-13T10:13:59.225234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Windows agent arena: Evaluating multi-modal os agents at scale","venue":null,"work_id":"907ea9df-fbf9-467d-a923-d947f6be3cb2","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:08ce5b29f29b1207410e70c48ab7724528c81a4d38988942b17799029025bbf6","observation_id":"042026ee-35a6-4706-a152-bdbe14b7f2d0","resolution":{"observed_at":"2026-05-13T10:13:59.230301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seed-thinking-1.6","venue":null,"work_id":"3b2249af-6823-4e97-8db9-98e0dadb0f77","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:d91e5745b147e62911d49c341260acf5cc99685a94069d8a9d055d1954579b9a","observation_id":"1497993b-6d28-444b-acb7-7fa68e3173c1","resolution":{"observed_at":"2026-05-13T10:13:59.233720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2407.20183","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T04:37:37.756213Z","title":"Mindsearch: Mimicking human minds elicits deep ai searcher","venue":null,"work_id":"c758c4d2-1c6a-47a9-b85f-d4d74101ebfa","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:cf69a98ee3c0a5334158c859be3be6089d4e77963b2bd16bde46dbf186389ae9","observation_id":"5084a61c-7bf2-4f8e-8e74-8c64999d6241","resolution":{"observed_at":"2026-05-13T10:13:59.085850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10935","last_updated":"2024-02-23T04:36:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-17T08:10:35Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","version":2},"cited_work":{"arxiv_id":"2401.10935","doi":"10.48550/arxiv.2401.10935","metadata_source":"pith","pith_arxiv_id":"2401.10935","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","venue":"cs.HC","work_id":"8fe50425-9d6d-4080-bd43-51b3d0d0e5f6","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2401.10935","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:471939f00d62c8b74d67625b40bf709c52457d4b568a8e08a355bd759186d1d6","observation_id":"379666f6-5021-49b5-9f28-3990481137ae","resolution":{"observed_at":"2026-05-17T10:09:46.778093Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:e939374b6354a863e06bffaef0390eb12235031593664fd67c7cd68d74c1eecd","observation_id":"4684eb12-2aa2-405d-a34c-f7c6b8dd8e72","resolution":{"observed_at":"2026-05-13T10:13:59.060146Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Molmo and pixmo: Open weights and open data for state-of-the-art multimodal models.arXiv e-prints, pages arXiv–2409","venue":null,"work_id":"2d48d5b6-42a2-47c7-9675-1a6ce29ee205","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:11ee2ac0b4bb52200d9206057bac4b5f07a66178f01d3b73856211d9ea3ba3d4","observation_id":"758f78d0-9afb-4382-a7d2-caa6bd7ed31d","resolution":{"observed_at":"2026-05-13T10:13:59.236547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06070","last_updated":"2023-12-09T05:57:46Z","snapshot_observed_at":"2026-07-06T15:40:50.807376Z","submitted_at":"2023-06-09T17:44:31Z","title":"Mind2Web: Towards a Generalist Agent for the Web","version":3},"cited_work":{"arxiv_id":"2306.06070","doi":"10.48550/arxiv.2306.06070","metadata_source":"pith","pith_arxiv_id":"2306.06070","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mind2Web: Towards a Generalist Agent for the Web","venue":"cs.CL","work_id":"e26f5a00-c007-439d-83f6-7900f5687b6b","year":2023},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2306.06070","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:800762728f685fe000e43c92f3cd363e16f5810f4cbc4fc66c737cdd53fb5c69","observation_id":"adf86baa-3cf9-435a-89fa-4d2d1ea0c52e","resolution":{"observed_at":"2026-05-15T20:05:16.335224Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:29.437492+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:29.437492+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Minedojo: Building open-ended embodied agents with internet-scale knowledge","venue":null,"work_id":"9a1b4103-a4f7-47c7-9489-26773c00de1e","year":2022},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:3aecccb15ec61b563ff7b73c3d2ad786a6c6b9dd443754a4d39fdb02150fb7e2","observation_id":"704c45d5-1748-4bac-b1a7-73e15fe6e9e0","resolution":{"observed_at":"2026-05-13T10:13:59.240350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11536","last_updated":"2025-04-17T16:46:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-15T18:10:22Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","version":2},"cited_work":{"arxiv_id":"2504.11536","doi":"10.48550/arxiv.2504.11536","metadata_source":"pith","pith_arxiv_id":"2504.11536","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","venue":"cs.CL","work_id":"6da510e4-e55c-4412-b7c8-839984508e99","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2504.11536","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:560118f7d65af159713bb4ae6dc2eef0051339620134b7a494f4c81d4dbcb158","observation_id":"15f6c244-687b-4b84-9943-2525f47874aa","resolution":{"observed_at":"2026-05-13T18:42:39.160125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17452","last_updated":"2024-02-21T12:59:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:38Z","title":"ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving","version":4},"cited_work":{"arxiv_id":"2309.17452","doi":"10.48550/arxiv.2309.17452","metadata_source":"pith","pith_arxiv_id":"2309.17452","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving","venue":"cs.CL","work_id":"8534cb5e-3749-4533-bc6f-1d85f32f41c8","year":2023},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2309.17452","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:275530747239980dd60cc9be01ac7547403c161de08319d37e5821d012c40ea4","observation_id":"615ff5bb-32cc-4172-971e-b01b9679b31b","resolution":{"observed_at":"2026-05-19T09:19:36.299641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":"2411.15594","doi":"10.1016/j.xinn.2025.101253","metadata_source":"pith","pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey on LLM-as-a-Judge","venue":"cs.CL","work_id":"2676656a-67bd-4ad5-bad6-cb6f5fcdbfbe","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:dbf55e5558a96ee0150ab8d8f303020322ec686ce524564300afe220fa2d34c5","observation_id":"0a96da0c-de26-49d8-baa2-e6fd0fa5b25a","resolution":{"observed_at":"2026-05-13T10:13:59.103962Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:01.818871+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:01.818871+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:49ecff1e3b7c48d828756fab2acad36df5d649df8ef8dbf9055aa4cb13a29b6b","observation_id":"bfd63874-1468-450b-9ab4-868a68cc8e85","resolution":{"observed_at":"2026-05-13T10:13:59.109629Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09298","last_updated":"2024-09-27T05:55:01Z","snapshot_observed_at":"2026-08-04T01:20:35.490332Z","submitted_at":"2023-09-17T15:19:29Z","title":"OWL: A Large Language Model for IT Operations","version":2},"cited_work":{"arxiv_id":"2309.09298","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.09298","snapshot_observed_at":"2026-06-30T20:05:04.422058Z","title":"Owl: A large language model for it operations","venue":null,"work_id":"05370166-aaa0-4a11-bfa2-13086d1e0e6b","year":2023},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2309.09298","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:bf04efaa7f3586daad5545682942eb5468d8a7dde30703b713de7b07301c2c4f","observation_id":"a3d3700e-8dfe-4eaa-84ad-4f7d0f00f94b","resolution":{"observed_at":"2026-05-13T10:13:59.115701Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cogagent: A visual language model for gui agents","venue":null,"work_id":"0266f4fd-818f-4dd2-ac16-854cb026624a","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:878aee35eedd0eec691cb60ee99ad98278f17139a34eaa52155072efbe4f38d2","observation_id":"19e7957f-4545-4596-b6ab-f35abe9f0984","resolution":{"observed_at":"2026-05-13T10:13:59.244186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15146","last_updated":"2025-06-03T09:53:37Z","snapshot_observed_at":"2026-07-06T21:27:37.409259Z","submitted_at":"2025-05-21T06:02:55Z","title":"lmgame-Bench: How Good are LLMs at Playing Games?","version":2},"cited_work":{"arxiv_id":"2505.15146","doi":"10.48550/arxiv.2505.15146","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15146","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Xing, Ion Stoica, Tajana Rosing, Haojian Jin, and Hao Zhang","venue":"ArXiv.org","work_id":"10ddd4f7-8f21-466f-b975-f64ea89b9b2e","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2505.15146","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:7c751b52962086721a9243c1911405da946d9cc6a4dc8281b70cca9a800274d0","observation_id":"c87a4664-3ed6-421e-bf53-762d56b3599c","resolution":{"observed_at":"2026-05-13T10:13:59.184183Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04482","last_updated":"2025-08-06T14:33:45Z","snapshot_observed_at":"2026-07-06T22:08:50.319355Z","submitted_at":"2025-08-06T14:33:45Z","title":"OS Agents: A Survey on MLLM-based Agents for General Computing Devices Use","version":1},"cited_work":{"arxiv_id":"2508.04482","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04482","snapshot_observed_at":"2026-06-30T11:04:37.777456Z","title":"arXiv:2508.04482 [cs.AI] https://arxiv.org/abs/2508.04482","venue":null,"work_id":"9f8c0110-9f60-4b89-ad80-79780e426db5","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2508.04482","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:879b9640f74a77f957e4c45fdcf962d8070690d0d6c1c7eb7e8875636600d955","observation_id":"944110c9-c093-42b8-b993-20daf9b17846","resolution":{"observed_at":"2026-05-13T10:13:58.845816Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18105","last_updated":"2025-05-23T17:02:02Z","snapshot_observed_at":"2026-07-06T21:29:26.614513Z","submitted_at":"2025-05-23T17:02:02Z","title":"ManuSearch: Democratizing Deep Search in Large Language Models with a Transparent and Open Multi-Agent Framework","version":1},"cited_work":{"arxiv_id":"2505.18105","doi":"10.48550/arxiv.2505.18105","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.18105","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Manusearch: Democratizing deep search in large language models with a transparent and open multi-agent framework","venue":"arXiv (Cornell University)","work_id":"cd30899f-09ea-4fe5-8e21-0ad118811fcd","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2505.18105","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:eb4fcabe42efb3b836ca0e9fff6212f5e65783310e06daadb82e9a7b3e4d66d9","observation_id":"58b2e9f9-264c-4002-962f-95023d9d2a37","resolution":{"observed_at":"2026-05-13T10:13:58.880912Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:87bf6f9047850f608a95c22ffd83914730500a4ac054fdbe89b7bcba47d9f38b","observation_id":"2fccd53a-de22-41b0-ac7e-6d0151c13033","resolution":{"observed_at":"2026-05-13T10:13:58.886621Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":"2310.06770","doi":"10.1145/512927.512945","metadata_source":"pith","pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","venue":"cs.CL","work_id":"d0effe15-a689-441a-8e3f-ea35f1c4e4b1","year":2023},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:47091b01e18d5d070e46bca952f396dc1f41ce9486a32b2bb416380181209c6d","observation_id":"f1a0c3ee-5aba-4d9c-8e26-4eb22e3fa5bd","resolution":{"observed_at":"2026-05-13T10:13:58.918697Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00445","last_updated":"2022-05-01T11:01:28Z","snapshot_observed_at":"2026-07-06T13:05:30.057038Z","submitted_at":"2022-05-01T11:01:28Z","title":"MRKL Systems: A modular, neuro-symbolic architecture that combines large language models, external knowledge sources and discrete reasoning","version":1},"cited_work":{"arxiv_id":"2205.00445","doi":"10.48550/arxiv.2205.00445","metadata_source":"pith","pith_arxiv_id":"2205.00445","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MRKL Systems: A modular, neuro-symbolic architecture that combines large language models, external knowledge sources and discrete reasoning","venue":"cs.CL","work_id":"e393ecfc-aa97-4014-bb7a-90ebd9f00535","year":2022},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2205.00445","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:4ef588c26e2c926b1b9fdd5086fd7ba87551d6c36a527a0e9c65557736115e45","observation_id":"e8a8c77a-9766-4de9-b7af-5796656fdabe","resolution":{"observed_at":"2026-05-15T07:31:08.404728Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02592","last_updated":"2025-07-03T12:59:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-03T12:59:07Z","title":"WebSailor: Navigating Super-human Reasoning for Web Agent","version":1},"cited_work":{"arxiv_id":"2507.02592","doi":"10.48550/arxiv.2507.02592","metadata_source":"pith","pith_arxiv_id":"2507.02592","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebSailor: Navigating Super-human Reasoning for Web Agent","venue":"cs.CL","work_id":"fec5a195-1dd5-425a-b552-109af948a7dd","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2507.02592","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:144e81fa08a45699825aa5ff3b8f71220dc95ec489aa3c34d843eb1af3313fe8","observation_id":"30ef546f-4f12-4a81-8aab-221dfeebc95d","resolution":{"observed_at":"2026-05-17T15:37:09.773663Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16365","last_updated":"2025-09-12T17:56:19Z","snapshot_observed_at":"2026-07-06T20:56:09.656767Z","submitted_at":"2025-03-20T17:21:58Z","title":"JARVIS-VLA: Post-Training Large-Scale Vision Language Models to Play Visual Games with Keyboards and Mouse","version":2},"cited_work":{"arxiv_id":"2503.16365","doi":"10.48550/arxiv.2503.16365","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.16365","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jarvis-vla: Post-training large- scale vision language models to play visual games with keyboards and mouse","venue":"ArXiv.org","work_id":"bfd23bf3-5908-4890-bb7b-2404a00b0718","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2503.16365","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:8e8b55272fcf31b9f06a1a573f1f3f8d65913bd08352e5e455319bccdb6939bf","observation_id":"2eff03f3-e254-4d06-88d9-e3454eef8b1c","resolution":{"observed_at":"2026-05-13T10:13:59.004983Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"cited_work":{"arxiv_id":"2501.05366","doi":"10.48550/arxiv.2501.05366","metadata_source":"pith","pith_arxiv_id":"2501.05366","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","venue":"cs.AI","work_id":"6246e99b-7b4e-4424-be78-3e1983932cdc","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2501.05366","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:1ccdcebfe24530e952ab3f9acd54cebfc2d4fb75bf42d7cd6cbad507df7f9124","observation_id":"fb9bb40b-15bf-4aed-b1e6-e1d0f0caba50","resolution":{"observed_at":"2026-05-13T17:36:27.820666Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23383","last_updated":"2025-03-30T10:16:25Z","snapshot_observed_at":"2026-07-06T21:01:00.397040Z","submitted_at":"2025-03-30T10:16:25Z","title":"ToRL: Scaling Tool-Integrated RL","version":1},"cited_work":{"arxiv_id":"2503.23383","doi":"10.48550/arxiv.2503.23383","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23383","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2503.23383 , year=","venue":"ArXiv.org","work_id":"aec6658a-b95b-4edc-942e-10f5203b0b6b","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2503.23383","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:6d3d77a452b4973d66d0d008e2a69f42f455abaf720f2f043d09ee7655e586a4","observation_id":"b9f49a87-c1ee-4848-adad-06a39be94915","resolution":{"observed_at":"2026-05-13T10:13:59.036699Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01990","last_updated":"2025-08-02T12:44:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-31T18:00:29Z","title":"Advances and Challenges in Foundation Agents: From Brain-Inspired Intelligence to Evolutionary, Collaborative, and Safe Systems","version":2},"cited_work":{"arxiv_id":"2504.01990","doi":"10.48550/arxiv.2504.01990","metadata_source":"pith","pith_arxiv_id":"2504.01990","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Advances and Challenges in Foundation Agents: From Brain-Inspired Intelligence to Evolutionary, Collaborative, and Safe Systems","venue":"cs.AI","work_id":"984dfe5e-1c5c-4b65-920e-15121a85ee7e","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2504.01990","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:5747360508697234e0bc43c023433fbbd8d2a31169c182fe18214bee1c0f7ac4","observation_id":"1ded9e82-d560-4c8f-a2e2-06e552dc3762","resolution":{"observed_at":"2026-05-13T10:13:59.041986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:6048b98b3b499865ac49da8123ee8cc8e7532d49520a36a854f75e1666c78917","observation_id":"efa7606d-90a1-4c89-a24d-f755e76324f5","resolution":{"observed_at":"2026-05-13T10:13:59.047730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16667","last_updated":"2024-02-26T15:39:52Z","snapshot_observed_at":"2026-07-31T11:42:31.804160Z","submitted_at":"2024-02-26T15:39:52Z","title":"RepoAgent: An LLM-Powered Open-Source Framework for Repository-level Code Documentation Generation","version":1},"cited_work":{"arxiv_id":"2402.16667","doi":"10.48550/arxiv.2402.16667","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.16667","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Repoagent: An llm-powered open-source framework for repository-level code documentation generation","venue":"arXiv (Cornell University)","work_id":"c3f1a7bd-32bd-486c-a5bf-dd731a934541","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2402.16667","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:b6f550a81e1efe331c663113997695a25b511ee166934186b967fa8ab7e9835c","observation_id":"2178612c-4e14-449c-ab0c-e5596a49b28a","resolution":{"observed_at":"2026-05-13T10:13:59.053557Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-20T22:23:32.066853+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T22:23:32.066853+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language models play starcraft ii: Benchmarks and a chain of summarization approach.Advances in Neural Information Processing Systems, 37:133386–133442","venue":null,"work_id":"6b03274b-59e2-4104-a55c-daa1edffbf89","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:4ec8f62772dc7a626c11c607cd60544ad70cf413662f90e421676559ee88d680","observation_id":"fca6930a-71da-436b-b1eb-12b645b31734","resolution":{"observed_at":"2026-05-13T10:13:59.248418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human-level control through deep reinforcement learning","venue":null,"work_id":"99ed19e8-489b-4631-ab7c-b309f91e1966","year":2015},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:ace25787877917d6cfe5f6e6898883bebeb973a10539853c590c0cafd287955f","observation_id":"51f24dd3-f343-4273-b841-ff8ec47cecf6","resolution":{"observed_at":"2026-05-13T10:13:59.252471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kimi-researcher: End-to-end rl training for emerging agentic capabilities.https://moonshotai","venue":null,"work_id":"2083bcfc-33da-4425-8dc6-66d729ae42d1","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:e10e8f982186c61a94f1db0d802ee97b9a192a84018a99aac4f990bc2f283527","observation_id":"f0a3ea3f-9fdc-4838-87e0-48ab8c7dece4","resolution":{"observed_at":"2026-05-13T10:13:59.256633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.13501","doi":"10.48550/arxiv.2412.13501","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gui agents: A survey","venue":"arXiv (Cornell University)","work_id":"f38f0fec-72eb-4823-bf7c-ea2f4e699bf1","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:9797626a3b71cb6c6ee94a28cc47c1778407157ed97483627e6bdad4b5e19651","observation_id":"3fca4f54-49c9-44c3-b37e-2375d06705c7","resolution":{"observed_at":"2026-05-13T10:13:59.079422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OpenAI: Introducing ChatGPT","venue":null,"work_id":"1fe91064-6d45-4264-85d6-3edb01b71f42","year":2022},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:c1ec2748abb68baadfb07d2f9070f826917ff3638c957f2b6e6c3cc2342218d6","observation_id":"2af4f713-f4f7-48d2-b794-1b627170012c","resolution":{"observed_at":"2026-05-13T10:13:59.260936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing gpt 5","venue":null,"work_id":"31c7c653-95bc-4152-a462-2536c10642f5","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:601948b2079791ce241ef8d757c23a3248443afeffd3367e1faaffe1b5624cb0","observation_id":"0e53297b-4131-41a7-97e2-ac3dea75efcd","resolution":{"observed_at":"2026-05-13T10:13:59.264676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing deep research - openai.https://openai.com/index/introducing-deep-research/","venue":null,"work_id":"9c1e4dea-06c0-45dc-afbb-d85e99112247","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:e06f854718cccb66ad4a708b90ed828caa40fef1b07028ec94793dbcc05f80df","observation_id":"c7a3b863-07b4-4ed4-8573-e5e7702f2c80","resolution":{"observed_at":"2026-05-13T10:13:59.268878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openai o3 and o4-mini system card","venue":null,"work_id":"a811691b-f64f-44c5-bf53-df800aa43259","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:7901e1e63a13f40fd813a1dfdd99e6d487d1943dc41173d02c817933aac8c971","observation_id":"44dbbce9-e221-4f13-93b3-a5e01a1ddc91","resolution":{"observed_at":"2026-05-13T10:13:59.272797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Computer-using agent (cua)","venue":null,"work_id":"094257c6-ccb1-4671-8c66-1fe2cd142a52","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:ce3a94cca2b833e14140ab46e0596bc235c9ba1dfa85284c0191107f8b6a2dfd","observation_id":"467dbc45-7e12-4acc-b672-b556c1b6e17e","resolution":{"observed_at":"2026-05-13T10:13:59.276563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Operator","venue":null,"work_id":"61b84f83-2e6e-45ca-95ce-873217e500af","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:d790e3839777b32e95a2b0308b2ac2aff83c4ebe7f21c2908bca087b3ad7bcff","observation_id":"86231617-ca47-499d-8c31-7f2100926fbc","resolution":{"observed_at":"2026-05-13T10:13:59.280752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21139","last_updated":"2025-06-06T07:53:20Z","snapshot_observed_at":"2026-07-06T20:14:49.976782Z","submitted_at":"2024-12-30T18:15:39Z","title":"Training Software Engineering Agents and Verifiers with SWE-Gym","version":2},"cited_work":{"arxiv_id":"2412.21139","doi":"10.48550/arxiv.2412.21139","metadata_source":"pith","pith_arxiv_id":"2412.21139","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Software Engineering Agents and Verifiers with SWE-Gym","venue":"cs.SE","work_id":"17189f19-7774-4b97-ab44-9966bf5d6d48","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2412.21139","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:4cd5a66a32341e1c4bb15bb157c693d8d2b12f4b90a5241146b570c095b48944","observation_id":"1c0a0eb8-eeb9-489d-beb4-0464fa0eac73","resolution":{"observed_at":"2026-05-18T05:20:40.573423Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.emnlp-main.451","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploring mode connectivity for pre-trained language models","venue":null,"work_id":"69ad2ca8-dd65-4db9-a315-2c41618c04c5","year":2022},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:d7ff0c28673d96262f10b536c0d697eb7b6fec00e63722affa8639590640cdec","observation_id":"c95661c9-6d35-49f3-9023-96457b42d33a","resolution":{"observed_at":"2026-05-13T10:13:58.832471Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":"2501.12326","doi":"10.48550/arxiv.2501.12326","metadata_source":"pith","pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","venue":"cs.AI","work_id":"0bbcf263-a46d-4525-a438-11fce3316568","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:5d8bab062e8d45c8ce3c56b819875c3beef95688eddf075eb3791cfb844da817","observation_id":"fd4f7368-5270-49b9-a630-759aade2bdd3","resolution":{"observed_at":"2026-05-13T10:13:59.127832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-19T22:22:19.638951+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-19T22:22:19.638951+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20286","last_updated":"2025-05-26T17:58:53Z","snapshot_observed_at":"2026-07-06T21:30:52.246162Z","submitted_at":"2025-05-26T17:58:53Z","title":"Alita: Generalist Agent Enabling Scalable Agentic Reasoning with Minimal Predefinition and Maximal Self-Evolution","version":1},"cited_work":{"arxiv_id":"2505.20286","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20286","snapshot_observed_at":"2026-07-09T14:26:20.364079Z","title":"Alita: Generalist agent enabling scalable agentic reasoning with minimal predefinition and maximal self-evolution","venue":"cs.AI","work_id":"8c50a731-e2ce-41b5-a21a-7a4dcb1dacc5","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2505.20286","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:4cb761f1bb172ee58cf0eba302a61604ad54cae452940cf456d25e7a2d566b8f","observation_id":"93d14fd2-4d9f-44ae-9485-adc41df0567e","resolution":{"observed_at":"2026-05-13T10:13:59.132799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10179","last_updated":"2024-10-11T16:30:24Z","snapshot_observed_at":"2026-07-06T18:00:39.863947Z","submitted_at":"2024-03-13T17:50:32Z","title":"Scaling Instructable Agents Across Many Simulated Worlds","version":3},"cited_work":{"arxiv_id":"2404.10179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.10179","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling instructable agents across many simulated worlds","venue":null,"work_id":"7ff2a0a7-9856-458d-8ff2-9d1a12cf4888","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2404.10179","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:6efa59113e00e493021a4df8ee18251a29045a38ea195fff132ed92e092bcc61","observation_id":"4081edfb-eb3b-47dd-be6c-6aea0658c3a2","resolution":{"observed_at":"2026-05-13T10:13:59.137373Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14573","last_updated":"2025-04-06T20:37:50Z","snapshot_observed_at":"2026-07-06T18:18:39.093732Z","submitted_at":"2024-05-23T13:48:54Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","version":5},"cited_work":{"arxiv_id":"2405.14573","doi":"10.48550/arxiv.2405.14573","metadata_source":"pith","pith_arxiv_id":"2405.14573","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","venue":"cs.AI","work_id":"c5116d19-d3d3-40fd-9620-f7489812a9ba","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2405.14573","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:9f6a25307eae45fff487e7a9710c8fcbbb9972a84cbb17d5f684a265581c018b","observation_id":"b8218296-d4d1-4fb3-9549-86778b499ced","resolution":{"observed_at":"2026-05-13T12:06:13.928391Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06175","last_updated":"2022-11-11T10:04:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-05-12T16:03:26Z","title":"A Generalist Agent","version":3},"cited_work":{"arxiv_id":"2205.06175","doi":"10.48550/arxiv.2205.06175","metadata_source":"pith","pith_arxiv_id":"2205.06175","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Generalist Agent","venue":"cs.AI","work_id":"4b0a87cd-8d54-4abc-9698-c4cb20995600","year":2022},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2205.06175","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:90d3a0758f46910692e5a280bf52c8deae33f120090002965d94a512350cc46a","observation_id":"7773e536-5c0f-46cd-af32-387bace27bcf","resolution":{"observed_at":"2026-05-13T10:13:59.148204Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":"2302.04761","doi":"10.48550/arxiv.2302.04761","metadata_source":"pith","pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","venue":"cs.CL","work_id":"9bce40c8-cfd7-4983-80e0-c3bd4402322a","year":2023},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:fd5abbb50bf98dc2453ae0e90ede7ab0494b18529e44f71facbd8cf852f8b059","observation_id":"ee4951a7-96b4-41e8-a93d-52ead39690a1","resolution":{"observed_at":"2026-05-13T10:13:59.153816Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:11.107254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:11.107254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:b38017cd9553a65d9b566806769d1ac256b30937c49a644a101ffbd949caed83","observation_id":"7b3ec73a-373c-4837-b353-3632485fd75e","resolution":{"observed_at":"2026-05-13T10:13:59.159784Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ui-tars-1.5.https://seed-tars.com/1.5","venue":null,"work_id":"2ac5ba78-9a38-4c4e-be4e-d71924d73e1e","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:d5a41a6a6359df0d9c155e3489416b5bceab71d54cfff4bd38eac2ad4c1d3782","observation_id":"7f5de416-8b05-4eaa-941f-81e6c38fd012","resolution":{"observed_at":"2026-05-13T10:13:59.188438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:48d13fa5627e355fffb8b03c9d6c3e7cb48a877beca4fa42d882c9d15cd0d77e","observation_id":"fff9fb30-d0d8-450b-b418-2852e4dcca0e","resolution":{"observed_at":"2026-05-13T10:13:59.178104Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05720","last_updated":"2025-07-08T07:07:53Z","snapshot_observed_at":"2026-07-06T21:53:46.656981Z","submitted_at":"2025-07-08T07:07:53Z","title":"MobileGUI-RL: Advancing Mobile GUI Agent through Reinforcement Learning in Online Environment","version":1},"cited_work":{"arxiv_id":"2507.05720","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.05720","snapshot_observed_at":"2026-07-04T10:59:46.413359Z","title":"Mobilegui-rl: Advancing mobile gui agent through reinforcement learning in online environment","venue":null,"work_id":"4b1aecd7-add8-45d1-b46c-5c1a9c30fe03","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2507.05720","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:81aac775b7bab722f4c00748e99839a1d1f8edd78769fcf4f335089db7c2de96","observation_id":"63f560cc-b7a7-414c-9742-3d60d8d1ffd6","resolution":{"observed_at":"2026-05-13T10:13:59.172725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T03:44:29.499952Z","title":"Reflexion: Language agents with verbal reinforcement learning.Advances in Neural Information Processing Systems, 36:8634–8652","venue":null,"work_id":"a1894bfe-ed8e-4cc3-a955-b4689ee7d53f","year":2023},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:51762be6ae5a1fb50e943bdc5dcfeffcf7d682128109b351b9d145247a6441e8","observation_id":"c068340d-82e5-4bfc-8a97-358fb9225445","resolution":{"observed_at":"2026-05-13T10:13:59.288928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mastering the game of go without human knowledge","venue":null,"work_id":"c5450117-2599-4661-abe6-0d1d8800e3da","year":2017},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:11801f753b355e1352e017ca7ec3117c77a7335c934d736ae23ef5fad5922915","observation_id":"b597834e-65ac-4184-aa7b-55a3f85b7d78","resolution":{"observed_at":"2026-05-13T10:13:59.293160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17005","last_updated":"2025-05-22T17:58:26Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:58:26Z","title":"R1-Searcher++: Incentivizing the Dynamic Knowledge Acquisition of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.17005","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17005","snapshot_observed_at":"2026-06-30T11:54:38.232124Z","title":"R1-searcher++: Incentivizing the dynamic knowledge acquisition of llms via reinforcement learning","venue":null,"work_id":"097ccf61-9cab-4a68-94c4-d310a0cdfa38","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2505.17005","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:af5be7cb56268947a9e03fabd1a17cc636c4704162430a558b7c1cad86351e21","observation_id":"5190ed19-ff39-4025-9f0b-1b0a40ef037d","resolution":{"observed_at":"2026-05-13T10:13:58.852583Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.16834","doi":"10.48550/arxiv.2505.16834","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Simpledeepsearcher: Deep information seeking via web-powered reasoning trajectory synthesis","venue":"ArXiv.org","work_id":"da0e1d3f-5591-420e-a894-b1b9dd4adc5f","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:1ed7ca9940cfeaa0ed1e3374367c0f223323c57dc60fef3e9f932686efed74b7","observation_id":"c5d5f36a-580b-4632-9c2c-f75b2d64bdd4","resolution":{"observed_at":"2026-05-13T10:13:58.838223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13865","last_updated":"2025-06-04T17:29:13Z","snapshot_observed_at":"2026-07-06T21:11:39.503336Z","submitted_at":"2025-03-27T17:58:31Z","title":"A Survey on (M)LLM-Based GUI Agents","version":2},"cited_work":{"arxiv_id":"2504.13865","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.13865","snapshot_observed_at":"2026-07-04T14:29:53.306375Z","title":"A survey on (m)llm-based gui agents","venue":null,"work_id":"e614cf10-db17-498f-91c0-d74bcaeb2a24","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2504.13865","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:647f4b3f66a3e1fc18aedabc2ba6f224d1d16b9d7ccc6c8a9d6c6ec68b2dc65e","observation_id":"3b79331d-4abf-4c99-ae87-80df533c1337","resolution":{"observed_at":"2026-05-13T10:13:58.859933Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":"2507.20534","doi":"10.1145/3448609","metadata_source":"pith","pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi K2: Open Agentic Intelligence","venue":"cs.LG","work_id":"7f18284c-12d3-4137-bea1-1da97e8cf3c1","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:bb964a227f04a4589ed9d73d9d768b57b361aab096774ad639ff77dbc0fa170b","observation_id":"d1ca66a6-f7b9-400e-9271-02650cf71938","resolution":{"observed_at":"2026-05-13T10:13:58.866070Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:dd674eb135570b4d85186e0e126daec7794a195f49bb838bfed134b01f6b2e49","observation_id":"27400637-b343-4f51-a6c7-949a21e57c1b","resolution":{"observed_at":"2026-05-13T10:13:58.873345Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Terminal-bench: A benchmark for ai agents in terminal environments, Apr 2025","venue":null,"work_id":"9192ff12-afe1-4a3e-88c5-246c81d663fc","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:28a8276779d556b726928756ada9acdbddcdf5778bb9353a48b800faf504790f","observation_id":"a72b6e33-61c0-4fe5-925f-537cf3c6a119","resolution":{"observed_at":"2026-05-13T10:13:59.297516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grandmaster level in starcraft ii using multi-agent reinforcement learning.nature, 575(7782):350–354","venue":null,"work_id":"c7d8365d-27d8-4434-9ea1-be35a87f67ba","year":2019},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:f491a7da06f544e64abcc30dd6879d397124fa0f1f312636cc11d1d7a6c40288","observation_id":"b4f033b3-4bd2-4ac2-8986-e97faffd5525","resolution":{"observed_at":"2026-05-13T10:13:59.301733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.16291","doi":"10.18653/v1/2023.emnlp-main.118","metadata_source":"pith","pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","venue":"cs.AI","work_id":"ffe0d207-86cf-4742-a100-e988ac8b9676","year":2023},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:cebd3de22bce95774f9379bee393ad7747c18517dee38e8da206bb72bd6501c3","observation_id":"61cca9ef-94aa-4447-a9c6-b488d97009d6","resolution":{"observed_at":"2026-05-13T10:13:58.892299Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14870","last_updated":"2025-05-31T20:08:42Z","snapshot_observed_at":"2026-08-05T00:14:13.012902Z","submitted_at":"2025-04-21T05:40:05Z","title":"Acting Less is Reasoning More! Teaching Model to Act Efficiently","version":2},"cited_work":{"arxiv_id":"2504.14870","doi":"10.48550/arxiv.2504.14870","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14870","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Acting less is reasoning more! teaching model to act efficiently","venue":"ArXiv.org","work_id":"b03375b2-32a8-4d45-9126-bd45ad56fb43","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2504.14870","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:726b87e81d9df48797cb06ba7c25ca93121d18197bf97211e155c9d8392023c9","observation_id":"d4973e55-2653-4d3b-b064-4fcac0a9ad7a","resolution":{"observed_at":"2026-05-13T10:13:58.899300Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04890","last_updated":"2025-02-13T10:09:37Z","snapshot_observed_at":"2026-08-01T16:20:26.422997Z","submitted_at":"2024-11-07T17:28:10Z","title":"GUI Agents with Foundation Models: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2411.04890","doi":"10.48550/arxiv.2411.04890","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.04890","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gui agents with foundation models: A comprehensive survey","venue":"arXiv (Cornell University)","work_id":"48bc4d35-0dc9-45c8-b563-cea72d9dd42e","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2411.04890","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:844e4b430f256bbe2555ab0e3d506895ea80a770be16ce8e6660be043e618cb4","observation_id":"c7440ca6-9008-4b1a-b009-db1466a79df5","resolution":{"observed_at":"2026-05-13T10:13:58.907184Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16741","last_updated":"2025-04-18T18:14:31Z","snapshot_observed_at":"2026-08-02T14:58:44.167588Z","submitted_at":"2024-07-23T17:50:43Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","version":3},"cited_work":{"arxiv_id":"2407.16741","doi":"10.1145/3718958.3750537","metadata_source":"pith","pith_arxiv_id":"2407.16741","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","venue":"cs.SE","work_id":"f1762ea0-e382-4f38-a28c-adc643789859","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2407.16741","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:decf8eaaf26632a9e41670db1939e4eb86a0893df765715f09e1e9f0885570c1","observation_id":"1c7bff89-4e5a-4402-a062-ff05086fc6aa","resolution":{"observed_at":"2026-05-13T10:13:58.913195Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jarvis-1: Open-world multi-task agents with memory-augmented multimodal language models","venue":null,"work_id":"436c9bb9-f110-4049-b446-f84b000373e8","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:3b6bec933cc937feca6214c7451891a3713acea75660ef98fbf7f58bb4e3f2cb","observation_id":"f30ef1b8-4f0d-479e-ab63-386ec104bc76","resolution":{"observed_at":"2026-05-13T10:13:59.306336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12516","last_updated":"2025-04-16T22:27:45Z","snapshot_observed_at":"2026-08-03T00:43:33.338074Z","submitted_at":"2025-04-16T22:27:45Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","version":1},"cited_work":{"arxiv_id":"2504.12516","doi":"10.48550/arxiv.2504.12516","metadata_source":"pith","pith_arxiv_id":"2504.12516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","venue":"cs.CL","work_id":"25adb508-d97c-49d6-ae43-7a70c2478a34","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2504.12516","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:556fde99cc6154f89f0b9b4079827f0a1a59ef3380a57cff6b45e8dabba289fb","observation_id":"e03d7d87-8c84-4017-a82a-6caa432876bc","resolution":{"observed_at":"2026-05-13T10:13:58.926566Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23218","last_updated":"2024-10-30T17:10:19Z","snapshot_observed_at":"2026-08-05T06:30:40.974506Z","submitted_at":"2024-10-30T17:10:19Z","title":"OS-ATLAS: A Foundation Action Model for Generalist GUI Agents","version":1},"cited_work":{"arxiv_id":"2410.23218","doi":"10.48550/arxiv.2410.23218","metadata_source":"pith","pith_arxiv_id":"2410.23218","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OS-ATLAS: A Foundation Action Model for Generalist GUI Agents","venue":"cs.CL","work_id":"16e00be2-1641-403c-8835-c50a6628f483","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2410.23218","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:909363212f71031c965f082e64a3e01b3892503355bee43e7a63013cf4ac3135","observation_id":"08fcf8ea-563e-48e3-911a-1627a6198afb","resolution":{"observed_at":"2026-05-13T10:13:58.931773Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-19T22:22:20.970634+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-19T22:22:20.970634+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer environments.Advancesin Neural Information Processing Systems, 37:52040–52094","venue":null,"work_id":"b2c0973b-7fbe-4497-ac9b-96a050902c4e","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:125a6a02c04afc2c0a6a9530cbbffd34cbffb3b9b7a1363611b4e90416b9ba5d","observation_id":"f5cef7a7-b027-4238-8b53-f758e5e068c2","resolution":{"observed_at":"2026-05-13T10:13:59.310786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04454","last_updated":"2025-05-05T16:17:20Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:58:26Z","title":"Aguvis: Unified Pure Vision Agents for Autonomous GUI Interaction","version":2},"cited_work":{"arxiv_id":"2412.04454","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04454","snapshot_observed_at":"2026-07-04T10:39:44.899694Z","title":"Aguvis: Unified Pure Vision Agents for Autonomous GUI Interaction","venue":"cs.CL","work_id":"64030c49-afa6-4cf0-b64c-831d19d6674e","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2412.04454","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:c446def6bd355dc20723ef10c42eb668a2316f4c4a91ac46c10f8267dc4e1acb","observation_id":"1828ce06-2366-41ec-a450-18bcf600ff8c","resolution":{"observed_at":"2026-05-18T04:09:42.002663Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.01382","doi":"10.48550/arxiv.2504.01382","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An illusion of progress? assessing the current state of web agents","venue":"ArXiv.org","work_id":"faf58fb2-da4e-413b-a68e-c2c7438f7c62","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:44b9b46e5e84ad0c80f7dd61008bcfdd18d1e7338dedd28979d0747107e025ae","observation_id":"bfdb9337-e75a-430a-840f-bed423bbe53b","resolution":{"observed_at":"2026-05-13T10:13:58.948017Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":"2405.15793","doi":"10.48550/arxiv.2405.15793","metadata_source":"pith","pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","venue":"cs.SE","work_id":"01826cd9-a652-403c-a2ec-531da9fe2b6a","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:4ed82e34e65c8989366726edfe727ae018c6e0751ad285f0a838a00f1fd8f162","observation_id":"45c4b309-5d99-45f3-8a83-4f91d7c6f9cd","resolution":{"observed_at":"2026-05-13T10:13:58.953503Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:24.962823+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:24.962823+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:54:50.121206Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":"db3d7fd5-c023-4dce-b5d9-acb8403ec05f","year":2023},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:58b6902efd56ae0d8e7036a9ac9eaee67f79e4b2a4e42de026973727d4b647aa","observation_id":"35636f95-d60f-40f9-b194-1bce3654d687","resolution":{"observed_at":"2026-05-13T10:13:59.314798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:e9c693cc7a07fb728aa8a721285c2c39c96c8b8a4f9d0280d868e332870c36d6","observation_id":"494210af-a3a7-40e4-ad71-358a6e0f58b5","resolution":{"observed_at":"2026-05-13T10:13:58.966213Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16563","last_updated":"2023-12-04T14:53:15Z","snapshot_observed_at":"2026-07-06T15:09:29.225079Z","submitted_at":"2023-03-29T09:45:50Z","title":"Skill Reinforcement Learning and Planning for Open-World Long-Horizon Tasks","version":2},"cited_work":{"arxiv_id":"2303.16563","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.16563","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Plan4mc: Skill reinforcement learning and planning for open-world minecraft tasks","venue":null,"work_id":"7aa7ccf6-cad2-4111-a7fd-d67ae7344eab","year":2023},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2303.16563","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:ecc8d78a1ef8740d4c8d16f2c6b3b63a37521bb3a7f24a5077b66c33613f4f9d","observation_id":"fe9b2a5e-ecb2-4902-9605-207c538bea61","resolution":{"observed_at":"2026-05-13T10:13:58.973256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01491","last_updated":"2025-03-03T12:59:25Z","snapshot_observed_at":"2026-07-06T20:45:41.540398Z","submitted_at":"2025-03-03T12:59:25Z","title":"What's Behind PPO's Collapse in Long-CoT? Value Optimization Holds the Secret","version":1},"cited_work":{"arxiv_id":"2503.01491","doi":"10.48550/arxiv.2503.01491","metadata_source":"pith","pith_arxiv_id":"2503.01491","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"What’s behind ppo’s collapse in long-cot? value optimization holds the secret","venue":"cs.LG","work_id":"b9f345a1-11ca-4214-b731-220afdbef297","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2503.01491","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:6b03623e05d3e40cf0d3846fd62ad5296107eb1c05ec5de455008198be11195b","observation_id":"65780489-24fc-4086-8b40-c06b37a4b90a","resolution":{"observed_at":"2026-05-13T10:13:58.979808Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T16:19:05.612581+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T16:19:05.612581+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05118","last_updated":"2025-04-11T02:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T14:21:11Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","version":3},"cited_work":{"arxiv_id":"2504.05118","doi":"10.1109/access.2024.3384487","metadata_source":"pith","pith_arxiv_id":"2504.05118","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","venue":"cs.AI","work_id":"c2351652-65f7-47cd-ae80-dbcd72a6eb20","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2504.05118","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:4c7c4742f67f553aeed91ff4aeb25d6965a269050c0245611d317d5c353bb52c","observation_id":"a4c1acac-b9ed-4ac5-a94a-3d44a3cb00b3","resolution":{"observed_at":"2026-05-13T10:13:58.985799Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02605","last_updated":"2025-04-03T14:06:17Z","snapshot_observed_at":"2026-07-30T07:56:48.878578Z","submitted_at":"2025-04-03T14:06:17Z","title":"Multi-SWE-bench: A Multilingual Benchmark for Issue Resolving","version":1},"cited_work":{"arxiv_id":"2504.02605","doi":"10.48550/arxiv.2504.02605","metadata_source":"pith","pith_arxiv_id":"2504.02605","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-SWE-bench: A Multilingual Benchmark for Issue Resolving","venue":"cs.SE","work_id":"c66ce635-0931-4807-8300-a45863330d75","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2504.02605","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:34b5d2a07fae771fd81b8c0a01f6a1e37cb147eec6a097f8155e74e33145a593","observation_id":"fce82d0d-5011-463c-908c-89594276b620","resolution":{"observed_at":"2026-05-16T06:48:50.578231Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:50:49.442994+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:50:49.442994+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06471","last_updated":"2025-08-08T17:21:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-08T17:21:06Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","version":1},"cited_work":{"arxiv_id":"2508.06471","doi":"10.48550/arxiv.2508.06471","metadata_source":"pith","pith_arxiv_id":"2508.06471","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","venue":"cs.CL","work_id":"5bb4e5d7-985e-431b-bb0d-75576cdc2950","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2508.06471","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:6ae810f48fe9f38dbaa5b2229a17a99a91c9b5570e5b87db8e5f8c0dbfcf7ce0","observation_id":"325cd7da-af23-4399-a85f-939f70e260d9","resolution":{"observed_at":"2026-05-13T10:13:58.998108Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proagent: building proactive cooperative agents with large language models","venue":null,"work_id":"b70ecdfe-2225-4543-b329-b36c3b7a0ab6","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:89609889034244b49223a2d98ba39ad35fb1f5774a0614915f220d5f51ec7ad2","observation_id":"02579d63-69a6-483f-9ecc-3f05b6c82663","resolution":{"observed_at":"2026-05-13T10:13:59.319576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18279","last_updated":"2025-05-06T15:08:00Z","snapshot_observed_at":"2026-07-06T19:57:55.925634Z","submitted_at":"2024-11-27T12:13:39Z","title":"Large Language Model-Brained GUI Agents: A Survey","version":12},"cited_work":{"arxiv_id":"2411.18279","doi":"10.48550/arxiv.2411.18279","metadata_source":"pith","pith_arxiv_id":"2411.18279","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Model-Brained GUI Agents: A Survey","venue":"cs.AI","work_id":"782b1dd3-0702-49e8-a23c-abe09cdc169a","year":2024},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2411.18279","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:3141a7151d915d0d53ac03617a8e94dda235b8e20455e8a54d1594a3421e07c2","observation_id":"f342a48a-feed-429c-b143-49a246ced4b1","resolution":{"observed_at":"2026-05-19T11:08:28.109115Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19314","last_updated":"2025-05-01T05:02:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-27T17:32:43Z","title":"BrowseComp-ZH: Benchmarking Web Browsing Ability of Large Language Models in Chinese","version":2},"cited_work":{"arxiv_id":"2504.19314","doi":"10.48550/arxiv.2504.19314","metadata_source":"pith","pith_arxiv_id":"2504.19314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BrowseComp-ZH: Benchmarking Web Browsing Ability of Large Language Models in Chinese","venue":"cs.CL","work_id":"d2997896-a54e-43f5-80ac-d4d548116d21","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2504.19314","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:5c3a10adad4d6eab4595dc6ad72ee6837ad1cd55939c5ffc6e235fecb9fb9c78","observation_id":"d64d02d7-b344-4ba1-a763-12477effec23","resolution":{"observed_at":"2026-05-17T22:04:50.009871Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-07-06T15:58:31.756298Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":"2307.13854","doi":"10.48550/arxiv.2307.13854","metadata_source":"pith","pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","venue":"cs.AI","work_id":"7058ffd2-a339-4102-89eb-248eeb074652","year":2023},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:6018d329e63962ac0774b4d248ef585d40f96dd261f9d5e94a1ffb6367eec1ea","observation_id":"c11eb651-6cb9-48b8-86bc-db002b5dbb9c","resolution":{"observed_at":"2026-05-13T10:13:59.024073Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning"},"reference_resolution":{"displayed":90,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":1,"unresolved":0,"verified_exact":54,"verified_fuzzy":31},"total_outbound_references":90},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 90 of 90 outbound references and 80 inbound Pith citation observations for arXiv:2509.02544."}