{"as_of":"2026-08-08T06:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:07fb19824a723525d2ed233a545637c736226b96548efbd67c8f1333665b8c86","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T06:01:31.581813Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.11896","doi":"10.48550/arxiv.2406.11896","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":"arXiv (Cornell University)","work_id":"fbe0b5bd-e928-4828-a7f5-fe7d0135ed13","year":2024},"citing_paper":{"arxiv_id":"2411.18279","last_updated":"2025-05-06T15:08:00Z","snapshot_observed_at":"2026-07-06T19:57:55.925634Z","submitted_at":"2024-11-27T12:13:39Z","title":"Large Language Model-Brained GUI Agents: A Survey","version":12},"reference_index":272,"source":"pdf_text","source_observed_at":"2026-05-19T11:08:27.472508Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2411.18279"},"observation_digest":"sha256:44c607f6b6b559346ac20388e191cb47b9af8e083aae65a95b9200e35a706878","observation_id":"5f3e55d0-2209-4451-961a-3e69d2040b29","resolution":{"observed_at":"2026-05-19T11:08:27.886474Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-08T06:01:31.581813Z","title":"org/CorpusID:236493482","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08226","last_updated":"2025-02-14T06:23:57Z","snapshot_observed_at":"2026-08-08T05:53:49.808163Z","submitted_at":"2025-02-12T09:12:30Z","title":"TRISHUL: Towards Region Identification and Screen Hierarchy Understanding for Large VLM based GUI Agents","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T06:01:31.581813Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2502.08226"},"observation_digest":"sha256:998a61320c12105c5265d4482448234d5e4e0f77a68444dbe65477808e085043","observation_id":"1e4b7b4c-0a65-427d-8e12-9cf119621f80","resolution":{"observed_at":"2026-08-08T06:01:31.581813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-07T20:57:48.364438Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.15760","last_updated":"2025-02-13T18:55:14Z","snapshot_observed_at":"2026-08-07T22:34:53.289352Z","submitted_at":"2025-02-13T18:55:14Z","title":"Digi-Q: Learning Q-Value Functions for Training Device-Control Agents","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T20:57:48.364438Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2502.15760"},"observation_digest":"sha256:8f24d9e7e4745715b92f6d7b0746d3f042cd0d3c2d5706d7350bbf1fbba3b265","observation_id":"d4454652-81f3-42e6-a2b3-9a537faf939f","resolution":{"observed_at":"2026-08-07T20:57:48.364438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.11896","doi":"10.48550/arxiv.2406.11896","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":"arXiv (Cornell University)","work_id":"fbe0b5bd-e928-4828-a7f5-fe7d0135ed13","year":2024},"citing_paper":{"arxiv_id":"2503.09572","last_updated":"2025-04-22T17:56:22Z","snapshot_observed_at":"2026-08-07T20:22:20.692339Z","submitted_at":"2025-03-12T17:40:52Z","title":"Plan-and-Act: Improving Planning of Agents for Long-Horizon Tasks","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T21:32:18.491541Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2503.09572"},"observation_digest":"sha256:42b4ea8e577be59a1dafef9a93871e56d0abcdc79e6d4fb16b3aebede99edb59","observation_id":"7ad6cb1e-f8ba-4bbc-93b3-c1624f9c133e","resolution":{"observed_at":"2026-05-17T21:32:18.576546Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.11896","doi":"10.48550/arxiv.2406.11896","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":"arXiv (Cornell University)","work_id":"fbe0b5bd-e928-4828-a7f5-fe7d0135ed13","year":2024},"citing_paper":{"arxiv_id":"2504.01990","last_updated":"2025-08-02T12:44:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-31T18:00:29Z","title":"Advances and Challenges in Foundation Agents: From Brain-Inspired Intelligence to Evolutionary, Collaborative, and Safe Systems","version":2},"reference_index":131,"source":"pdf_text","source_observed_at":"2026-05-22T21:39:49.832151Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2504.01990"},"observation_digest":"sha256:d7a11f9536da7123839fee969e9d31830b67ad8f6c33bfa6a56aeba17cc16b87","observation_id":"a24d3dba-8d57-4d66-bd5f-55b8283841e2","resolution":{"observed_at":"2026-05-22T21:42:10.964670Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-07T11:40:11.634772Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-08T06:17:02.407037Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.634772Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:460d080e06a50844fbcbe89d557cd9af85a553ba8ca5a2e018ad6fce719f8dd7","observation_id":"e7c33ebd-f11e-44f7-a256-d7d3f4bfdf96","resolution":{"observed_at":"2026-08-07T11:40:11.634772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-07T10:28:16.963397Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-08T02:17:06.461305Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:16.963397Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:d422da8eb4c18719e37ce83f7340677d4f10c80d346856771167b1d0a5e81cb2","observation_id":"e94ea10d-0614-4f9b-860c-ae435ececd19","resolution":{"observed_at":"2026-08-07T10:28:16.963397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-07T05:36:02.295962Z","title":"Hao Bai, Yifei Zhou, Mert Cemri, Jiayi Pan, Alane Suhr, Sergey Levine, and Aviral Kumar","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07636","last_updated":"2025-06-23T01:00:06Z","snapshot_observed_at":"2026-08-07T05:26:45.835942Z","submitted_at":"2025-06-09T11:03:16Z","title":"SWE-Dev: Building Software Engineering Agents with Training and Inference Scaling","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:02.295962Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2506.07636"},"observation_digest":"sha256:f209b7c253e873de29833c93033c9b352cc1a50bb817780191243abb1fd4ffc7","observation_id":"f7779880-9179-40b0-808c-83717c266519","resolution":{"observed_at":"2026-08-07T05:36:02.295962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-07T05:27:49.964683Z","title":"Di- girl: Training in-the-wild device-control agents with autonomous reinforcement learning.ArXiv, abs/2406.11896, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07976","last_updated":"2025-06-10T12:50:18Z","snapshot_observed_at":"2026-08-07T20:50:35.036523Z","submitted_at":"2025-06-09T17:50:02Z","title":"Thinking vs. Doing: Agents that Reason by Scaling Test-Time Interaction","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:27:49.964683Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2506.07976"},"observation_digest":"sha256:05d92ce519fcdc2b85d1905d2cb6de1061c47cc90959763f808ad97abd4ec2f1","observation_id":"c4d4bed2-1749-4bfe-ac01-17c9343ec65b","resolution":{"observed_at":"2026-08-07T05:27:49.964683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-07T05:25:59.230422Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08012","last_updated":"2025-06-09T17:59:57Z","snapshot_observed_at":"2026-08-07T21:54:44.419968Z","submitted_at":"2025-06-09T17:59:57Z","title":"GUI-Reflection: Empowering Multimodal GUI Models with Self-Reflection Behavior","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:25:59.230422Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2506.08012"},"observation_digest":"sha256:50a7e66860713a69778121465f3ee7459df36f556f6038fbf84c0ec7b15fa014","observation_id":"ad01e14f-f568-4893-a43d-b0afa9e9de4c","resolution":{"observed_at":"2026-08-07T05:25:59.230422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-07T05:04:02.686260Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.686260Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:3c284b765ed88fc82446bc3e9221dbecf618d7ec3abc0cd176634e34303ace48","observation_id":"e3d773ef-5b92-40cf-8a11-0faa6e9b0f1d","resolution":{"observed_at":"2026-08-07T05:04:02.686260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-05T14:22:41.778339Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21456","last_updated":"2025-08-29T09:39:00Z","snapshot_observed_at":"2026-08-07T14:15:36.132963Z","submitted_at":"2025-08-29T09:39:00Z","title":"Morae: Proactively Pausing UI Agents for User Choices","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:41.778339Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2508.21456"},"observation_digest":"sha256:051976729d01e35e3a4df25bb1da030d0b0178e7abe9e96a6d1226882a239b03","observation_id":"b1845b36-9aef-465d-ba2f-98b444bc38cf","resolution":{"observed_at":"2026-08-05T14:22:41.778339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-04T09:33:37.516249Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14828","last_updated":"2026-06-09T15:51:56Z","snapshot_observed_at":"2026-08-05T04:35:32.361585Z","submitted_at":"2025-10-16T16:04:35Z","title":"RoboGPT-R1: Enhancing Robot Task Planning with Reinforcement Learning","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T09:33:37.516249Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2510.14828"},"observation_digest":"sha256:0ebd2120ac416f4da4bf4a68d3be32187bee6297eb897f26bf4ba0a537b4d0a4","observation_id":"47da6e38-1052-4529-9f20-6bc6fe3661f4","resolution":{"observed_at":"2026-08-04T09:33:37.516249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-02T20:51:40.057308Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-02T20:51:33.578240Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:40.057308Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:bd0bdc826d976e067539e91d4605f4e9022bc20c854c22b94841f9ca88fb9df4","observation_id":"355963d0-0bc2-43bb-bc9d-3e7e4c12e1b3","resolution":{"observed_at":"2026-08-02T20:51:40.057308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.11896","doi":"10.48550/arxiv.2406.11896","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":"arXiv (Cornell University)","work_id":"fbe0b5bd-e928-4828-a7f5-fe7d0135ed13","year":2024},"citing_paper":{"arxiv_id":"2604.15607","last_updated":"2026-04-17T01:10:34Z","snapshot_observed_at":"2026-07-31T18:00:05.937926Z","submitted_at":"2026-04-17T01:10:34Z","title":"Imperfectly Cooperative Human-AI Interactions: Comparing the Impacts of Human and AI Attributes in Simulated and User Studies","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-10T09:39:56.132765Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2604.15607"},"observation_digest":"sha256:7466959b23ffc29806015cf326ed5cb1b260765eeaf5488a5792c1e531fed12f","observation_id":"53699552-90cd-4730-b690-5bdb26881479","resolution":{"observed_at":"2026-05-10T09:43:49.218927Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.11896","doi":"10.48550/arxiv.2406.11896","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":"arXiv (Cornell University)","work_id":"fbe0b5bd-e928-4828-a7f5-fe7d0135ed13","year":2024},"citing_paper":{"arxiv_id":"2605.05765","last_updated":"2026-05-21T06:55:40Z","snapshot_observed_at":"2026-08-07T03:54:21.317685Z","submitted_at":"2026-05-07T06:58:34Z","title":"X-OmniClaw Technical Report: A Unified Mobile Agent for Multimodal Understanding and Interaction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T14:53:52.019677Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2605.05765"},"observation_digest":"sha256:7aa8297d9326244ba8ce432d5cd309181448ffad757102b247ea28ccbb2ccefd","observation_id":"eb2eff33-30b9-4595-b298-bec0008e8fee","resolution":{"observed_at":"2026-05-11T18:41:08.618088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.11896","doi":"10.48550/arxiv.2406.11896","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":"arXiv (Cornell University)","work_id":"fbe0b5bd-e928-4828-a7f5-fe7d0135ed13","year":2024},"citing_paper":{"arxiv_id":"2605.05765","last_updated":"2026-05-21T06:55:40Z","snapshot_observed_at":"2026-08-07T03:54:21.317685Z","submitted_at":"2026-05-07T06:58:34Z","title":"X-OmniClaw Technical Report: A Unified Mobile Agent for Multimodal Understanding and Interaction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T09:50:00.415616Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2605.05765"},"observation_digest":"sha256:6b95b1987a2746edd557a0836da6dab11c024cb875bce73d52ab809e3c86869e","observation_id":"11d4a26d-5163-4211-9e2e-361aea54fa1a","resolution":{"observed_at":"2026-05-22T09:51:21.735886Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.11896","doi":"10.48550/arxiv.2406.11896","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":"arXiv (Cornell University)","work_id":"fbe0b5bd-e928-4828-a7f5-fe7d0135ed13","year":2024},"citing_paper":{"arxiv_id":"2606.06322","last_updated":"2026-06-04T15:57:29Z","snapshot_observed_at":"2026-08-08T01:19:00.742186Z","submitted_at":"2026-06-04T15:57:29Z","title":"DragOn: A Benchmark and Dataset for Drag-Based GUI Interactions","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-28T01:37:45.812577Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2606.06322"},"observation_digest":"sha256:60a84068e4e2c9b629bf3ddac1ba749d947aa6c5ac06a90c13557431e8e5a9ce","observation_id":"2d464d1f-8714-4984-b0d5-5b6250ad749c","resolution":{"observed_at":"2026-06-28T01:41:29.389207Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.11896","doi":"10.48550/arxiv.2406.11896","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":"arXiv (Cornell University)","work_id":"fbe0b5bd-e928-4828-a7f5-fe7d0135ed13","year":2024},"citing_paper":{"arxiv_id":"2606.09447","last_updated":"2026-06-08T12:55:42Z","snapshot_observed_at":"2026-07-06T23:48:48.962930Z","submitted_at":"2026-06-08T12:55:42Z","title":"AliyunConsoleAgent: Training Web Agents in Real-World Cloud Environments via Distillation and Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T16:22:05.424293Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2606.09447"},"observation_digest":"sha256:ee16b5095f80cb1ee8879107b69da4e941aa9940d429fc36a35cf83a60c3fe1b","observation_id":"5095580d-68f3-4e5c-a0ef-84c1e6dfbb58","resolution":{"observed_at":"2026-07-03T01:47:31.155254Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.11896","doi":"10.48550/arxiv.2406.11896","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":"arXiv (Cornell University)","work_id":"fbe0b5bd-e928-4828-a7f5-fe7d0135ed13","year":2024},"citing_paper":{"arxiv_id":"2606.29537","last_updated":"2026-07-13T10:30:17Z","snapshot_observed_at":"2026-07-17T23:18:06.822637Z","submitted_at":"2026-06-28T17:59:17Z","title":"OSWorld 2.0: Benchmarking Computer Use Agents on Long-Horizon Real-World Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T07:10:38.909339Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2606.29537"},"observation_digest":"sha256:e58962974159752fa40851d29690feabb2d8f402aac603306ff11ad19828b76a","observation_id":"8fa9f138-1523-4d8c-a5d8-3db86f1ace14","resolution":{"observed_at":"2026-06-30T07:14:21.216457Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-07-15T10:24:53.345620Z","title":"DigiRL: Training in-the-wild device-control agents with autonomous reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.29537","last_updated":"2026-07-13T10:30:17Z","snapshot_observed_at":"2026-07-17T23:18:06.822637Z","submitted_at":"2026-06-28T17:59:17Z","title":"OSWorld 2.0: Benchmarking Computer Use Agents on Long-Horizon Real-World Tasks","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-15T10:24:53.345620Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2606.29537"},"observation_digest":"sha256:9a034cbd73285fc330e3f3999ce93f665f1cddbe7a21c54270a2f47261f8c125","observation_id":"129e80f9-a4f3-44e4-b245-d3d53b26c939","resolution":{"observed_at":"2026-07-15T10:24:53.345620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-07-31T02:18:01.580579Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28609","last_updated":"2026-08-06T17:55:59Z","snapshot_observed_at":"2026-08-08T06:18:14.869928Z","submitted_at":"2026-07-30T17:57:41Z","title":"OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T02:18:01.580579Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2607.28609"},"observation_digest":"sha256:2a4a6b01860de1372c82316faa4331353397d5ee68aaee340f1e322a34bc8398","observation_id":"becb788d-5be3-4eb4-b251-72025671a35b","resolution":{"observed_at":"2026-07-31T02:18:01.580579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.11896/citation-record","integrity":"/paper/2406.11896/integrity","json":"/paper/2406.11896/citation-record.json","paper":"/paper/2406.11896"},"outbound":[],"paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2406.11896."}