{"as_of":"2026-08-13T02:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:993d61bdb3ef375bb52f6c0d00f439f92288b02c8928f1b20d245dd9557e8daf","coverage":[{"denominator":87,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":87,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T20:51:47.961506Z","state":"measured"},{"denominator":94,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":94,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:44:22.198316Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T11:56:55.516310Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"cited_work":{"arxiv_id":"2602.22190","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.22190","snapshot_observed_at":"2026-07-02T11:56:55.516310Z","title":"Gui-libra: Training native gui agents to reason and act with action-aware supervision and partially verifiable rl","venue":"cs.LG","work_id":"92549a20-b67b-4432-a2f1-81176c3e0d06","year":2026},"citing_paper":{"arxiv_id":"2605.10347","last_updated":"2026-05-22T05:43:30Z","snapshot_observed_at":"2026-07-06T23:22:18.704329Z","submitted_at":"2026-05-11T10:49:31Z","title":"How Mobile World Model Guides GUI Agents?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T04:28:34.562344Z"},"links":{"cited_paper":"/paper/2602.22190","citing_paper":"/paper/2605.10347"},"observation_digest":"sha256:0c8d3ddb38026bf3a50f0a4da36154f78be561f842b2c75d7481cbf91baa56c8","observation_id":"1e511dae-b2d1-43db-bfcb-deab746942b6","resolution":{"observed_at":"2026-05-27T02:04:34.683381Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"cited_work":{"arxiv_id":"2602.22190","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.22190","snapshot_observed_at":"2026-07-02T11:56:55.516310Z","title":"Gui-libra: Training native gui agents to reason and act with action-aware supervision and partially verifiable rl","venue":"cs.LG","work_id":"92549a20-b67b-4432-a2f1-81176c3e0d06","year":2026},"citing_paper":{"arxiv_id":"2605.10347","last_updated":"2026-05-22T05:43:30Z","snapshot_observed_at":"2026-07-06T23:22:18.704329Z","submitted_at":"2026-05-11T10:49:31Z","title":"How Mobile World Model Guides GUI Agents?","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-25T06:00:34.560405Z"},"links":{"cited_paper":"/paper/2602.22190","citing_paper":"/paper/2605.10347"},"observation_digest":"sha256:afba476cbff1640effdc3c76f08f5b5d428b24accdfbd65f77796c0a0aa4c512","observation_id":"ea4cfdd9-3dc1-41ff-b989-de3720d63a17","resolution":{"observed_at":"2026-05-27T02:04:34.683381Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"cited_work":{"arxiv_id":"2602.22190","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.22190","snapshot_observed_at":"2026-07-02T11:56:55.516310Z","title":"Gui-libra: Training native gui agents to reason and act with action-aware supervision and partially verifiable rl","venue":"cs.LG","work_id":"92549a20-b67b-4432-a2f1-81176c3e0d06","year":2026},"citing_paper":{"arxiv_id":"2605.12004","last_updated":"2026-05-12T11:54:23Z","snapshot_observed_at":"2026-08-11T09:18:52.581172Z","submitted_at":"2026-05-12T11:54:23Z","title":"Learning Agentic Policy from Action Guidance","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-13T05:02:49.206053Z"},"links":{"cited_paper":"/paper/2602.22190","citing_paper":"/paper/2605.12004"},"observation_digest":"sha256:08fd22195789064cc2105088041e2403ed7f8bbf2041d95c3cb6921793db2a45","observation_id":"64b3bdc3-82c7-4ed2-8889-7e699ce8bea5","resolution":{"observed_at":"2026-05-27T02:04:34.683381Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"cited_work":{"arxiv_id":"2602.22190","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.22190","snapshot_observed_at":"2026-07-02T11:56:55.516310Z","title":"Gui-libra: Training native gui agents to reason and act with action-aware supervision and partially verifiable rl","venue":"cs.LG","work_id":"92549a20-b67b-4432-a2f1-81176c3e0d06","year":2026},"citing_paper":{"arxiv_id":"2605.15963","last_updated":"2026-05-15T13:55:05Z","snapshot_observed_at":"2026-07-06T23:27:11.118592Z","submitted_at":"2026-05-15T13:55:05Z","title":"PAGER: Bridging the Semantic-Execution Gap in Point-Precise Geometric GUI Control","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-20T18:46:20.417039Z"},"links":{"cited_paper":"/paper/2602.22190","citing_paper":"/paper/2605.15963"},"observation_digest":"sha256:688218113734af238a74705c21d5222e15737e67b9d2dadd25178ee598020976","observation_id":"f1b5459a-a756-4a70-8539-8895bc52b352","resolution":{"observed_at":"2026-05-27T02:04:34.683381Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"cited_work":{"arxiv_id":"2602.22190","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.22190","snapshot_observed_at":"2026-07-02T11:56:55.516310Z","title":"Gui-libra: Training native gui agents to reason and act with action-aware supervision and partially verifiable rl","venue":"cs.LG","work_id":"92549a20-b67b-4432-a2f1-81176c3e0d06","year":2026},"citing_paper":{"arxiv_id":"2606.05597","last_updated":"2026-08-07T17:58:32Z","snapshot_observed_at":"2026-08-12T23:12:26.242059Z","submitted_at":"2026-06-04T02:18:44Z","title":"AsyncWebRL: Efficient Asynchronous Reinforcement Learning for Multi-Step Visual Web Agents","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-28T02:45:25.694378Z"},"links":{"cited_paper":"/paper/2602.22190","citing_paper":"/paper/2606.05597"},"observation_digest":"sha256:044a8d6e455252a41d7744b4586ddedec125f406e52bbad1e416c8054c53a54a","observation_id":"92b083bd-e12e-4610-81c9-8bebf8d79f9e","resolution":{"observed_at":"2026-07-02T11:56:55.517715Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.22190","snapshot_observed_at":"2026-08-12T00:44:22.198316Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07932","last_updated":"2026-08-08T05:39:48Z","snapshot_observed_at":"2026-08-13T01:11:48.547413Z","submitted_at":"2026-08-08T05:39:48Z","title":"SportsGrounder: Proposal-Aided Interleaved Grounding for Dense Sports Video Reasoning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T00:44:22.198316Z"},"links":{"cited_paper":"/paper/2602.22190","citing_paper":"/paper/2608.07932"},"observation_digest":"sha256:e13fd66a93ae21bc685ee98d1b650c66e5a5ea2440414a505a396a9f2de956fe","observation_id":"82ca7d81-97da-4b9f-ba93-b2be6818571f","resolution":{"observed_at":"2026-08-12T00:44:22.198316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.22190","snapshot_observed_at":"2026-08-11T20:19:16.243585Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09278","last_updated":"2026-08-10T08:33:19Z","snapshot_observed_at":"2026-08-13T01:17:04.592895Z","submitted_at":"2026-08-10T08:33:19Z","title":"Software Engineering for and with GUI Agent","version":1},"reference_index":300,"source":"pdf_text","source_observed_at":"2026-08-11T20:19:16.243585Z"},"links":{"cited_paper":"/paper/2602.22190","citing_paper":"/paper/2608.09278"},"observation_digest":"sha256:e37fcc99e2e99e0b37fcff86cd815085788ff3df46e07a4cabcd56733683ff2f","observation_id":"0b4ac350-6ea5-4f09-9410-f3717e958cbc","resolution":{"observed_at":"2026-08-11T20:19:16.243585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2602.22190/citation-record","integrity":"/paper/2602.22190/integrity","json":"/paper/2602.22190/citation-record.json","paper":"/paper/2602.22190"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:39.595656Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:39.595656Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:d6b9566651da2995efb5135431bba992c952cd61712cfa05fa397317bcf61456","observation_id":"6e652f09-70b4-4a49-b1e7-7cb17d8fa838","resolution":{"observed_at":"2026-08-02T20:51:39.595656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:39.708849Z","title":"Fara-7b: An efficient agentic model for computer use","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:39.708849Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:dc4ba281433411d8168d0fcb7d511bd2114eabb5c90af86dec49e149cdedcbd6","observation_id":"7ac63f35-e942-4b1f-9f78-7f71e6c7672c","resolution":{"observed_at":"2026-08-02T20:51:39.708849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:39.896351Z","title":"Uibert: Learning generic multimodal representations for ui understanding, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:39.896351Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:325951b3565c8322a0545274b542f231ce00e232cf3d96d484584800f5b6220b","observation_id":"b1c178a9-2be6-437b-8364-fb11b1d6718e","resolution":{"observed_at":"2026-08-02T20:51:39.896351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-12T23:42:29.168458Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-02T20:51:40.057308Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:40.057308Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:347d9a8e092dfdda6e92fd8477bd442c264bdece8b9883b156ff755b4714163e","observation_id":"355963d0-0bc2-43bb-bc9d-3e7e4c12e1b3","resolution":{"observed_at":"2026-08-02T20:51:40.057308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:40.200478Z","title":"Digi RL : Training in-the-wild device-control agents with autonomous reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:40.200478Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:c61b0f723ea782ffcdaf6e5fe8f7a6dba47deabd661cde874e2d914468079773","observation_id":"60d5b548-a1e9-4fd9-bf11-087dc2abab76","resolution":{"observed_at":"2026-08-02T20:51:40.200478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02439","last_updated":"2026-05-02T18:45:09Z","snapshot_observed_at":"2026-08-11T04:05:27.279416Z","submitted_at":"2026-01-05T09:35:11Z","title":"WebGym: Scaling Training Environments for Visual Web Agents with Realistic Tasks","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.02439","snapshot_observed_at":"2026-08-02T20:51:40.280648Z","title":"Webgym: Scaling training environments for visual web agents with realistic tasks","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:40.280648Z"},"links":{"cited_paper":"/paper/2601.02439","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:3fdda169b9030899e370a2f0a27d1013885b0f535b6b00eea277ed304d0b4258","observation_id":"14477464-be96-4e64-bc0c-b0d5824c1522","resolution":{"observed_at":"2026-08-02T20:51:40.280648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-11T14:42:37.584016Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-02T20:51:40.372101Z","title":"Qwen3-vl technical report, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:40.372101Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:02f645dcd5246538e399b55f8b3ea4372e4474229c541192a6b16e6e6d396a7f","observation_id":"d7567fb1-0730-4be7-9d34-20a5cd28eb33","resolution":{"observed_at":"2026-08-02T20:51:40.372101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-12T17:29:41.806995Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-02T20:51:40.488176Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:40.488176Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:2f187a0727ea8ef1961e33e7ec28dc13db6f5ee11a9f3ce1a05bed35628b8850","observation_id":"7c582dfa-54e1-40a1-a126-7e89b29eb21e","resolution":{"observed_at":"2026-08-02T20:51:40.488176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:40.581302Z","title":"AMEX : Android multi-annotation expo dataset for mobile GUI agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:40.581302Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:d6f610a6daff89118ed528fe8e78f3cad8d548c56511acf538bac44e6e8d416f","observation_id":"c857417a-9d2d-43ac-a66c-f06399a13159","resolution":{"observed_at":"2026-08-02T20:51:40.581302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:40.647987Z","title":"Era: Transforming vlms into embodied agents via embodied prior learning and online reinforcement learning, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:40.647987Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:8d192a99462086d90a0d5e3162f0abf88caaaf29094496f127978872adb04d20","observation_id":"5777b625-f567-48e8-842c-40724e527394","resolution":{"observed_at":"2026-08-02T20:51:40.647987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:40.741233Z","title":"Ui-ins: Enhancing gui grounding with multi-perspective instruction-as-reasoning, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:40.741233Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:cf89a90d0af4286ed0e37351b1d26669c9484c47b193a4d74d95d3b6873f248b","observation_id":"10ac2ed4-47a0-4554-ac3e-70870feb4fa7","resolution":{"observed_at":"2026-08-02T20:51:40.741233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:40.835625Z","title":"GUIC ourse: From general vision language model to versatile GUI agent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:40.835625Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:85b659522dd690a3e6502b72cfe21ea7272d3912caf75e557674342efd08b4ae","observation_id":"927b800c-f6d0-43d5-847f-e2e8e19021d9","resolution":{"observed_at":"2026-08-02T20:51:40.835625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10935","last_updated":"2024-02-23T04:36:51Z","snapshot_observed_at":"2026-08-11T07:36:02.871665Z","submitted_at":"2024-01-17T08:10:35Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10935","snapshot_observed_at":"2026-08-02T20:51:40.935767Z","title":"Seeclick: Harnessing gui grounding for advanced visual gui agents, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:40.935767Z"},"links":{"cited_paper":"/paper/2401.10935","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:9de4021caeddceca7f1c334c0662d880e22d9095e41a0468f87a34c8b30d9618","observation_id":"f1648194-23de-4384-ba6b-b7c21a3cf6ff","resolution":{"observed_at":"2026-08-02T20:51:40.935767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:41.022179Z","title":"S ee C lick: Harnessing GUI grounding for advanced visual GUI agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.022179Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:7ea326e239418ee03a0320ea82abe05ede13f1f40116359144def8178ccdb013","observation_id":"9e6de960-4f6c-490b-86f2-932687d6ce92","resolution":{"observed_at":"2026-08-02T20:51:41.022179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:41.088334Z","title":"Rico: A mobile app dataset for building data-driven design applications","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.088334Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:4095bd9f46d1b9a160700f6413ab72ab21ec454d6b4fb918fb6a146718eb8b47","observation_id":"8f38b1a0-e82a-4749-9870-f37d6e5c5971","resolution":{"observed_at":"2026-08-02T20:51:41.088334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:41.153829Z","title":"Mind2web: Towards a generalist agent for the web","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.153829Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:269f854dcf49a470d1d07b210b57441fec0611347e9e52b3b7f732451db54b22","observation_id":"1ae8b9fe-3c6b-42d9-bc1d-7f0c3bb717c8","resolution":{"observed_at":"2026-08-02T20:51:41.153829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17352","last_updated":"2025-11-11T08:13:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-21T17:52:43Z","title":"OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17352","snapshot_observed_at":"2026-08-02T20:51:41.234653Z","title":"Openvlthinker: Complex vision-language reasoning via iterative sft-rl cycles, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.234653Z"},"links":{"cited_paper":"/paper/2503.17352","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:75d257fb44e8f915c0bbe30f02bec2d8e34df90f0d075807d4d208c7bf55986e","observation_id":"c3eecac9-0ddd-4fcf-830f-3c61b57818c4","resolution":{"observed_at":"2026-08-02T20:51:41.234653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10978","last_updated":"2025-10-28T15:11:36Z","snapshot_observed_at":"2026-07-29T19:20:21.974239Z","submitted_at":"2025-05-16T08:26:59Z","title":"Group-in-Group Policy Optimization for LLM Agent Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10978","snapshot_observed_at":"2026-08-02T20:51:41.334848Z","title":"Group-in-group policy optimization for llm agent training, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.334848Z"},"links":{"cited_paper":"/paper/2505.10978","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:3148e3c7e1686c18598e3e33347007758271c3cd5ca00f82bc5a698dab1a0fe0","observation_id":"d6afb091-cd27-4c5b-8c3f-9224b83ddbcb","resolution":{"observed_at":"2026-08-02T20:51:41.334848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:41.406160Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.406160Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:b73626cc670e309cf3280139c41ba014bec322645cb613ee0008072c2a046976","observation_id":"f82b00b0-b0de-45d7-b018-ccbbc6336f52","resolution":{"observed_at":"2026-08-02T20:51:41.406160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:41.470504Z","title":"Navigating the digital world as humans do: Universal visual grounding for GUI agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.470504Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:326c352a4ce69f33504e8831938374850cef892293b2cdfe3cbb6c9751eddf1b","observation_id":"ca6930ee-f58a-4fc0-8047-0d3560597122","resolution":{"observed_at":"2026-08-02T20:51:41.470504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10833","last_updated":"2025-08-15T14:49:07Z","snapshot_observed_at":"2026-08-06T22:18:30.515234Z","submitted_at":"2025-08-14T16:58:07Z","title":"UI-Venus Technical Report: Building High-performance UI Agents with RFT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10833","snapshot_observed_at":"2026-08-02T20:51:41.570164Z","title":"Ui-venus technical report: Building high-performance ui agents with rft, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.570164Z"},"links":{"cited_paper":"/paper/2508.10833","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:a8b294163b9f7f0a7c526a7a9610425086eec9572cc4fe7f27d36aa9d98f47ed","observation_id":"38469782-6ce8-473b-a51a-60378d397cec","resolution":{"observed_at":"2026-08-02T20:51:41.570164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:41.626666Z","title":"Scalable data synthesis for computer use agents with step-level filtering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.626666Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:1985e5878d97f4635871201b2403871753ec4a13e8f4fa1d9f4bef40d0672b61","observation_id":"66b7ce4b-2806-4ecb-acfd-e2a20e8e9621","resolution":{"observed_at":"2026-08-02T20:51:41.626666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:41.709616Z","title":"Cogagent: A visual language model for gui agents, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.709616Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:e3683e08703005bfc47a704a63e53722672ed059e943a5c55d173c5fee0862e7","observation_id":"21f88a99-059f-476c-b015-b335f9e403b8","resolution":{"observed_at":"2026-08-02T20:51:41.709616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08914","last_updated":"2024-12-27T06:56:18Z","snapshot_observed_at":"2026-08-09T18:08:10.124923Z","submitted_at":"2023-12-14T13:20:57Z","title":"CogAgent: A Visual Language Model for GUI Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08914","snapshot_observed_at":"2026-08-02T20:51:41.781289Z","title":"Cogagent: A visual language model for gui agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.781289Z"},"links":{"cited_paper":"/paper/2312.08914","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:28969c0ecb5e656a22eb0de3dd82a257b923fab969cbf74c0a65f067c952123e","observation_id":"0ed4a0e8-0cda-4841-95b3-4d180ee4915f","resolution":{"observed_at":"2026-08-02T20:51:41.781289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-02T20:51:41.856269Z","title":"Glm-4.1 v-thinking: Towards versatile multimodal reasoning with scalable reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.856269Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:703e01942848e2208eeefe72f710d423de574c52898da51ebabfc699a98bc43c","observation_id":"23d1880b-e77c-4be0-8565-7b374eecc4eb","resolution":{"observed_at":"2026-08-02T20:51:41.856269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:41.937161Z","title":"Screenspot-pro: Gui grounding for professional high-resolution computer use","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:41.937161Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:ec0d069f9c3ccc317ca43c22df25d93b0093b7a144850fcb8d0fc40d106ee2cc","observation_id":"3b6e6c30-575f-44e9-a0b2-21e30ef67aa6","resolution":{"observed_at":"2026-08-02T20:51:41.937161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:42.020689Z","title":"On the effects of data scale on UI control agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:42.020689Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:b9096bf6264676fcae38a69123ec1ba0710aedc62ea01e35c09a135eae27ae79","observation_id":"b414e4b6-5452-4ab6-aac6-b2fecedcc055","resolution":{"observed_at":"2026-08-02T20:51:42.020689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:42.119885Z","title":"Mapping natural language instructions to mobile UI action sequences","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:42.119885Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:9287afdd10a43192a423231712be048fc141cd00b233363ca9f7045e85f89138","observation_id":"3065b7c4-c6a2-4c9f-99a5-7be335d83ecf","resolution":{"observed_at":"2026-08-02T20:51:42.119885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:42.196640Z","title":"Widget captioning: Generating natural language description for mobile user interface elements","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:42.196640Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:89ecf38913beedb04d12e5826e7aed6d44285322c15b1ba45e6906c76ddb9755","observation_id":"ae98de42-a5a8-4d76-905b-01a24ea2be5a","resolution":{"observed_at":"2026-08-02T20:51:42.196640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17465","last_updated":"2024-11-26T14:29:47Z","snapshot_observed_at":"2026-08-12T12:03:09.032622Z","submitted_at":"2024-11-26T14:29:47Z","title":"ShowUI: One Vision-Language-Action Model for GUI Visual Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17465","snapshot_observed_at":"2026-08-02T20:51:42.283887Z","title":"Showui: One vision-language-action model for gui visual agent, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:42.283887Z"},"links":{"cited_paper":"/paper/2411.17465","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:08b625a98b824f9d182a713a0ef66c08694f98f50ad1ca24022c4311c2886a1e","observation_id":"37e5ef16-a407-4fb9-bb37-3c778e521058","resolution":{"observed_at":"2026-08-02T20:51:42.283887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:42.356008Z","title":"What can rl bring to vla generalization? an empirical study, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:42.356008Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:dfe607a36e1f282269a2ca8c710fc72e3681a69b855df66998e1aeeaf937e76b","observation_id":"4f503664-42e3-4ec9-b47e-323d777e7c9e","resolution":{"observed_at":"2026-08-02T20:51:42.356008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00820","last_updated":"2024-10-28T17:05:10Z","snapshot_observed_at":"2026-08-12T22:13:35.439009Z","submitted_at":"2024-10-28T17:05:10Z","title":"AutoGLM: Autonomous Foundation Agents for GUIs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00820","snapshot_observed_at":"2026-08-02T20:51:42.436786Z","title":"Autoglm: Autonomous foundation agents for guis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:42.436786Z"},"links":{"cited_paper":"/paper/2411.00820","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:5204aad7b8b6e4eb40849d8c2d3f7fb400098620debefb1671775b8ccd49ddcb","observation_id":"17283d8a-d012-4ebb-bf77-53c42546aa3a","resolution":{"observed_at":"2026-08-02T20:51:42.436786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:42.537299Z","title":"Visualagentbench: Towards large multimodal models as visual foundation agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:42.537299Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:f4ea52466f06028df1744d1aa37d96783fc8b327507ebab64cc1846655fab769","observation_id":"50122f9e-3853-4e02-896a-7b9e06661d69","resolution":{"observed_at":"2026-08-02T20:51:42.537299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:42.639823Z","title":"Infigui-g1: Advancing gui grounding with adaptive exploration policy optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:42.639823Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:6cd77b81d80b566716dfe913cc6585f66642a1c7773fbda820c0af2a4e03c847","observation_id":"33949333-e356-4668-90e5-8f2d3bb69805","resolution":{"observed_at":"2026-08-02T20:51:42.639823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:42.708422Z","title":"Scalecua: Scaling open-source computer use agents with cross-platform data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:42.708422Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:3e3941dbbe4289d16c96a7113fea4d62f732ad4f33ea144e3d74faf580f747fe","observation_id":"9b4d659e-65ec-4dd9-a7c8-8fc87ecd151b","resolution":{"observed_at":"2026-08-02T20:51:42.708422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-08-12T02:21:51.598634Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-02T20:51:42.815891Z","title":"Understanding r1-zero-like training: A critical perspective","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:42.815891Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:0a59a64e5bbcdf9831c157b3714b2d5499146909abc27faf7e2809d1fe30898d","observation_id":"d545fa2c-f017-495e-8626-1012b854356c","resolution":{"observed_at":"2026-08-02T20:51:42.815891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08451","last_updated":"2025-08-01T03:37:57Z","snapshot_observed_at":"2026-08-12T23:44:18.235848Z","submitted_at":"2024-06-12T17:44:26Z","title":"GUIOdyssey: A Comprehensive Dataset for Cross-App GUI Navigation on Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08451","snapshot_observed_at":"2026-08-02T20:51:42.885175Z","title":"Gui odyssey: A comprehensive dataset for cross-app gui navigation on mobile devices","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:42.885175Z"},"links":{"cited_paper":"/paper/2406.08451","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:d794f996644a5cd7e14a8819fec372300c067aec5a796c66f9e071fc4755f3ac","observation_id":"687ce515-40ee-4ecd-b744-12acbd934150","resolution":{"observed_at":"2026-08-02T20:51:42.885175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21620","last_updated":"2025-05-24T08:46:08Z","snapshot_observed_at":"2026-08-01T20:06:59.931737Z","submitted_at":"2025-03-27T15:39:30Z","title":"UI-R1: Enhancing Efficient Action Prediction of GUI Agents by Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21620","snapshot_observed_at":"2026-08-02T20:51:42.979477Z","title":"Ui-r1: Enhancing action prediction of gui agents by reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:42.979477Z"},"links":{"cited_paper":"/paper/2503.21620","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:52b554203bda530d9db125d59f47e9a637ba8d630099152f639e518d5340c984","observation_id":"2ec95887-07b3-4f19-a857-2d25c2f5ad04","resolution":{"observed_at":"2026-08-02T20:51:42.979477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10458","last_updated":"2025-10-01T04:55:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:45:54Z","title":"GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10458","snapshot_observed_at":"2026-08-02T20:51:43.072415Z","title":"Gui-r1: A generalist r1-style vision-language action model for gui agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:43.072415Z"},"links":{"cited_paper":"/paper/2504.10458","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:b4af6fd1e643c43f721ea225180f0acaf49cc81ad3ba3d67fd7c509319b54dac","observation_id":"8963f312-605f-4b8e-948c-973021682eec","resolution":{"observed_at":"2026-08-02T20:51:43.072415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:43.171075Z","title":"Gui-360 ^ : A comprehensive dataset and benchmark for computer-using agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:43.171075Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:59a31d40edab373f933856ea1fa798885a1b1e456be65bb4dda7e172c9be9147","observation_id":"60aed442-2c10-4604-aafa-a6b3f14b8b05","resolution":{"observed_at":"2026-08-02T20:51:43.171075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:43.267652Z","title":"Rodriguez, Montek Kalsi, Nicolas Chapados, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:43.267652Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:3560679d6fc0be749b2bb4b97ef4d66f7ef82ebcef037a75f182dc7f95ecb34e","observation_id":"85e8445c-66bc-4476-95b7-24e0a676dc58","resolution":{"observed_at":"2026-08-02T20:51:43.267652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-02T20:51:43.349369Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:43.349369Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:94469e1334032127ebfe10f1c76e2a8acc694073ef7fb3cabf5d7e43254983df","observation_id":"98da29d5-d781-4c7e-88a4-e6dba02719f9","resolution":{"observed_at":"2026-08-02T20:51:43.349369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:43.405282Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:43.405282Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:571d8e7c8822755ae44ac56a8702a35a8fd94381b50f2a4a924139765ac3132e","observation_id":"469504ba-e137-4376-8b04-4f4ca4ab0282","resolution":{"observed_at":"2026-08-02T20:51:43.405282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07199","last_updated":"2024-08-13T20:52:13Z","snapshot_observed_at":"2026-08-12T15:20:41.947055Z","submitted_at":"2024-08-13T20:52:13Z","title":"Agent Q: Advanced Reasoning and Learning for Autonomous AI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07199","snapshot_observed_at":"2026-08-02T20:51:43.482352Z","title":"Agent q: Advanced reasoning and learning for autonomous ai agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:43.482352Z"},"links":{"cited_paper":"/paper/2408.07199","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:4765c1d415b6c72d8b933631c78baf728eeeb732ddfaef36495f5a92725c41c8","observation_id":"da766005-eba3-446d-90aa-c7327e77d887","resolution":{"observed_at":"2026-08-02T20:51:43.482352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02337","last_updated":"2025-01-27T11:56:15Z","snapshot_observed_at":"2026-08-12T22:08:01.336040Z","submitted_at":"2024-11-04T17:59:58Z","title":"WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02337","snapshot_observed_at":"2026-08-02T20:51:43.534953Z","title":"Webrl: Training llm web agents via self-evolving online curriculum reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:43.534953Z"},"links":{"cited_paper":"/paper/2411.02337","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:636a270b4cb2c2820aeb32258b2bd9338fd2571531ae5cde81aa5db3f20fc29c","observation_id":"577a560a-e36c-4b7c-91b0-9fe6805dd2df","resolution":{"observed_at":"2026-08-02T20:51:43.534953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-08-02T20:51:43.670089Z","title":"Ui-tars: Pioneering automated gui interaction with native agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:43.670089Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:991d129c464bde2b171c300b562d2b9426cdfeb92e3d989a372d31e73af67422","observation_id":"cfb42c2b-41a8-42cd-841e-751ecb5e11f4","resolution":{"observed_at":"2026-08-02T20:51:43.670089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:43.724241Z","title":"Android in the wild: a large-scale dataset for android device control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:43.724241Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:e94c866b2186081939d213ba379c382bb535dcb4b9b02191982d2ac3baba3838","observation_id":"a5ab4d93-90fd-47ea-b027-de3fe24e80d1","resolution":{"observed_at":"2026-08-02T20:51:43.724241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:43.788162Z","title":"Androidworld: A dynamic benchmarking environment for autonomous agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:43.788162Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:e22448a44369aa22914bbb77db57f27d02ebd5ee867ba09876d43741da94bd8a","observation_id":"ab889816-6b89-4eac-8042-9421659a9d06","resolution":{"observed_at":"2026-08-02T20:51:43.788162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T20:51:43.830923Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:43.830923Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:7b0354bff67e1d1d80ae601751b85c5ec4be64e675f0ea422c831c028cb57c8b","observation_id":"705e1b13-423c-429d-a2ac-67b2f46612d0","resolution":{"observed_at":"2026-08-02T20:51:43.830923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19723","last_updated":"2025-06-27T08:25:48Z","snapshot_observed_at":"2026-08-10T23:53:32.316930Z","submitted_at":"2024-12-27T16:21:58Z","title":"OS-Genesis: Automating GUI Agent Trajectory Construction via Reverse Task Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19723","snapshot_observed_at":"2026-08-02T20:51:43.957635Z","title":"Os-genesis: Automating gui agent trajectory construction via reverse task synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:43.957635Z"},"links":{"cited_paper":"/paper/2412.19723","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:1f36e34ee14b23c2557d3c1bd8fd524cc365c7c8ba1344388800ffe0184627d3","observation_id":"8a936a0d-0f04-4903-9915-1d175039698a","resolution":{"observed_at":"2026-08-02T20:51:43.957635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15846","last_updated":"2025-07-28T16:54:13Z","snapshot_observed_at":"2026-08-12T12:54:07.864402Z","submitted_at":"2025-07-21T17:53:42Z","title":"GUI-G$^2$: Gaussian Reward Modeling for GUI Grounding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15846","snapshot_observed_at":"2026-08-02T20:51:44.048532Z","title":"Gui-g ^2 : Gaussian reward modeling for gui grounding, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.048532Z"},"links":{"cited_paper":"/paper/2507.15846","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:ea9555e7a14935557063217ef6f89e059a344a2ad0d5c478dd75dbbecf4d7cc2","observation_id":"37e2c66c-84cb-4965-84a3-2ebdf66a680f","resolution":{"observed_at":"2026-08-02T20:51:44.048532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-11T12:35:47.937091Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-08-02T20:51:44.108333Z","title":"Ui-tars-2 technical report: Advancing gui agent with multi-turn reinforcement learning, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.108333Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:3deb1466d2d0fa6840adf8123b1fa8b2bb4f4199834657d262a49cf91046fd47","observation_id":"3b732d0d-0c29-4eba-98fa-75812375cd22","resolution":{"observed_at":"2026-08-02T20:51:44.108333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:44.187749Z","title":"Think or not? selective reasoning via reinforcement learning for vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.187749Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:7623dd52f196d16a69a79148b2e50bb8801858220d6e6f7332795bcc88c9ce55","observation_id":"52d685bc-6f57-463e-b576-c32b2849a8da","resolution":{"observed_at":"2026-08-02T20:51:44.187749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:44.245492Z","title":"Vagen: Reinforcing world model reasoning for multi-turn vlm agents, 2025 c","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.245492Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:08949d2c93b09c64164f5cac832c7ef9ee8ca649deeda4c32796d4192c4a3394","observation_id":"6fdf11e7-a310-4aab-96a4-1d102e6ba8b0","resolution":{"observed_at":"2026-08-02T20:51:44.245492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:44.294692Z","title":"Open CUA : Open foundations for computer-use agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.294692Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:198608129042d96a664a3f065d8b670340c4465618a83c43b8732dc0fbf86a7c","observation_id":"88e2232c-5d4c-4c01-8590-a3905c01e98f","resolution":{"observed_at":"2026-08-02T20:51:44.294692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12966","last_updated":"2023-07-24T17:44:58Z","snapshot_observed_at":"2026-08-11T19:09:11.098841Z","submitted_at":"2023-07-24T17:44:58Z","title":"Aligning Large Language Models with Human: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12966","snapshot_observed_at":"2026-08-02T20:51:44.365668Z","title":"Aligning large language models with human: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.365668Z"},"links":{"cited_paper":"/paper/2307.12966","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:83fa01b6a27a0a2feabf4c55ec523ebea79f3b0a74aaa4ff0857966d4dc57894","observation_id":"f7106de7-e6a0-43d1-bc18-be09eb504468","resolution":{"observed_at":"2026-08-02T20:51:44.365668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:44.432190Z","title":"Webui: A dataset for enhancing visual ui understanding with web semantics","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.432190Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:64d7ac5f9e96cbc4db7939c363aac8c3b969b42fa817c36c44029d7c5c4ea536","observation_id":"f81078ce-e2ed-4224-ab73-697f1150e41b","resolution":{"observed_at":"2026-08-02T20:51:44.432190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03143","last_updated":"2025-06-03T17:59:08Z","snapshot_observed_at":"2026-08-12T00:20:29.515481Z","submitted_at":"2025-06-03T17:59:08Z","title":"GUI-Actor: Coordinate-Free Visual Grounding for GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03143","snapshot_observed_at":"2026-08-02T20:51:44.479478Z","title":"Gui-actor: Coordinate-free visual grounding for gui agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.479478Z"},"links":{"cited_paper":"/paper/2506.03143","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:777e27d11570a53f2aadf682eb7ebb42c7e855939d2c460550eeaa330f920a4f","observation_id":"151c1528-593a-4f64-9f35-062df349735e","resolution":{"observed_at":"2026-08-02T20:51:44.479478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23218","last_updated":"2024-10-30T17:10:19Z","snapshot_observed_at":"2026-08-12T18:02:58.527813Z","submitted_at":"2024-10-30T17:10:19Z","title":"OS-ATLAS: A Foundation Action Model for Generalist GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23218","snapshot_observed_at":"2026-08-02T20:51:44.528884Z","title":"Os-atlas: A foundation action model for generalist gui agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.528884Z"},"links":{"cited_paper":"/paper/2410.23218","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:62b7fb8f44b21e2df3f540731f53723c6a9bf55eb72a65747c5ad23552561ba6","observation_id":"1b01d2f5-5e8a-434f-945c-a6eafd4940db","resolution":{"observed_at":"2026-08-02T20:51:44.528884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:44.598785Z","title":"OS - ATLAS : Foundation action model for generalist GUI agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.598785Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:75a5390bdd7cd2b09454eff7c71758b48e893c1427f754a37eb05a8d9925f0e2","observation_id":"26b3dd2b-62c5-4a2f-b89c-4c1e6cf95440","resolution":{"observed_at":"2026-08-02T20:51:44.598785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:44.685008Z","title":"Scaling computer-use grounding via user interface decomposition and synthesis, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.685008Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:8122b4ff85e7f417e0d3ff4dd730e782fb9dbc75f40aca25c72f6c00260b2ec3","observation_id":"204c913d-998c-4b24-be91-9544e9954814","resolution":{"observed_at":"2026-08-02T20:51:44.685008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:44.747371Z","title":"Agenttrek: Agent trajectory synthesis via guiding replay with web tutorials","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.747371Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:851f949c18982360d89c6caa53006f9064bf91cca6b4d212210428456d513e76","observation_id":"9373532d-b9f6-41f4-9d86-ef4aa26521a9","resolution":{"observed_at":"2026-08-02T20:51:44.747371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09605","last_updated":"2025-03-03T18:59:36Z","snapshot_observed_at":"2026-08-11T16:50:14.467445Z","submitted_at":"2024-12-12T18:59:27Z","title":"AgentTrek: Agent Trajectory Synthesis via Guiding Replay with Web Tutorials","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09605","snapshot_observed_at":"2026-08-02T20:51:44.793620Z","title":"Agenttrek: Agent trajectory synthesis via guiding replay with web tutorials, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.793620Z"},"links":{"cited_paper":"/paper/2412.09605","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:2fd4f1fbbb91f78cc15461bf136248f2e929b880282f6a0786b8ca2e40ddf77d","observation_id":"32d351d7-7f8a-414a-9c0d-082eb35f7317","resolution":{"observed_at":"2026-08-02T20:51:44.793620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:44.962555Z","title":"Aguvis: Unified pure vision agents for autonomous GUI interaction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:44.962555Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:62e0438e8ea1b5e33deccc00716ec80905c69c775920e787602dc3b79fd62be0","observation_id":"b61f86d4-45e2-4fad-9ca9-8bd250199690","resolution":{"observed_at":"2026-08-02T20:51:44.962555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:45.035019Z","title":"An illusion of progress? assessing the current state of web agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:45.035019Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:0c9d4ca9939d1b178291bffe2ac38caed7935614c2b9d15d6acc01358cd0b2fe","observation_id":"38177d91-8fc9-4041-81a0-6e446cd62a35","resolution":{"observed_at":"2026-08-02T20:51:45.035019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16419","last_updated":"2025-04-27T06:52:23Z","snapshot_observed_at":"2026-08-12T07:44:36.633997Z","submitted_at":"2025-04-23T05:01:25Z","title":"PixelWeb: The First Web GUI Dataset with Pixel-Wise Labels","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16419","snapshot_observed_at":"2026-08-02T20:51:45.176089Z","title":"Pixelweb: The first web gui dataset with pixel-wise labels, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:45.176089Z"},"links":{"cited_paper":"/paper/2504.16419","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:1e38625b0c7a3dde3edf8d1a0453b9405bbc25bf5784dd0848b96f68891e13de","observation_id":"8c51f430-dbfb-4d11-b26b-06a947c88010","resolution":{"observed_at":"2026-08-02T20:51:45.176089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:45.292094Z","title":"Regularizing hidden states enables learning generalizable reward model for llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:45.292094Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:8139f07426f3f5d9250a4317ab4f089c0ad07948768e858cb562eb4f9ddb0fe2","observation_id":"87390374-c43c-4d16-b791-f56a6902f11e","resolution":{"observed_at":"2026-08-02T20:51:45.292094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10207","last_updated":"2024-10-16T03:24:02Z","snapshot_observed_at":"2026-08-10T12:10:18.155478Z","submitted_at":"2024-02-15T18:58:31Z","title":"Rewards-in-Context: Multi-objective Alignment of Foundation Models with Dynamic Preference Adjustment","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10207","snapshot_observed_at":"2026-08-02T20:51:45.443374Z","title":"Rewards-in-context: Multi-objective alignment of foundation models with dynamic preference adjustment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:45.443374Z"},"links":{"cited_paper":"/paper/2402.10207","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:66c612534f779cc98377ca0d2b29107bf457d158431b7aef6fd35e38ee54c58c","observation_id":"e0b42742-611c-422a-8e2c-7ff795a6b75d","resolution":{"observed_at":"2026-08-02T20:51:45.443374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05791","last_updated":"2025-10-03T23:50:19Z","snapshot_observed_at":"2026-07-30T10:31:35.758747Z","submitted_at":"2025-07-08T08:52:18Z","title":"GTA1: GUI Test-time Scaling Agent","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05791","snapshot_observed_at":"2026-08-02T20:51:45.581241Z","title":"Gta1: Gui test-time scaling agent, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:45.581241Z"},"links":{"cited_paper":"/paper/2507.05791","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:bff7ade7819d8a89ea354674eb6872154655c0fc29e381619f2f92d98b7c03d6","observation_id":"599cc278-1405-46a6-bcdc-52e4c5c562fa","resolution":{"observed_at":"2026-08-02T20:51:45.581241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16256","last_updated":"2025-07-08T08:49:17Z","snapshot_observed_at":"2026-08-11T11:13:46.655837Z","submitted_at":"2024-12-20T07:16:57Z","title":"Aria-UI: Visual Grounding for GUI Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16256","snapshot_observed_at":"2026-08-02T20:51:45.689795Z","title":"Aria-ui: Visual grounding for gui instructions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:45.689795Z"},"links":{"cited_paper":"/paper/2412.16256","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:a3a11a4d81aeb31461ded79847347e124af689bd27b9e2a837f48ff7bd04af7b","observation_id":"f6ed61cb-cf8c-408a-9580-41ff07dce058","resolution":{"observed_at":"2026-08-02T20:51:45.689795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:45.746543Z","title":"Ferret-ui lite: Lessons from building small on-device gui agents, 2025 c","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:45.746543Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:f588af0f9e2cbd003493fdc5d22fa6b3d1b201d1ecb72c4fb09c76f8ff5c696e","observation_id":"71647ddb-11e1-48db-ae83-7741d18085b3","resolution":{"observed_at":"2026-08-02T20:51:45.746543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-02T20:51:45.825148Z","title":"Dapo: An open-source llm reinforcement learning system at scale","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:45.825148Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:c9810fce6daecc36effec7ba9a96b636bcbb830062547a4db0e560f2284c7d54","observation_id":"d58c2c67-89e2-45ae-89b2-5b3a2f70efd4","resolution":{"observed_at":"2026-08-02T20:51:45.825148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10292","last_updated":"2024-10-07T19:13:47Z","snapshot_observed_at":"2026-08-13T01:47:35.713102Z","submitted_at":"2024-05-16T17:50:19Z","title":"Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10292","snapshot_observed_at":"2026-08-02T20:51:45.970836Z","title":"Fine-tuning large vision-language models as decision-making agents via reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:45.970836Z"},"links":{"cited_paper":"/paper/2405.10292","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:bb9962c6909295af66f4e7b1f6e3e980dfebd8e4ccd8ba0817697b70b0538bba","observation_id":"35288331-b6b7-471c-92c2-4973e245f65b","resolution":{"observed_at":"2026-08-02T20:51:45.970836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:46.137969Z","title":"Visual backdoor attacks on mllm embodied decision making via contrastive trigger learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:46.137969Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:47f7e607a253d6e65d087d079047057cc100374fd377cece37623e5f4eb69a60","observation_id":"6bb19ecd-e214-40df-bda9-927fcc3177b9","resolution":{"observed_at":"2026-08-02T20:51:46.137969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:46.309031Z","title":"Tongui: Internet-scale trajectories from multimodal web tutorials for generalized gui agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:46.309031Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:1f75d000fe0d64a6c7da9b0d60dd34e2d2a9c931e0df4ecb908ba7b68b90fc08","observation_id":"ece36221-3a4f-4b8c-958c-ebb3e9f26c90","resolution":{"observed_at":"2026-08-02T20:51:46.309031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:46.419042Z","title":"Android in the zoo: Chain-of-action-thought for GUI agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:46.419042Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:e2c13c267e220d106dec7e7842f0694c61ebfb1b97aef957239a6805aad94393","observation_id":"a161721e-2ce0-42a5-99e2-acd0982487d8","resolution":{"observed_at":"2026-08-02T20:51:46.419042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08558","last_updated":"2026-05-24T21:56:11Z","snapshot_observed_at":"2026-08-04T10:47:54.049813Z","submitted_at":"2025-10-09T17:59:17Z","title":"Agent Learning via Early Experience","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.08558","snapshot_observed_at":"2026-08-02T20:51:46.531155Z","title":"Agent learning via early experience","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:46.531155Z"},"links":{"cited_paper":"/paper/2510.08558","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:a8ae0005532b651322b4a6a1ff98157ffd9fddd43a92984a6e207d51f311458d","observation_id":"cd77b6ba-29ef-4761-a3df-410a882af35c","resolution":{"observed_at":"2026-08-02T20:51:46.531155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23779","last_updated":"2025-07-31T17:59:09Z","snapshot_observed_at":"2026-08-08T14:45:38.446269Z","submitted_at":"2025-07-31T17:59:09Z","title":"Phi-Ground Tech Report: Advancing Perception in GUI Grounding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23779","snapshot_observed_at":"2026-08-02T20:51:46.702023Z","title":"Phi-ground tech report: Advancing perception in gui grounding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:46.702023Z"},"links":{"cited_paper":"/paper/2507.23779","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:d3d0e419105b05aa78862c82134e97b290c48556c0e603d05f9206735803cedb","observation_id":"b3853c00-df93-4e19-926b-f4e2304c78bd","resolution":{"observed_at":"2026-08-02T20:51:46.702023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:46.816068Z","title":"Gpt-4v(ision) is a generalist web agent, if grounded","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:46.816068Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:34e468cad0d62bff679400302457fe93e60460490c85bb575d96e95c388c0a9f","observation_id":"285b02d5-c71e-4438-a921-c6380e2f52e7","resolution":{"observed_at":"2026-08-02T20:51:46.816068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18071","last_updated":"2025-07-28T11:11:33Z","snapshot_observed_at":"2026-08-12T16:05:52.077251Z","submitted_at":"2025-07-24T03:50:32Z","title":"Group Sequence Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.18071","snapshot_observed_at":"2026-08-02T20:51:46.984573Z","title":"Group sequence policy optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:46.984573Z"},"links":{"cited_paper":"/paper/2507.18071","citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:f8d05f12ecf4d73e98d41adea57cd67a722337b4b831d4622e09b3ae7332b2d9","observation_id":"a8b201de-bd34-49f2-b9d9-4132c04b2381","resolution":{"observed_at":"2026-08-02T20:51:46.984573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:47.151666Z","title":"Agentstudio: A toolkit for building general virtual agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:47.151666Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:ec73d7ccff32dc893b86010a3c0ab4e408c82d7c66ab7efd149df46fcb5b5630","observation_id":"6c1a5554-f289-4a61-9fcd-82564176e021","resolution":{"observed_at":"2026-08-02T20:51:47.151666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:47.290897Z","title":"Mai-ui technical report: Real-world centric foundation gui agents, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:47.290897Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:a0b757c5721324b1b845df5eb0881ab2557a4ac0dca6beb72c9400c15e5f0a06","observation_id":"7b6c9c2b-9b4a-4957-b353-8ef718aae715","resolution":{"observed_at":"2026-08-02T20:51:47.290897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:47.423910Z","title":"GUI -g1: Understanding r1-zero-like training for visual grounding in GUI agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:47.423910Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:2eddbadae2acbcbcdc94d6c82be871da5425d983352ffa778faa0cb69428b8c0","observation_id":"c57c4d58-25f5-46f9-bc14-d967a42a6389","resolution":{"observed_at":"2026-08-02T20:51:47.423910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:47.577721Z","title":"The surprising effectiveness of negative reinforcement in llm reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:47.577721Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:30fb3766c5e21dc555361afbd882c4540fc105430256beacfc5c7d8166f5edc6","observation_id":"341ab263-3c83-46e2-a92b-87ab60340fd9","resolution":{"observed_at":"2026-08-02T20:51:47.577721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:47.678442Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:47.678442Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:d4afc1b50c4f21c1a72b0116e9674b0ad8c9280ac62dd757bbc2460d43c71bce","observation_id":"41beed27-bdfd-40b9-8693-56a000e3e5ca","resolution":{"observed_at":"2026-08-02T20:51:47.678442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:47.820096Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:47.820096Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:8a2b84586618190666f494ae8ff0610c0ff4c468c23aff4a5923ad338888a783","observation_id":"e82a9078-9abe-4a90-aa4a-e541f43612cc","resolution":{"observed_at":"2026-08-02T20:51:47.820096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:51:47.961506Z","title":"point_2d","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-02T20:51:47.961506Z"},"links":{"citing_paper":"/paper/2602.22190"},"observation_digest":"sha256:900e2b86a0d84686bef4905f5402f327025a2cf6bb7aa6830db2c73ab0e79487","observation_id":"d9a6117f-4095-41d1-a051-37a428e0ef82","resolution":{"observed_at":"2026-08-02T20:51:47.961506Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.22190","last_updated":"2026-05-25T21:32:44Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T08:14:31.502304Z","submitted_at":"2026-02-25T18:34:57Z","title":"GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL"},"reference_resolution":{"displayed":87,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":86,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":87},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 87 of 87 outbound references and 7 inbound Pith citation observations for arXiv:2602.22190."}