{"as_of":"2026-08-08T07:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:77a0f102dbe18ca446cdcc5dfa29029c9824a33b86af06d121a100a306a46bcb","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:34:16.540169Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T16:38:36.511631Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T05:17:40.282692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"cited_work":{"arxiv_id":"2505.21496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21496","snapshot_observed_at":"2026-07-03T05:17:40.282692Z","title":"Xiaoxin Chen, Aojun Zhou, and Hongsheng Li","venue":null,"work_id":"6eed96cc-da77-445d-bf7b-f5f5b38d02db","year":2025},"citing_paper":{"arxiv_id":"2507.21046","last_updated":"2026-01-16T20:59:08Z","snapshot_observed_at":"2026-08-01T06:32:44.461162Z","submitted_at":"2025-07-28T17:59:05Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","version":4},"reference_index":156,"source":"arxiv_source","source_observed_at":"2026-05-14T22:23:14.621091Z"},"links":{"cited_paper":"/paper/2505.21496","citing_paper":"/paper/2507.21046"},"observation_digest":"sha256:de0d8b2e9785b2e51bbc27fd8bc8be22221ce3c5161ec9b1924d26851c1f8ef8","observation_id":"5289f811-e60a-44fc-aef3-8421e4c95f59","resolution":{"observed_at":"2026-05-14T22:23:14.891136Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"cited_work":{"arxiv_id":"2505.21496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21496","snapshot_observed_at":"2026-07-03T05:17:40.282692Z","title":"Xiaoxin Chen, Aojun Zhou, and Hongsheng Li","venue":null,"work_id":"6eed96cc-da77-445d-bf7b-f5f5b38d02db","year":2025},"citing_paper":{"arxiv_id":"2512.12634","last_updated":"2026-05-31T23:48:10Z","snapshot_observed_at":"2026-08-03T16:38:30.744758Z","submitted_at":"2025-12-14T10:41:39Z","title":"MobiBench: Multi-Branch, Modular Benchmark for Mobile GUI Agents","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T22:59:16.413568Z"},"links":{"cited_paper":"/paper/2505.21496","citing_paper":"/paper/2512.12634"},"observation_digest":"sha256:f532f080b734fe59122d2d1b4e3ed9c54f75d0e175d84786f8f6935f93e4fe02","observation_id":"4d2494aa-d860-460c-af02-942321710354","resolution":{"observed_at":"2026-05-16T23:01:20.732591Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21496","snapshot_observed_at":"2026-08-03T16:38:36.511631Z","title":"Xiaoxin Chen, Aojun Zhou, and Hongsheng Li","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.12634","last_updated":"2026-05-31T23:48:10Z","snapshot_observed_at":"2026-08-03T16:38:30.744758Z","submitted_at":"2025-12-14T10:41:39Z","title":"MobiBench: Multi-Branch, Modular Benchmark for Mobile GUI Agents","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T16:38:36.511631Z"},"links":{"cited_paper":"/paper/2505.21496","citing_paper":"/paper/2512.12634"},"observation_digest":"sha256:5114566d8f49cd0248530b1660c34b24855c50a459c6862298fda69475728d05","observation_id":"57332581-d9cf-46d9-8dae-1575766256bf","resolution":{"observed_at":"2026-08-03T16:38:36.511631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"cited_work":{"arxiv_id":"2505.21496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21496","snapshot_observed_at":"2026-07-03T05:17:40.282692Z","title":"Xiaoxin Chen, Aojun Zhou, and Hongsheng Li","venue":null,"work_id":"6eed96cc-da77-445d-bf7b-f5f5b38d02db","year":2025},"citing_paper":{"arxiv_id":"2604.10674","last_updated":"2026-04-12T14:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T14:57:52Z","title":"Skill-SD: Skill-Conditioned Self-Distillation for Multi-turn LLM Agents","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-10T15:28:07.981488Z"},"links":{"cited_paper":"/paper/2505.21496","citing_paper":"/paper/2604.10674"},"observation_digest":"sha256:82c1c2d8c6991c11e42b1f95d5b3d3764eee0487419efe41d266bfca22cfbe3a","observation_id":"0eb2fcd5-bef3-4ff5-b6ed-4384ad800f34","resolution":{"observed_at":"2026-05-11T10:31:00.883961Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"cited_work":{"arxiv_id":"2505.21496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21496","snapshot_observed_at":"2026-07-03T05:17:40.282692Z","title":"Xiaoxin Chen, Aojun Zhou, and Hongsheng Li","venue":null,"work_id":"6eed96cc-da77-445d-bf7b-f5f5b38d02db","year":2025},"citing_paper":{"arxiv_id":"2604.22558","last_updated":"2026-04-24T13:53:39Z","snapshot_observed_at":"2026-08-05T08:11:55.563542Z","submitted_at":"2026-04-24T13:53:39Z","title":"SOLAR-RL: Semi-Online Long-horizon Assignment Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-08T12:09:24.371878Z"},"links":{"cited_paper":"/paper/2505.21496","citing_paper":"/paper/2604.22558"},"observation_digest":"sha256:15d7ababfc04991523c05daa694ea09e3179f139d2d70c37b762606aeb8014a0","observation_id":"c2fb5109-690a-4177-92e8-b942e493da8f","resolution":{"observed_at":"2026-05-11T19:21:08.791996Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"cited_work":{"arxiv_id":"2505.21496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21496","snapshot_observed_at":"2026-07-03T05:17:40.282692Z","title":"Xiaoxin Chen, Aojun Zhou, and Hongsheng Li","venue":null,"work_id":"6eed96cc-da77-445d-bf7b-f5f5b38d02db","year":2025},"citing_paper":{"arxiv_id":"2605.07110","last_updated":"2026-05-08T01:38:46Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:38:46Z","title":"Securing Computer-Use Agents: A Unified Architecture-Lifecycle Framework for Deployment-Grounded Reliability","version":1},"reference_index":116,"source":"pdf_text","source_observed_at":"2026-05-11T01:15:19.239355Z"},"links":{"cited_paper":"/paper/2505.21496","citing_paper":"/paper/2605.07110"},"observation_digest":"sha256:7be2a3732617f57b4fd048938afa3bc58a9eebc7917fac0b72850be8bd50582f","observation_id":"11271b9d-07e3-4faf-b2bd-ec8727698671","resolution":{"observed_at":"2026-05-11T04:35:56.386591Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"cited_work":{"arxiv_id":"2505.21496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21496","snapshot_observed_at":"2026-07-03T05:17:40.282692Z","title":"Xiaoxin Chen, Aojun Zhou, and Hongsheng Li","venue":null,"work_id":"6eed96cc-da77-445d-bf7b-f5f5b38d02db","year":2025},"citing_paper":{"arxiv_id":"2605.14311","last_updated":"2026-05-15T06:09:21Z","snapshot_observed_at":"2026-07-06T23:25:44.508166Z","submitted_at":"2026-05-14T03:23:44Z","title":"Beyond Binary: Reframing GUI Critique as Continuous Semantic Alignment","version":1},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-05-15T01:58:19.295247Z"},"links":{"cited_paper":"/paper/2505.21496","citing_paper":"/paper/2605.14311"},"observation_digest":"sha256:c76e74425ecf64d495261382d23fb55b84fc8aa30f265e2bb990d9b27a2d6718","observation_id":"493f2919-3491-4dea-8426-4b60a7a5116e","resolution":{"observed_at":"2026-05-15T01:58:28.784779Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"cited_work":{"arxiv_id":"2505.21496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21496","snapshot_observed_at":"2026-07-03T05:17:40.282692Z","title":"Xiaoxin Chen, Aojun Zhou, and Hongsheng Li","venue":null,"work_id":"6eed96cc-da77-445d-bf7b-f5f5b38d02db","year":2025},"citing_paper":{"arxiv_id":"2605.14311","last_updated":"2026-05-15T06:09:21Z","snapshot_observed_at":"2026-07-06T23:25:44.508166Z","submitted_at":"2026-05-14T03:23:44Z","title":"Beyond Binary: Reframing GUI Critique as Continuous Semantic Alignment","version":2},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-05-19T16:45:16.963802Z"},"links":{"cited_paper":"/paper/2505.21496","citing_paper":"/paper/2605.14311"},"observation_digest":"sha256:a6400e2a7cbf409bf78b259a25fa9700a036a211ffe2f5d2b59ed8674577a086","observation_id":"91a71e88-db5d-424b-aeeb-791f91cc0643","resolution":{"observed_at":"2026-05-19T16:47:40.442080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"cited_work":{"arxiv_id":"2505.21496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21496","snapshot_observed_at":"2026-07-03T05:17:40.282692Z","title":"Xiaoxin Chen, Aojun Zhou, and Hongsheng Li","venue":null,"work_id":"6eed96cc-da77-445d-bf7b-f5f5b38d02db","year":2025},"citing_paper":{"arxiv_id":"2606.11078","last_updated":"2026-06-09T16:39:10Z","snapshot_observed_at":"2026-07-06T23:50:11.160843Z","submitted_at":"2026-06-09T16:39:10Z","title":"A History-Aware Visually Grounded Critic for Computer Use Agents","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-27T13:20:32.432002Z"},"links":{"cited_paper":"/paper/2505.21496","citing_paper":"/paper/2606.11078"},"observation_digest":"sha256:4611c3c06bc49579f69d17821fcfdbee4140af9a153be0a4f1e96f51f6b3b054","observation_id":"2ae10624-8280-4103-b73a-fe9c95337637","resolution":{"observed_at":"2026-07-03T05:17:40.284425Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21496/citation-record","integrity":"/paper/2505.21496/integrity","json":"/paper/2505.21496/citation-record.json","paper":"/paper/2505.21496"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.00906","last_updated":"2025-04-01T15:40:27Z","snapshot_observed_at":"2026-07-06T21:02:28.100677Z","submitted_at":"2025-04-01T15:40:27Z","title":"Agent S2: A Compositional Generalist-Specialist Framework for Computer Use Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00906","snapshot_observed_at":"2026-08-07T13:34:12.202353Z","title":"Agent s2: A compositional generalist-specialist framework for computer use agents.arXiv preprint arXiv:2504.00906, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:12.202353Z"},"links":{"cited_paper":"/paper/2504.00906","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:db9e04aa02e60b8e7f03d21f5efe36a6757ddcc2f99d9dd1dcedf3286d929380","observation_id":"227e2ae3-3a85-4962-9ffa-e7834f866702","resolution":{"observed_at":"2026-08-07T13:34:12.202353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T13:34:12.249449Z","title":"Qwen-vl: A frontier large vision-language model with versatile 11 abilities.ArXiv, abs/2308.12966, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:12.249449Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:791a56644ac3ec4a932dd07a39b2d9c9af73c7d9747522c39536124656038c1c","observation_id":"a2f36f7f-c2e9-4ecd-b9a8-939e3a2ed610","resolution":{"observed_at":"2026-08-07T13:34:12.249449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T13:34:12.316549Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:12.316549Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:2ccf0ff7206abfdaf1091d434ac4de5a38e2d9b08820ab6e576db75243beb848","observation_id":"7465ed76-0ae9-4e79-ae52-f65a0c47afa5","resolution":{"observed_at":"2026-08-07T13:34:12.316549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:34:12.379422Z","title":"A survey of monte carlo tree search methods.IEEE Transactions on Computational Intelligence and AI in games, 4(1):1–43, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:12.379422Z"},"links":{"citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:f7c68fb039b7cc4c8ecaedb94bdfe44258dde7913aebc796e9403d839ab1c8f7","observation_id":"e7f68e8e-48ee-48c7-b024-8ce6c8907cfa","resolution":{"observed_at":"2026-08-07T13:34:12.379422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17490","last_updated":"2025-05-29T02:43:50Z","snapshot_observed_at":"2026-07-06T18:51:28.182977Z","submitted_at":"2024-07-03T17:59:58Z","title":"AMEX: Android Multi-annotation Expo Dataset for Mobile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17490","snapshot_observed_at":"2026-08-07T13:34:12.433269Z","title":"Amex: Android multi-annotation expo dataset for mobile gui agents.arXiv preprint arXiv:2407.17490, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:12.433269Z"},"links":{"cited_paper":"/paper/2407.17490","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:4227cf2d237ba712a20217b665dc33981924a69153f4437d91f1a7ea7fb5f0c3","observation_id":"9f0b76e8-ea5d-4239-af90-8675f023a612","resolution":{"observed_at":"2026-08-07T13:34:12.433269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:34:12.506033Z","title":"A3: Android agent arena for mobile gui agents.arXiv preprint arXiv:2501.01149, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:12.506033Z"},"links":{"citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:6b10233912b733a1925054c414d4e04da745f1e3ffc89c824beba1ae8935b7d1","observation_id":"31233573-e7a7-4112-8222-849a623d1057","resolution":{"observed_at":"2026-08-07T13:34:12.506033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03553","last_updated":"2024-09-27T08:16:28Z","snapshot_observed_at":"2026-07-06T18:10:29.627336Z","submitted_at":"2024-05-06T15:20:30Z","title":"AlphaMath Almost Zero: Process Supervision without Process","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03553","snapshot_observed_at":"2026-08-07T13:34:12.576689Z","title":"Alphamath almost zero: process supervision without process.arXiv preprint arXiv:2405.03553, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:12.576689Z"},"links":{"cited_paper":"/paper/2405.03553","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:8c472837cd64055f2c108470133a4ad63505520d5f061b93e21ed6b863ae42fc","observation_id":"0d1cd788-394a-43d5-bbad-e5da891f9fc6","resolution":{"observed_at":"2026-08-07T13:34:12.576689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10935","last_updated":"2024-02-23T04:36:51Z","snapshot_observed_at":"2026-08-08T03:28:12.161766Z","submitted_at":"2024-01-17T08:10:35Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10935","snapshot_observed_at":"2026-08-07T13:34:12.653482Z","title":"Seeclick: Harnessing gui grounding for advanced visual gui agents.arXiv preprint arXiv:2401.10935, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:12.653482Z"},"links":{"cited_paper":"/paper/2401.10935","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:7aa79b578fbe5a38dd859bef59bf068e79e588b929b43e3294fc92a7d32ec3f0","observation_id":"f8d6c2ca-21f7-4c57-a9b2-d1fed7883993","resolution":{"observed_at":"2026-08-07T13:34:12.653482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04519","last_updated":"2025-01-08T14:12:57Z","snapshot_observed_at":"2026-08-04T20:57:22.329262Z","submitted_at":"2025-01-08T14:12:57Z","title":"rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04519","snapshot_observed_at":"2026-08-07T13:34:12.734899Z","title":"rstar-math: Small llms can master math reasoning with self-evolved deep thinking.arXiv preprint arXiv:2501.04519, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:12.734899Z"},"links":{"cited_paper":"/paper/2501.04519","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:1f3f2eba20a4ea51b32960fdcde44c0c3acb2cb366d7350c7b6d1a68b510710f","observation_id":"f779bc17-e800-4b2d-bdc9-34e5539ba275","resolution":{"observed_at":"2026-08-07T13:34:12.734899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T13:34:12.797680Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:12.797680Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:2910ce88142c290b59ac5be29d1a67f95a1e7a2322a1f390702d8cfbf1d8ad54","observation_id":"ca5dbac5-7c7b-4248-94c3-41f5904e5db8","resolution":{"observed_at":"2026-08-07T13:34:12.797680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:34:12.869363Z","title":"Cogagent: A visual language model for gui agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:12.869363Z"},"links":{"citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:f70fb7914b64d9d45e37f5193225da6e4aa3064694408348142dcad6ae5b3b20","observation_id":"5291f4ed-3582-48b4-a0a5-fe1bc8e8c58c","resolution":{"observed_at":"2026-08-07T13:34:12.869363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12981","last_updated":"2023-07-24T17:59:02Z","snapshot_observed_at":"2026-08-03T03:13:48.042761Z","submitted_at":"2023-07-24T17:59:02Z","title":"3D-LLM: Injecting the 3D World into Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12981","snapshot_observed_at":"2026-08-07T13:34:12.942509Z","title":"3d-llm: Injecting the 3d world into large language models.arXiv preprint arXiv:2307.12981, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:12.942509Z"},"links":{"cited_paper":"/paper/2307.12981","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:fc161181bb3207093b29df74e0ecb48ad9ed9ca487fddcc1cea3d1186f3886c9","observation_id":"ede2a85a-43d5-41a2-8f87-252065a26fc8","resolution":{"observed_at":"2026-08-07T13:34:12.942509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:34:17.671192Z","title":"On the effects of data scale on computer control agents.arXiv e-prints, pages arXiv–2406, 2024","venue":null,"work_id":"22281fe1-922b-493d-b02a-59a9d3724571","year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:13.035312Z"},"links":{"citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:e955939c5ca1709104fa92f993c40ddd81c932cb147fd7ecf735edf6fb39df99","observation_id":"2311d38f-86cf-4f67-87ed-853bfaf5705d","resolution":{"observed_at":"2026-08-07T13:34:17.722438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:34:13.140041Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:13.140041Z"},"links":{"citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:e364f83cbcdc1f631f1be33087a4172097b2f14a0406f2186a5e4f22da6d96d1","observation_id":"887cdd4c-5205-4652-a939-da5b5e711103","resolution":{"observed_at":"2026-08-07T13:34:13.140041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07575","last_updated":"2023-11-13T18:59:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T18:59:47Z","title":"SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07575","snapshot_observed_at":"2026-08-07T13:34:13.235887Z","title":"Sphinx: The joint mixing of weights, tasks, and visual embeddings for multi-modal large language models.arXiv preprint arXiv:2311.07575, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:13.235887Z"},"links":{"cited_paper":"/paper/2311.07575","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:529eca07c203ab7b89e760ba76225181336fa9919bc80e9b9560dc0b7862a3eb","observation_id":"92a97f96-647a-453c-a8a7-13773936f429","resolution":{"observed_at":"2026-08-07T13:34:13.235887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T13:34:13.339552Z","title":"Deepseek-v3 technical report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:13.339552Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:82219b367c97e41c29305b43b358c3f695006a5d711f00ecee2bbf84f2523d76","observation_id":"292911e5-8523-4bf0-a20d-6ab532f11507","resolution":{"observed_at":"2026-08-07T13:34:13.339552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14239","last_updated":"2025-04-19T09:25:55Z","snapshot_observed_at":"2026-08-05T23:52:52.919433Z","submitted_at":"2025-04-19T09:25:55Z","title":"InfiGUI-R1: Advancing Multimodal GUI Agents from Reactive Actors to Deliberative Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14239","snapshot_observed_at":"2026-08-07T13:34:13.481997Z","title":"Infigui-r1: Advancing multimodal gui agents from reactive actors to deliberative reasoners.arXiv preprint arXiv:2504.14239, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:13.481997Z"},"links":{"cited_paper":"/paper/2504.14239","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:253f68df95e6e0ba7c5f4c52bae5d2057a49c645efdbbc342494df5ed6f03a88","observation_id":"c5cd0a30-8150-4219-9a2a-8804e503146f","resolution":{"observed_at":"2026-08-07T13:34:13.481997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21620","last_updated":"2025-05-24T08:46:08Z","snapshot_observed_at":"2026-08-01T20:06:59.931737Z","submitted_at":"2025-03-27T15:39:30Z","title":"UI-R1: Enhancing Efficient Action Prediction of GUI Agents by Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21620","snapshot_observed_at":"2026-08-07T13:34:13.620018Z","title":"Ui-r1: Enhancing action prediction of gui agents by reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:13.620018Z"},"links":{"cited_paper":"/paper/2503.21620","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:1d570ff0904b8948d94122e4b4706226cfeb3263293461ccc2ae1475100b8f58","observation_id":"4c982ce9-de55-414f-b99b-e78a0d8b3a49","resolution":{"observed_at":"2026-08-07T13:34:13.620018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06592","snapshot_observed_at":"2026-08-07T13:34:13.755616Z","title":"Improve mathematical reasoning in language models by automated process supervision.arXiv preprint arXiv:2406.06592, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:13.755616Z"},"links":{"cited_paper":"/paper/2406.06592","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:168a511371e6d23c540f1e5ed9502ba204e3b7c0fac7a3529bbf5a7f6d565566","observation_id":"0f33a703-4705-4b47-8a72-5a2f45a5edd8","resolution":{"observed_at":"2026-08-07T13:34:13.755616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:34:13.862753Z","title":"Chatgpt.https://chat.openai.com, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:13.862753Z"},"links":{"citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:81e51bf038449730496cb39345c5c0ff98a32e5275a732b72e21f786caa85507","observation_id":"c2f9b3b7-b026-492d-aae0-ca092bc084fc","resolution":{"observed_at":"2026-08-07T13:34:13.862753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T13:34:13.981674Z","title":"Gpt-4 technical report.ArXiv, abs/2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:13.981674Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:58ee3a1ff8019b7f25bb242aa93c7ae002edec7071a24f76333411e67a331ca5","observation_id":"8f64ac00-d58b-4ca5-b8a6-74c2aa79dc80","resolution":{"observed_at":"2026-08-07T13:34:13.981674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07199","last_updated":"2024-08-13T20:52:13Z","snapshot_observed_at":"2026-08-01T22:07:45.419539Z","submitted_at":"2024-08-13T20:52:13Z","title":"Agent Q: Advanced Reasoning and Learning for Autonomous AI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07199","snapshot_observed_at":"2026-08-07T13:34:14.113020Z","title":"Agent q: Advanced reasoning and learning for autonomous ai agents.arXiv preprint arXiv:2408.07199, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:14.113020Z"},"links":{"cited_paper":"/paper/2408.07199","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:6dc73cecb5961936405dd6f81c4c2445fed3ec1b5d1082bb43bf53c8f4cf327c","observation_id":"a4ea2b57-ebf4-42ff-9979-5c8891bc4380","resolution":{"observed_at":"2026-08-07T13:34:14.113020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-08-07T13:34:14.257156Z","title":"Ui-tars: Pioneering automated gui interaction with native agents.arXiv preprint arXiv:2501.12326, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:14.257156Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:424de41d2474153f66139454a26b06c53f4eb91a3158f0d047a564fbb8ac49d2","observation_id":"92256e3c-d1ad-4ea4-a686-baab33ea19aa","resolution":{"observed_at":"2026-08-07T13:34:14.257156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:34:14.409660Z","title":"Language models are unsupervised multitask learners.OpenAI blog, 1(8):9, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:14.409660Z"},"links":{"citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:fbb31d6105e9e265036a132875abf6a2ea9d31a835968e9c6cc7ba75a713d951","observation_id":"18e99542-9edb-404b-922c-7bd8fd6b195b","resolution":{"observed_at":"2026-08-07T13:34:14.409660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T13:34:14.554994Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:14.554994Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:9343098390eeace738aaaa5c6218abda59162ccc160451d424e4ac8c527e0937","observation_id":"4299b27c-2464-471b-8631-fd47de7faa97","resolution":{"observed_at":"2026-08-07T13:34:14.554994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:34:14.699428Z","title":"Mas- tering the game of go with deep neural networks and tree search.nature, 529(7587):484–489, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:14.699428Z"},"links":{"citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:a74b428daaccfcd0954960ccadb2f948af7d4c15fba9958be54fda4a6f95a75a","observation_id":"0b45da9d-dea5-4d83-a679-ceb0e656aa83","resolution":{"observed_at":"2026-08-07T13:34:14.699428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T13:34:14.819538Z","title":"Scaling llm test-time compute opti- mally can be more effective than scaling model parameters.arXiv preprint arXiv:2408.03314, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:14.819538Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:a30e353575884bf73360ac424c7099a955f49914998b5b348dc4851b87f976ad","observation_id":"16db5226-a409-4b9c-864a-bf6255dbe2ed","resolution":{"observed_at":"2026-08-07T13:34:14.819538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19723","last_updated":"2025-06-27T08:25:48Z","snapshot_observed_at":"2026-08-07T22:32:37.258577Z","submitted_at":"2024-12-27T16:21:58Z","title":"OS-Genesis: Automating GUI Agent Trajectory Construction via Reverse Task Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19723","snapshot_observed_at":"2026-08-07T13:34:14.968525Z","title":"Os-genesis: Automating gui agent trajectory construction via reverse task synthesis.arXiv preprint arXiv:2412.19723, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:14.968525Z"},"links":{"cited_paper":"/paper/2412.19723","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:ed19efdc84e8d702216aefb509d3e341b45d1aa38c92fdb5280241174b288c7f","observation_id":"7297932f-4faf-4bc3-ab0f-fd3a169a502c","resolution":{"observed_at":"2026-08-07T13:34:14.968525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-07T13:34:15.089504Z","title":"Solving math word problems with process-and outcome-based feedback.arXiv preprint arXiv:2211.14275, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:15.089504Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:943f210c5d15389e47ad88be951ca5f3802c7c95bf530e192616553cd0c31d82","observation_id":"44e31cf1-f544-4aeb-a2eb-5ddf837cb190","resolution":{"observed_at":"2026-08-07T13:34:15.089504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01014","last_updated":"2024-06-03T05:50:00Z","snapshot_observed_at":"2026-08-06T22:15:02.337988Z","submitted_at":"2024-06-03T05:50:00Z","title":"Mobile-Agent-v2: Mobile Device Operation Assistant with Effective Navigation via Multi-Agent Collaboration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01014","snapshot_observed_at":"2026-08-07T13:34:15.163897Z","title":"Mobile-agent-v2: Mobile device operation assistant with effective navigation via multi-agent collaboration.arXiv preprint arXiv:2406.01014, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:15.163897Z"},"links":{"cited_paper":"/paper/2406.01014","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:5fdf64c8fd0623a6a56cc487eae47d7901da4395b9816f360e59f2789b3ca208","observation_id":"fe1316b3-e451-4395-ae3c-764650b0e91a","resolution":{"observed_at":"2026-08-07T13:34:15.163897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16158","last_updated":"2024-04-18T06:53:38Z","snapshot_observed_at":"2026-08-05T03:22:24.562938Z","submitted_at":"2024-01-29T13:46:37Z","title":"Mobile-Agent: Autonomous Multi-Modal Mobile Device Agent with Visual Perception","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16158","snapshot_observed_at":"2026-08-07T13:34:15.236161Z","title":"Mobile-agent: Autonomous multi-modal mobile device agent with visual perception","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:15.236161Z"},"links":{"cited_paper":"/paper/2401.16158","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:a9f1b5411f054c4d99a891f7f40f0d21e2852c82066e8cd81797a3d198be2bf6","observation_id":"bbef74c7-fff6-4cc0-980b-e343c0d65e40","resolution":{"observed_at":"2026-08-07T13:34:15.236161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:34:17.463356Z","title":"Mathcoder-VL: Bridging vision and code for enhanced multimodal mathematical reasoning","venue":null,"work_id":"7f1832fe-ab14-41b4-80fa-f240d4bc336c","year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:15.316016Z"},"links":{"citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:bbc76f79d5624008d63076d2a1c7934237f7d10dbd990917a5b94f5171412615","observation_id":"def6758d-5dbf-4975-9f7d-8f9d65e82240","resolution":{"observed_at":"2026-08-07T13:34:17.521569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-07T13:34:15.423628Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations.arXiv preprint arXiv:2312.08935, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:15.423628Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:5c970a7c77c1339afa499b78b31209ec3639c41e623f22f89e60852ab4f54a96","observation_id":"1df33d67-42ef-4230-8368-26f8a79366c6","resolution":{"observed_at":"2026-08-07T13:34:15.423628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10291","last_updated":"2025-03-13T12:03:37Z","snapshot_observed_at":"2026-08-07T21:25:47.268391Z","submitted_at":"2025-03-13T12:03:37Z","title":"VisualPRM: An Effective Process Reward Model for Multimodal Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10291","snapshot_observed_at":"2026-08-07T13:34:15.560978Z","title":"Visualprm: An effective process reward model for multimodal reasoning.arXiv preprint arXiv:2503.10291, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:15.560978Z"},"links":{"cited_paper":"/paper/2503.10291","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:f426be7baefaaf65651617a8c4e414afc02c60e5d8268b404f7819d7dc91b6ed","observation_id":"1aa3ba3e-bc83-4e45-923a-36e8737cec09","resolution":{"observed_at":"2026-08-07T13:34:15.560978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05236","last_updated":"2026-02-25T13:17:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-07T08:36:05Z","title":"Unified Reward Model for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05236","snapshot_observed_at":"2026-08-07T13:34:15.647874Z","title":"Unified reward model for multimodal understanding and generation.arXiv preprint arXiv:2503.05236, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:15.647874Z"},"links":{"cited_paper":"/paper/2503.05236","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:9466a80e9ecb92890baff9b0146091f6fb032c9f988f09c184bad93ed7704c66","observation_id":"8af82fd7-ea28-4370-a825-150a1c1f3d2e","resolution":{"observed_at":"2026-08-07T13:34:15.647874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23218","last_updated":"2024-10-30T17:10:19Z","snapshot_observed_at":"2026-08-05T06:30:40.974506Z","submitted_at":"2024-10-30T17:10:19Z","title":"OS-ATLAS: A Foundation Action Model for Generalist GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23218","snapshot_observed_at":"2026-08-07T13:34:15.744658Z","title":"Os-atlas: A foundation action model for generalist gui agents.arXiv preprint arXiv:2410.23218, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:15.744658Z"},"links":{"cited_paper":"/paper/2410.23218","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:806ca9c66063a0450a5c640f1202524a34949e469785f7072e2f31d59ba99123","observation_id":"8fb54bdf-7891-4fab-8e5a-d249069a88b9","resolution":{"observed_at":"2026-08-07T13:34:15.744658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18407","last_updated":"2025-02-25T17:58:02Z","snapshot_observed_at":"2026-08-07T17:49:27.969414Z","submitted_at":"2025-02-25T17:58:02Z","title":"AgentRM: Enhancing Agent Generalization with Reward Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18407","snapshot_observed_at":"2026-08-07T13:34:15.862250Z","title":"Agentrm: Enhancing agent generalization with reward modeling.arXiv preprint arXiv:2502.18407, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:15.862250Z"},"links":{"cited_paper":"/paper/2502.18407","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:984f1f7bf833548131380a34a92c5daed663b62f20c145670c1da7fc4abed4fc","observation_id":"cf9fdf4f-a4ba-4e57-b9c9-f3686dbf2bf3","resolution":{"observed_at":"2026-08-07T13:34:15.862250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24024","last_updated":"2024-11-04T05:57:31Z","snapshot_observed_at":"2026-08-05T20:27:11.926706Z","submitted_at":"2024-10-31T15:25:20Z","title":"AndroidLab: Training and Systematic Benchmarking of Android Autonomous Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24024","snapshot_observed_at":"2026-08-07T13:34:15.971321Z","title":"Androidlab: Training and systematic benchmarking of android autonomous agents.arXiv preprint arXiv:2410.24024, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:15.971321Z"},"links":{"cited_paper":"/paper/2410.24024","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:a591afb2bf74b9d7937793d779a8e88a39ed063ffae54fca9a6a4f48ef2ea36b","observation_id":"af4cb082-3624-408f-8885-41b813c97ed9","resolution":{"observed_at":"2026-08-07T13:34:15.971321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04454","last_updated":"2025-05-05T16:17:20Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:58:26Z","title":"Aguvis: Unified Pure Vision Agents for Autonomous GUI Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04454","snapshot_observed_at":"2026-08-07T13:34:16.052993Z","title":"Aguvis: Unified pure vision agents for autonomous gui interaction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:16.052993Z"},"links":{"cited_paper":"/paper/2412.04454","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:a63d4c95de193dd4eee9c5ecb7101a03040521e43b19beb7edade914fac2c1e0","observation_id":"3725fa04-4eae-44f7-9e8d-9e1c688ce59e","resolution":{"observed_at":"2026-08-07T13:34:16.052993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09724","last_updated":"2024-04-01T13:50:51Z","snapshot_observed_at":"2026-08-07T05:06:51.002209Z","submitted_at":"2023-11-16T09:56:28Z","title":"OVM, Outcome-supervised Value Models for Planning in Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09724","snapshot_observed_at":"2026-08-07T13:34:16.142382Z","title":"Ovm, outcome-supervised value models for planning in mathematical reasoning.arXiv preprint arXiv:2311.09724, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:16.142382Z"},"links":{"cited_paper":"/paper/2311.09724","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:8c5b96148b82f42931c83afba496b69e3c7fc463d2b427f4d373776454ae7207","observation_id":"c048bd41-ef28-4f99-888c-ac0ddaf58a90","resolution":{"observed_at":"2026-08-07T13:34:16.142382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01981","last_updated":"2024-12-02T21:20:02Z","snapshot_observed_at":"2026-08-06T03:48:05.506841Z","submitted_at":"2024-12-02T21:20:02Z","title":"Free Process Rewards without Process Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01981","snapshot_observed_at":"2026-08-07T13:34:16.228199Z","title":"Free process rewards without process labels.arXiv preprint arXiv:2412.01981, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:16.228199Z"},"links":{"cited_paper":"/paper/2412.01981","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:4901abf49507ba173df7b36cc3df72a51e86ee72c5976c77f94d64c61d931feb","observation_id":"0390a426-2071-44cc-81f4-329ffa836446","resolution":{"observed_at":"2026-08-07T13:34:16.228199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12368","last_updated":"2025-05-20T11:36:34Z","snapshot_observed_at":"2026-08-06T01:46:05.964793Z","submitted_at":"2025-01-21T18:47:32Z","title":"InternLM-XComposer2.5-Reward: A Simple Yet Effective Multi-Modal Reward Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12368","snapshot_observed_at":"2026-08-07T13:34:16.325870Z","title":"Internlm-xcomposer2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:16.325870Z"},"links":{"cited_paper":"/paper/2501.12368","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:6da2561c13319293c586f81fe9a61a491055764b1375ee24c8451ead9f9831fd","observation_id":"38988312-0153-4080-8c93-3efae3d66d08","resolution":{"observed_at":"2026-08-07T13:34:16.325870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:34:16.413731Z","title":"Appagent: Multimodal agents as smartphone users","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:16.413731Z"},"links":{"citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:c89d5fc4cd15249f20e6864c20f97c0a0bcd58bb86f8ac3cc057d1444d8cf169","observation_id":"c7a15394-1998-4c38-84fa-f5a389b6a23f","resolution":{"observed_at":"2026-08-07T13:34:16.413731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15240","last_updated":"2025-02-22T10:21:46Z","snapshot_observed_at":"2026-07-06T19:06:41.697671Z","submitted_at":"2024-08-27T17:57:45Z","title":"Generative Verifiers: Reward Modeling as Next-Token Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15240","snapshot_observed_at":"2026-08-07T13:34:16.465747Z","title":"Generative verifiers: Reward modeling as next-token prediction.arXiv preprint arXiv:2408.15240, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:16.465747Z"},"links":{"cited_paper":"/paper/2408.15240","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:83720aa56d220c5887aa4b978d268b1942c16cd7e745e4a20c1a9eaa0a0d8099","observation_id":"289121d4-a544-4f0d-92f6-41ef672b1dfa","resolution":{"observed_at":"2026-08-07T13:34:16.465747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-07T13:34:16.540169Z","title":"action_desc","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:16.540169Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2505.21496"},"observation_digest":"sha256:9f4a3dff0a8aaab3015056b3094c7f2247417d2fa25f7de8015a562c1883a19e","observation_id":"c0c5c59e-0ee5-4ba8-94f0-7349e1a74c8a","resolution":{"observed_at":"2026-08-07T13:34:16.540169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.21496","last_updated":"2025-05-27T17:58:06Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:26:36.570205Z","submitted_at":"2025-05-27T17:58:06Z","title":"UI-Genie: A Self-Improving Approach for Iteratively Boosting MLLM-based Mobile GUI Agents"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 9 inbound Pith citation observations for arXiv:2505.21496."}