{"as_of":"2026-08-08T07:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61c3daa9f787c6604a991ca9ed2959394a3baab787ec49fd75fd488d549a39b7","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:04:05.654823Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.08972/citation-record","integrity":"/paper/2506.08972/integrity","json":"/paper/2506.08972/citation-record.json","paper":"/paper/2506.08972"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.18279","last_updated":"2025-05-06T15:08:00Z","snapshot_observed_at":"2026-07-06T19:57:55.925634Z","submitted_at":"2024-11-27T12:13:39Z","title":"Large Language Model-Brained GUI Agents: A Survey","version":12},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18279","snapshot_observed_at":"2026-08-07T05:04:02.377770Z","title":"Large language model-brained gui agents: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.377770Z"},"links":{"cited_paper":"/paper/2411.18279","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:df13c4c72b60ed4d370f31150391c4d2233f8d03a728599c324417e805cb9065","observation_id":"1f4ff667-7f8e-4e39-9f61-4d8404fd49f8","resolution":{"observed_at":"2026-08-07T05:04:02.377770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:02.433247Z","title":"Llm-powered gui agents in phone automation: Surveying progress and prospects","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.433247Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:85031f2b9e921fa07e75e623c6aa343b07adce21f805ec2f5f66b0e5a091ff12","observation_id":"891f9527-f04c-47c5-8b57-4a91bd121ae4","resolution":{"observed_at":"2026-08-07T05:04:02.433247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:02.470904Z","title":"Gui agents: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.470904Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:4f67ea1f758aeb63549196f1ccf56e8c7d9571092065caaa6d13df6dda70c943","observation_id":"36c978c8-0249-4332-8cac-4260bcc46b88","resolution":{"observed_at":"2026-08-07T05:04:02.470904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:06.844464Z","title":"Os agents: A survey on mllm-based agents for general computing devices use, 2024","venue":null,"work_id":"83612e4a-b2ac-4eb9-8d65-2fceb05939f8","year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.550846Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:67a7430c5604755795206731dd28a5f90e2b4ad447ced7f8a9ec88ce31a2fb57","observation_id":"5e4fadc6-cf70-47c9-8ef3-989230462b0f","resolution":{"observed_at":"2026-08-07T05:04:06.848246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04890","last_updated":"2025-02-13T10:09:37Z","snapshot_observed_at":"2026-08-06T08:17:46.881583Z","submitted_at":"2024-11-07T17:28:10Z","title":"GUI Agents with Foundation Models: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04890","snapshot_observed_at":"2026-08-07T05:04:02.622402Z","title":"Gui agents with foundation models: A comprehensive survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.622402Z"},"links":{"cited_paper":"/paper/2411.04890","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:c529f8ed42a892a6b55001d262950b7aab4a2121cc9666add186bbc614ad86a7","observation_id":"a389405f-d6d2-41a5-ba91-eac919a21c7c","resolution":{"observed_at":"2026-08-07T05:04:02.622402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-05T15:40:55.400927Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-07T05:04:02.686260Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.686260Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:3c284b765ed88fc82446bc3e9221dbecf618d7ec3abc0cd176634e34303ace48","observation_id":"e3d773ef-5b92-40cf-8a11-0faa6e9b0f1d","resolution":{"observed_at":"2026-08-07T05:04:02.686260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14803","last_updated":"2025-02-21T16:23:59Z","snapshot_observed_at":"2026-07-06T19:36:15.200874Z","submitted_at":"2024-10-18T18:19:56Z","title":"DistRL: An Asynchronous Distributed Reinforcement Learning Framework for On-Device Control Agents","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14803","snapshot_observed_at":"2026-08-07T05:04:02.738997Z","title":"Distrl: An asynchronous distributed reinforcement learning framework for on-device control agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.738997Z"},"links":{"cited_paper":"/paper/2410.14803","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:f09ef43da45506a59a3bbaa79b9728418c44462156e45c60de52f3ac70a5e8a1","observation_id":"5213041a-cf8b-4029-9cf7-85175976ba64","resolution":{"observed_at":"2026-08-07T05:04:02.738997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00820","last_updated":"2024-10-28T17:05:10Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-28T17:05:10Z","title":"AutoGLM: Autonomous Foundation Agents for GUIs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00820","snapshot_observed_at":"2026-08-07T05:04:02.811222Z","title":"Autoglm: Autonomous foundation agents for guis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.811222Z"},"links":{"cited_paper":"/paper/2411.00820","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:84a265d3731860ba3a00a5bc3c0fa8fa5a2a26702155d0b6704549b9e506113a","observation_id":"0e989823-9bf0-4c1f-b683-dfd68a6782dc","resolution":{"observed_at":"2026-08-07T05:04:02.811222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-08-07T05:04:02.888261Z","title":"Ui-tars: Pioneering automated gui interaction with native agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.888261Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:f68f01e72a9c14f34e728e274016cbfc437f540d0b57f568e4c7c806fc8d2c1e","observation_id":"29203d0a-fcd6-4afb-bf6f-3075693da4fa","resolution":{"observed_at":"2026-08-07T05:04:02.888261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02268","last_updated":"2025-04-15T02:32:21Z","snapshot_observed_at":"2026-08-07T17:31:36.621633Z","submitted_at":"2025-03-04T04:34:09Z","title":"AppAgentX: Evolving GUI Agents as Proficient Smartphone Users","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02268","snapshot_observed_at":"2026-08-07T05:04:02.955352Z","title":"Appagentx: Evolving gui agents as proficient smartphone users","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.955352Z"},"links":{"cited_paper":"/paper/2503.02268","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:4248aaef1270b1a4b9c3182906ad5ea70b5776e3f99e1411f77032a93bf7ff0d","observation_id":"66a511c6-0827-4dd9-9b53-93e4302e286b","resolution":{"observed_at":"2026-08-07T05:04:02.955352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23218","last_updated":"2024-10-30T17:10:19Z","snapshot_observed_at":"2026-08-05T06:30:40.974506Z","submitted_at":"2024-10-30T17:10:19Z","title":"OS-ATLAS: A Foundation Action Model for Generalist GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23218","snapshot_observed_at":"2026-08-07T05:04:03.027676Z","title":"Os-atlas: A foundation action model for generalist gui agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.027676Z"},"links":{"cited_paper":"/paper/2410.23218","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:f269cb414a75ffddc66750d09154d9d0c9afaf59c85234c6b267d4a58ce61fe6","observation_id":"783a232b-79b3-4399-a242-1b6fe0731582","resolution":{"observed_at":"2026-08-07T05:04:03.027676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05243","last_updated":"2025-06-17T15:06:02Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:47:50Z","title":"Navigating the Digital World as Humans Do: Universal Visual Grounding for GUI Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05243","snapshot_observed_at":"2026-08-07T05:04:03.096089Z","title":"Navigating the digital world as humans do: Universal visual grounding for gui agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.096089Z"},"links":{"cited_paper":"/paper/2410.05243","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:aef98226a91ca3b4ee86dd1f831935c38e81244e592dff8cea524be64ecdcc01","observation_id":"7cc582b9-e2ed-4e17-ab79-de222054ff5c","resolution":{"observed_at":"2026-08-07T05:04:03.096089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:03.156620Z","title":"A3: Android agent arena for mobile gui agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.156620Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:c3d3e294e4fdc1b64f3c1cfb01a044f93005332a1b1906880e764336c4fb46ff","observation_id":"9bccfc80-3530-4a39-9636-30ef7e5be0e8","resolution":{"observed_at":"2026-08-07T05:04:03.156620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14573","last_updated":"2025-04-06T20:37:50Z","snapshot_observed_at":"2026-08-07T08:11:20.950548Z","submitted_at":"2024-05-23T13:48:54Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14573","snapshot_observed_at":"2026-08-07T05:04:03.238577Z","title":"Androidworld: A dynamic benchmarking environment for autonomous agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.238577Z"},"links":{"cited_paper":"/paper/2405.14573","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:3c364af07b7dfbdb19d369f2c4b78a6de40ab842916667cb35f139c521b6e90a","observation_id":"1cb98f84-0cca-49b2-90dc-bdd3b09d8f1e","resolution":{"observed_at":"2026-08-07T05:04:03.238577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24024","last_updated":"2024-11-04T05:57:31Z","snapshot_observed_at":"2026-08-05T20:27:11.926706Z","submitted_at":"2024-10-31T15:25:20Z","title":"AndroidLab: Training and Systematic Benchmarking of Android Autonomous Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24024","snapshot_observed_at":"2026-08-07T05:04:03.289818Z","title":"Androidlab: Training and systematic benchmarking of android autonomous agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.289818Z"},"links":{"cited_paper":"/paper/2410.24024","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:0f2f86f0501d587676eef8e1d4f6ce18d1eedffbba34fae0f8b3304b9b141936","observation_id":"78fc35ad-43b9-4c9b-a03c-fdd48555b02b","resolution":{"observed_at":"2026-08-07T05:04:03.289818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:03.353342Z","title":"An- droidinthewild: A large-scale dataset for android device control.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.353342Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:74879e20f8ae91d9303f3d04c335f92679bc93c3b270f84a4b3d5e3722f53e2c","observation_id":"06e469b1-8c5d-423b-9e53-38821d72c876","resolution":{"observed_at":"2026-08-07T05:04:03.353342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11436","last_updated":"2024-06-07T04:52:29Z","snapshot_observed_at":"2026-07-06T16:21:21.249108Z","submitted_at":"2023-09-20T16:12:32Z","title":"You Only Look at Screens: Multimodal Chain-of-Action Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11436","snapshot_observed_at":"2026-08-07T05:04:03.408143Z","title":"You only look at screens: Multimodal chain-of-action agents","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.408143Z"},"links":{"cited_paper":"/paper/2309.11436","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:8676c7abd980b47b1a828ecf2c4436ccdc15227f502103de85fc8cb922a94068","observation_id":"9dd1ac17-6417-40d8-a34c-5fe592090746","resolution":{"observed_at":"2026-08-07T05:04:03.408143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:06.827458Z","title":"Ferret-ui: Grounded mobile ui understanding with multimodal llms","venue":null,"work_id":"5d36fe99-92dc-4ed6-a0b3-9c6337058859","year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.467121Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:c3aa63f578e80b67aebc3ceb17391560356d75a7378bfbf8c988900f36ca1e66","observation_id":"e120fe4f-0829-4923-bad0-593c9ab534ce","resolution":{"observed_at":"2026-08-07T05:04:06.831154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:06.817235Z","title":"On the effects of data scale on computer control agents","venue":null,"work_id":"f3a2ec06-dd49-4c3d-b345-770832e22648","year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.563320Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:5b7dcb76a44a40d081bb9724b508e8859b9dc8794b7ae4fa66a3110c60b3498c","observation_id":"affe60fd-f599-41ed-a713-79b51a63b366","resolution":{"observed_at":"2026-08-07T05:04:06.820745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10935","last_updated":"2024-02-23T04:36:51Z","snapshot_observed_at":"2026-08-08T03:28:12.161766Z","submitted_at":"2024-01-17T08:10:35Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10935","snapshot_observed_at":"2026-08-07T05:04:03.636959Z","title":"Seeclick: Harnessing gui grounding for advanced visual gui agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.636959Z"},"links":{"cited_paper":"/paper/2401.10935","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:9801a43d038d620be3310aff8ac45fa5d4aabdfc8c7a186044def01c5427f4d4","observation_id":"7a6ac3c1-69d2-43b3-bc0a-3423c7de5130","resolution":{"observed_at":"2026-08-07T05:04:03.636959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00993","last_updated":"2024-07-01T06:10:01Z","snapshot_observed_at":"2026-07-06T18:39:20.664293Z","submitted_at":"2024-07-01T06:10:01Z","title":"Mobile-Bench: An Evaluation Benchmark for LLM-based Mobile Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00993","snapshot_observed_at":"2026-08-07T05:04:03.689317Z","title":"Mobile-bench: An evaluation benchmark for llm-based mobile agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.689317Z"},"links":{"cited_paper":"/paper/2407.00993","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:027213109bcb656c81bcd25a0e00b95250b57dd2df8f7d605b9ad16283d2854d","observation_id":"8ab96405-d688-47e8-9a67-e88bf182d052","resolution":{"observed_at":"2026-08-07T05:04:03.689317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13771","last_updated":"2026-07-05T07:51:04Z","snapshot_observed_at":"2026-08-04T19:11:48.797552Z","submitted_at":"2023-12-21T11:52:45Z","title":"AppAgent: Multimodal Agents as Smartphone Users","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13771","snapshot_observed_at":"2026-08-07T05:04:03.736172Z","title":"Appagent: Multimodal agents as smartphone users","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.736172Z"},"links":{"cited_paper":"/paper/2312.13771","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:4b350952f152f347128391709bd0d3e601101e524acddc39c4fca69cb00ca70e","observation_id":"25b3ad38-83d4-4f0b-9988-8040f38dff3a","resolution":{"observed_at":"2026-08-07T05:04:03.736172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:06.806835Z","title":"Autodroid: Llm-powered task automation in android","venue":null,"work_id":"54982534-24b2-4a9c-ac9f-8da6036b796c","year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.800152Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:55ac1e5f2b311035d0ecbe9819d438e7e782625086692208ad13796936672a05","observation_id":"8b2aa62d-05de-46b3-8511-b1c988b23ef2","resolution":{"observed_at":"2026-08-07T05:04:06.810370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:03.858282Z","title":"Spa-bench: A comprehensive benchmark for smartphone agent evaluation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.858282Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:6034fccddaa70772cdc40ce3c8d5b8076ed1a8c62de822bd4f39f161bb47cc42","observation_id":"aafd57fe-9844-47f3-8995-538947c7b609","resolution":{"observed_at":"2026-08-07T05:04:03.858282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:03.905222Z","title":"Appagent v2: Advanced agent for flexible mobile interactions.arXiv preprint arXiv:2408.11824, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.905222Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:618e81105d1fb9f03df38a2d76c31e3a67d69e6c7cc3d8c727f12210ca88b0d9","observation_id":"c0cf9d2c-af07-452d-9f15-c48c14625a63","resolution":{"observed_at":"2026-08-07T05:04:03.905222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16158","last_updated":"2024-04-18T06:53:38Z","snapshot_observed_at":"2026-08-05T03:22:24.562938Z","submitted_at":"2024-01-29T13:46:37Z","title":"Mobile-Agent: Autonomous Multi-Modal Mobile Device Agent with Visual Perception","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16158","snapshot_observed_at":"2026-08-07T05:04:03.960768Z","title":"Mobile-agent: Autonomous multi-modal mobile device agent with visual perception","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.960768Z"},"links":{"cited_paper":"/paper/2401.16158","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:1596964dd9db35af49324a0029397a26d3eb6408e48012c9ababcb037609c678","observation_id":"4bfccc72-5761-4723-b966-e18f30e0e118","resolution":{"observed_at":"2026-08-07T05:04:03.960768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01014","last_updated":"2024-06-03T05:50:00Z","snapshot_observed_at":"2026-08-06T22:15:02.337988Z","submitted_at":"2024-06-03T05:50:00Z","title":"Mobile-Agent-v2: Mobile Device Operation Assistant with Effective Navigation via Multi-Agent Collaboration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01014","snapshot_observed_at":"2026-08-07T05:04:04.037198Z","title":"Mobile-agent-v2: Mobile device operation assistant with effective navigation via multi-agent collaboration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.037198Z"},"links":{"cited_paper":"/paper/2406.01014","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:75eff251ee0c722a2273b0601eba714a31bf748b7c904425a54e4d96a7db1cd9","observation_id":"af324b9c-961d-468b-9eed-e76b8c429c01","resolution":{"observed_at":"2026-08-07T05:04:04.037198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11733","last_updated":"2025-01-28T16:58:02Z","snapshot_observed_at":"2026-08-07T18:11:16.595464Z","submitted_at":"2025-01-20T20:35:46Z","title":"Mobile-Agent-E: Self-Evolving Mobile Assistant for Complex Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11733","snapshot_observed_at":"2026-08-07T05:04:04.128061Z","title":"Mobile-agent-e: Self-evolving mobile assistant for complex tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.128061Z"},"links":{"cited_paper":"/paper/2501.11733","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:bc588705c52fc697a3fcdd2584c382c8fcb9da39f201a4414b6de6fe463afd97","observation_id":"5b244fa8-9e5b-4d5f-a9b1-8a5664ff94ba","resolution":{"observed_at":"2026-08-07T05:04:04.128061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07939","last_updated":"2024-05-23T05:18:58Z","snapshot_observed_at":"2026-08-01T11:47:21.821212Z","submitted_at":"2024-02-08T15:40:35Z","title":"UFO: A UI-Focused Agent for Windows OS Interaction","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07939","snapshot_observed_at":"2026-08-07T05:04:04.198831Z","title":"Ufo: A ui-focused agent for windows os interaction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.198831Z"},"links":{"cited_paper":"/paper/2402.07939","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:30e3a8066233cefe74c1e07e2c9782e249221ff1b85eb8866db1198476d3bfcc","observation_id":"5d396ddb-ea92-4ce5-9f67-2eb05168a37f","resolution":{"observed_at":"2026-08-07T05:04:04.198831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01614","last_updated":"2024-03-12T23:14:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-03T08:33:09Z","title":"GPT-4V(ision) is a Generalist Web Agent, if Grounded","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01614","snapshot_observed_at":"2026-08-07T05:04:04.244499Z","title":"Gpt-4v (ision) is a generalist web agent, if grounded","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.244499Z"},"links":{"cited_paper":"/paper/2401.01614","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:b95436df83adb1480901acfbeeab8bf91fe9b36c0fd8a7e04a4336ec2786d351","observation_id":"2b67b76a-4a95-4ccb-a272-dc916dc58a08","resolution":{"observed_at":"2026-08-07T05:04:04.244499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04575","last_updated":"2025-01-08T15:45:21Z","snapshot_observed_at":"2026-08-05T04:06:23.326388Z","submitted_at":"2025-01-08T15:45:21Z","title":"InfiGUIAgent: A Multimodal Generalist GUI Agent with Native Reasoning and Reflection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04575","snapshot_observed_at":"2026-08-07T05:04:04.291048Z","title":"Infiguiagent: A multimodal generalist gui agent with native reasoning and reflection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.291048Z"},"links":{"cited_paper":"/paper/2501.04575","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:43d16d80ac2c26dded2176856248172de2e4ee8266385ec9c41547842bdfba16","observation_id":"da7c9d20-85b4-43dc-ad3c-9077092eeb0b","resolution":{"observed_at":"2026-08-07T05:04:04.291048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08164","last_updated":"2024-10-10T17:43:51Z","snapshot_observed_at":"2026-07-06T19:31:23.072307Z","submitted_at":"2024-10-10T17:43:51Z","title":"Agent S: An Open Agentic Framework that Uses Computers Like a Human","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08164","snapshot_observed_at":"2026-08-07T05:04:04.321652Z","title":"Agent s: An open agentic framework that uses computers like a human.arXiv preprint arXiv:2410.08164, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.321652Z"},"links":{"cited_paper":"/paper/2410.08164","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:ed4f35768cf5e18df63723ab5388f9a6c176921082877bf0952c772b1a0c55d9","observation_id":"328cd54c-6632-4a74-8a59-5d376eb24128","resolution":{"observed_at":"2026-08-07T05:04:04.321652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07429","last_updated":"2024-09-11T17:21:00Z","snapshot_observed_at":"2026-08-07T15:35:11.892405Z","submitted_at":"2024-09-11T17:21:00Z","title":"Agent Workflow Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07429","snapshot_observed_at":"2026-08-07T05:04:04.353532Z","title":"Agent workflow memory","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.353532Z"},"links":{"cited_paper":"/paper/2409.07429","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:153c60b53e3f01966bdad42af473c1d0d3c88bd113c829f82b0cd8fb576972fe","observation_id":"ed677184-b9ba-4742-a7c5-4eb11fb7b4fa","resolution":{"observed_at":"2026-08-07T05:04:04.353532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00203","last_updated":"2024-08-01T00:00:43Z","snapshot_observed_at":"2026-07-06T18:55:19.894571Z","submitted_at":"2024-08-01T00:00:43Z","title":"OmniParser for Pure Vision Based GUI Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00203","snapshot_observed_at":"2026-08-07T05:04:04.373511Z","title":"Omniparser for pure vision based gui agent","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.373511Z"},"links":{"cited_paper":"/paper/2408.00203","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:eb08d3126227cc1a6eeb2e1a773a16bf1a07694b6052d272f93bb88f892edcb2","observation_id":"b8ae43c8-1b8d-4447-a2e0-062b06628d69","resolution":{"observed_at":"2026-08-07T05:04:04.373511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-04T03:29:49.409446Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-07T05:04:04.415109Z","title":"Set-of-mark prompting unleashes extraordinary visual grounding in gpt-4v.arXiv preprint arXiv:2310.11441, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.415109Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:301ac57b33e67519f1e303869ba55039b6bc281b27015a55b5f118c607ec59ea","observation_id":"121c460c-7629-4919-bd34-0a5bedb1f0d6","resolution":{"observed_at":"2026-08-07T05:04:04.415109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07562","last_updated":"2023-11-13T18:53:37Z","snapshot_observed_at":"2026-07-06T16:46:57.403995Z","submitted_at":"2023-11-13T18:53:37Z","title":"GPT-4V in Wonderland: Large Multimodal Models for Zero-Shot Smartphone GUI Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07562","snapshot_observed_at":"2026-08-07T05:04:04.450958Z","title":"Gpt-4v in wonderland: Large multimodal models for zero-shot smartphone gui navigation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.450958Z"},"links":{"cited_paper":"/paper/2311.07562","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:60da99059e72068b19b0728bae66c7af292674fe4c0177a4579736755ba22746","observation_id":"f8344364-2b2d-46e1-9bff-8d656eb6c471","resolution":{"observed_at":"2026-08-07T05:04:04.450958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08451","last_updated":"2025-08-01T03:37:57Z","snapshot_observed_at":"2026-08-03T18:32:07.479349Z","submitted_at":"2024-06-12T17:44:26Z","title":"GUIOdyssey: A Comprehensive Dataset for Cross-App GUI Navigation on Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08451","snapshot_observed_at":"2026-08-07T05:04:04.486846Z","title":"Gui odyssey: A comprehensive dataset for cross-app gui navigation on mobile devices","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.486846Z"},"links":{"cited_paper":"/paper/2406.08451","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:e52c6096dc296d9453c7361779f9a1344a388fa0f90bb61b3e90cee204b81f29","observation_id":"40e3c447-011a-4812-9691-076cf8bdc8c3","resolution":{"observed_at":"2026-08-07T05:04:04.486846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17465","last_updated":"2024-11-26T14:29:47Z","snapshot_observed_at":"2026-07-06T19:57:18.481261Z","submitted_at":"2024-11-26T14:29:47Z","title":"ShowUI: One Vision-Language-Action Model for GUI Visual Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17465","snapshot_observed_at":"2026-08-07T05:04:04.513377Z","title":"Showui: One vision-language-action model for gui visual agent","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.513377Z"},"links":{"cited_paper":"/paper/2411.17465","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:599bf48590d073f44123312d644a09d28c131796770ecb52d0a702c51e1e3cbb","observation_id":"604549a2-8239-4c56-9bb1-6062220719f0","resolution":{"observed_at":"2026-08-07T05:04:04.513377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.03196","last_updated":"2025-04-16T15:34:51Z","snapshot_observed_at":"2026-08-07T17:28:37.361116Z","submitted_at":"2025-03-05T05:30:22Z","title":"SpiritSight Agent: Advanced GUI Agent with One Look","version":2},"cited_work":{"arxiv_id":"2503.03196","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.03196","snapshot_observed_at":"2026-08-07T05:04:06.099231Z","title":"SpiritSight Agent: Advanced GUI Agent with One Look","venue":"cs.CV","work_id":"0a924ae7-9209-4437-8ff9-05eb6ce6801b","year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.549092Z"},"links":{"cited_paper":"/paper/2503.03196","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:21c54aa7d219dd75f487cfd8c86d939688111c67027b462afd901b9c4472eeb8","observation_id":"76aa6030-b91c-4ada-8ce5-02b345f61834","resolution":{"observed_at":"2026-08-07T05:04:06.104278Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02713","last_updated":"2024-07-13T02:12:30Z","snapshot_observed_at":"2026-07-06T17:39:41.498480Z","submitted_at":"2024-03-05T07:09:35Z","title":"Android in the Zoo: Chain-of-Action-Thought for GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02713","snapshot_observed_at":"2026-08-07T05:04:04.582840Z","title":"Android in the zoo: Chain-of-action-thought for gui agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.582840Z"},"links":{"cited_paper":"/paper/2403.02713","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:9f993782ca0e678bd1c3be05e3e1970f4e82b15bf1c354cc35a90b651b94c97c","observation_id":"1a4b1b1c-ddca-49cd-b3ce-78c787774a18","resolution":{"observed_at":"2026-08-07T05:04:04.582840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02337","last_updated":"2025-01-27T11:56:15Z","snapshot_observed_at":"2026-07-06T19:45:00.034364Z","submitted_at":"2024-11-04T17:59:58Z","title":"WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02337","snapshot_observed_at":"2026-08-07T05:04:04.613379Z","title":"Webrl: Training llm web agents via self-evolving online curriculum reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.613379Z"},"links":{"cited_paper":"/paper/2411.02337","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:240ae6b46749f7c920a2e640c110537abae06928cfd7988d579b40ae77432e0d","observation_id":"23b686ae-f595-477c-a155-9ea064784556","resolution":{"observed_at":"2026-08-07T05:04:04.613379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07199","last_updated":"2024-08-13T20:52:13Z","snapshot_observed_at":"2026-08-01T22:07:45.419539Z","submitted_at":"2024-08-13T20:52:13Z","title":"Agent Q: Advanced Reasoning and Learning for Autonomous AI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07199","snapshot_observed_at":"2026-08-07T05:04:04.651490Z","title":"Agent q: Advanced reasoning and learning for autonomous ai agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.651490Z"},"links":{"cited_paper":"/paper/2408.07199","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:08f819114de1a32a6f317047c799e0553afd6bf2dd39c74eaeb00e60311d792e","observation_id":"cded1182-6c6b-40c2-805b-7894c10aa0e6","resolution":{"observed_at":"2026-08-07T05:04:04.651490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04454","last_updated":"2025-05-05T16:17:20Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:58:26Z","title":"Aguvis: Unified Pure Vision Agents for Autonomous GUI Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04454","snapshot_observed_at":"2026-08-07T05:04:04.685367Z","title":"Aguvis: Unified pure vision agents for autonomous gui interaction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.685367Z"},"links":{"cited_paper":"/paper/2412.04454","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:3d25f97fe91d07c904b72bf3f98e06234bb49408e717b938b382d379448f89da","observation_id":"30b34fbe-fbbf-4060-8d29-ee17119870ef","resolution":{"observed_at":"2026-08-07T05:04:04.685367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:04.720347Z","title":"Screenspot-pro: Gui grounding for professional high-resolution computer use, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.720347Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:d307f18b5e91ca54615e0281420dfc8cc145ac65005303788ceff9b5408de45a","observation_id":"055d1a09-a581-46fa-83c3-ef717ef1f844","resolution":{"observed_at":"2026-08-07T05:04:04.720347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13896","last_updated":"2025-01-27T18:58:42Z","snapshot_observed_at":"2026-08-07T10:56:15.098153Z","submitted_at":"2025-01-23T18:16:21Z","title":"GUI-Bee: Align GUI Action Grounding to Novel Environments via Autonomous Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13896","snapshot_observed_at":"2026-08-07T05:04:04.829186Z","title":"Gui-bee: Align gui action grounding to novel environments via autonomous exploration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.829186Z"},"links":{"cited_paper":"/paper/2501.13896","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:66152dcd8f6c1e48fd1edb751642892e7c9ec48bf21085079d9d2937c6910cf7","observation_id":"7e897fcb-a146-48a4-abc8-e014ba706a99","resolution":{"observed_at":"2026-08-07T05:04:04.829186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.08199","last_updated":"2025-02-09T21:09:17Z","snapshot_observed_at":"2026-07-06T13:53:13.702355Z","submitted_at":"2022-09-16T23:49:00Z","title":"ScreenQA: Large-Scale Question-Answer Pairs over Mobile App Screenshots","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.08199","snapshot_observed_at":"2026-08-07T05:04:04.926947Z","title":"Screenqa: Large-scale question-answer pairs over mobile app screenshots","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:04.926947Z"},"links":{"cited_paper":"/paper/2209.08199","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:5a2bef973949e24653785be0f7403813ba58b87ca2d665099c413bc5ab871bbb","observation_id":"ef29ff60-b3fa-4c83-81fd-aa66fc7b7c9d","resolution":{"observed_at":"2026-08-07T05:04:04.926947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.09465","last_updated":"2021-11-08T08:31:44Z","snapshot_observed_at":"2026-07-06T10:34:53.435463Z","submitted_at":"2021-01-23T09:43:44Z","title":"WebSRC: A Dataset for Web-Based Structural Reading Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.09465","snapshot_observed_at":"2026-08-07T05:04:05.032391Z","title":"Websrc: a dataset for web-based structural reading comprehension","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.032391Z"},"links":{"cited_paper":"/paper/2101.09465","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:02cf88224448bb5b27476241aacf678f11462c20d03f86a9505d5492b33d2848","observation_id":"853a1692-f1be-4e3f-9899-e840f3a88902","resolution":{"observed_at":"2026-08-07T05:04:05.032391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05955","last_updated":"2024-04-09T02:29:39Z","snapshot_observed_at":"2026-07-06T17:57:31.912970Z","submitted_at":"2024-04-09T02:29:39Z","title":"VisualWebBench: How Far Have Multimodal LLMs Evolved in Web Page Understanding and Grounding?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05955","snapshot_observed_at":"2026-08-07T05:04:05.089521Z","title":"Visualwebbench: How far have multimodal llms evolved in web page understanding and grounding? arXiv preprint arXiv:2404.05955, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.089521Z"},"links":{"cited_paper":"/paper/2404.05955","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:4f7df32b5225efedaf77bc41850b3549eee80817e41442d70f8a65e8876ed863","observation_id":"b4bc93dd-f677-4116-8ae0-4a539e227d7b","resolution":{"observed_at":"2026-08-07T05:04:05.089521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:05.187438Z","title":"Weblinx: Real-world website navigation with multi-turn dialogue","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.187438Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:960d2d4ea07e78c44e0fe3f205d50f0f06a558ec9f3ece61fdcdebe73eeaff6a","observation_id":"e5d680d0-8e48-4edc-b30c-f81e872c6e59","resolution":{"observed_at":"2026-08-07T05:04:05.187438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11029","last_updated":"2022-11-24T06:34:43Z","snapshot_observed_at":"2026-07-06T13:12:39.361042Z","submitted_at":"2022-05-23T04:05:37Z","title":"META-GUI: Towards Multi-modal Conversational Agents on Mobile GUI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11029","snapshot_observed_at":"2026-08-07T05:04:05.323156Z","title":"Meta-gui: Towards multi-modal conversational agents on mobile gui","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.323156Z"},"links":{"cited_paper":"/paper/2205.11029","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:9fd013e3b966f5a872c75dbfa1e4c137e5549282d167b26d27389140ce53e952","observation_id":"8fe52bbc-0ef5-4db9-835d-e1405d890d4d","resolution":{"observed_at":"2026-08-07T05:04:05.323156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:06.783961Z","title":"Mind2web: Towards a generalist agent for the web","venue":null,"work_id":"24ea5581-6fef-455d-ad4b-79646f3afcdc","year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.398029Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:213a4a25cef8474e873caf941c7a70dea8f52c003dfe182be50b02a9968376c9","observation_id":"3e1716cf-2902-4ed0-b2cd-4b84901ae0b9","resolution":{"observed_at":"2026-08-07T05:04:06.787663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08184","last_updated":"2024-06-12T13:14:50Z","snapshot_observed_at":"2026-07-06T18:29:34.538901Z","submitted_at":"2024-06-12T13:14:50Z","title":"MobileAgentBench: An Efficient and User-Friendly Benchmark for Mobile LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08184","snapshot_observed_at":"2026-08-07T05:04:05.486686Z","title":"Mobileagentbench: An efficient and user-friendly benchmark for mobile llm agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.486686Z"},"links":{"cited_paper":"/paper/2406.08184","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:9222ff99b9810fe69743cb5fb019a308596f3247ede46efe7edfa4598e9b6762","observation_id":"9ed03f4d-d766-4e68-ab22-d58f885d811e","resolution":{"observed_at":"2026-08-07T05:04:05.486686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:06.772829Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer environments","venue":null,"work_id":"49b1f784-cfe4-448b-b06c-5fa4d33ca86b","year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.504034Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:e4322413692204b6f05a96026c3406951630f07bc737f039419edfaa2a3d1dec","observation_id":"c6f8d7e9-15cb-4a5a-a969-f48bd44883e6","resolution":{"observed_at":"2026-08-07T05:04:06.776478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-07T05:04:05.511312Z","title":"Webarena: A realistic web environment for building autonomous agents","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.511312Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:854962675c53f7bf0e256dc9b62938690dd3caecf884f1b036c0517ebab729f8","observation_id":"786624df-57b8-439b-b6cc-a79252e9a1f2","resolution":{"observed_at":"2026-08-07T05:04:05.511312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12373","last_updated":"2024-07-16T06:19:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-18T07:58:33Z","title":"WebCanvas: Benchmarking Web Agents in Online Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12373","snapshot_observed_at":"2026-08-07T05:04:05.517672Z","title":"Webcanvas: Benchmarking web agents in online environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.517672Z"},"links":{"cited_paper":"/paper/2406.12373","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:29ba9797941f152e828a20371a22adbff7a70930f10883c9133846c61c4afee5","observation_id":"b60d8667-6fe9-4a33-936f-d8a3b50fe2fd","resolution":{"observed_at":"2026-08-07T05:04:05.517672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08264","last_updated":"2024-09-13T20:17:13Z","snapshot_observed_at":"2026-08-05T14:11:56.506073Z","submitted_at":"2024-09-12T17:56:43Z","title":"Windows Agent Arena: Evaluating Multi-Modal OS Agents at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08264","snapshot_observed_at":"2026-08-07T05:04:05.525625Z","title":"Windows agent arena: Evaluating multi-modal os agents at scale","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.525625Z"},"links":{"cited_paper":"/paper/2409.08264","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:574d057981af338be9bd8016b49165d53b5cb60bca829df4cf0dce880d3af558","observation_id":"93d2ffcb-d844-4b02-b81d-66b34b7f648f","resolution":{"observed_at":"2026-08-07T05:04:05.525625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07718","last_updated":"2024-07-23T06:19:28Z","snapshot_observed_at":"2026-08-02T12:09:24.340284Z","submitted_at":"2024-03-12T14:58:45Z","title":"WorkArena: How Capable Are Web Agents at Solving Common Knowledge Work Tasks?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07718","snapshot_observed_at":"2026-08-07T05:04:05.534348Z","title":"Workarena: How capable are web agents at solving common knowledge work tasks? arXiv preprint arXiv:2403.07718, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.534348Z"},"links":{"cited_paper":"/paper/2403.07718","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:1c91bfc72d7ef6e42d968f33e00a4ab84cc5ae259f34be887e5fa46864b7a014","observation_id":"159d9c6e-cfba-4b14-8950-45edfa1a5543","resolution":{"observed_at":"2026-08-07T05:04:05.534348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14282","last_updated":"2025-02-21T02:54:09Z","snapshot_observed_at":"2026-08-07T18:02:56.876716Z","submitted_at":"2025-02-20T05:41:55Z","title":"PC-Agent: A Hierarchical Multi-Agent Collaboration Framework for Complex Task Automation on PC","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14282","snapshot_observed_at":"2026-08-07T05:04:05.541599Z","title":"Pc-agent: A hierarchical multi-agent collaboration framework for complex task automation on pc","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.541599Z"},"links":{"cited_paper":"/paper/2502.14282","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:1b6e610d9cd748f86b0688f88f09d0bb4c8a69c265b27d917f1e6420a7d7e960","observation_id":"7a811a1e-47a3-46fd-a113-642e3e0e1d5c","resolution":{"observed_at":"2026-08-07T05:04:05.541599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07949","last_updated":"2025-05-20T19:54:36Z","snapshot_observed_at":"2026-07-06T20:35:02.935416Z","submitted_at":"2025-02-11T20:57:46Z","title":"Advancing Autonomous VLM Agents via Variational Subgoal-Conditioned Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2502.07949","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.07949","snapshot_observed_at":"2026-08-07T05:04:05.836097Z","title":"Advancing Autonomous VLM Agents via Variational Subgoal-Conditioned Reinforcement Learning","venue":"cs.LG","work_id":"ade38fb2-0d99-41ca-95e3-b69a39c73193","year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.548532Z"},"links":{"cited_paper":"/paper/2502.07949","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:c87df75cf5daf0c0482037783fd522935551f1a884d84b47cb763ee4a050efd3","observation_id":"8dc86540-026a-4449-8965-31049f5667c0","resolution":{"observed_at":"2026-08-07T05:04:05.841970Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:05.554252Z","title":"Markov decision processes","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.554252Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:8593d9899b220f7b366cb440e7c715d474a023aa548e113c18cfd6573b690122","observation_id":"a871f6a9-ae9c-41bb-87c1-5621be104ded","resolution":{"observed_at":"2026-08-07T05:04:05.554252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:05.560405Z","title":"Atom of thoughts for markov llm test-time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.560405Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:a9ad7739c0420259ae912000d7b5f032b22ebb1151cc084c3caba616b5377853","observation_id":"dd4bb27d-f39b-474f-9e1b-2108037668f0","resolution":{"observed_at":"2026-08-07T05:04:05.560405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:05.567481Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.567481Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:7d534c410d46ee63f936f884abc9b8f0182fc30104791999bff30d613084dade","observation_id":"8b2d7092-f7eb-4f9c-9305-cc919432e220","resolution":{"observed_at":"2026-08-07T05:04:05.567481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:05.574128Z","title":"Reflexion: Language agents with verbal reinforcement learning.Advances in Neural Information Processing Systems, 36:8634–8652, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.574128Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:cb1b1bb565c1583ca910a53340406da87201d876897349893dea83a6e50625e9","observation_id":"97d50b36-9c26-4a78-91de-56c022397e71","resolution":{"observed_at":"2026-08-07T05:04:05.574128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09390","last_updated":"2023-12-14T23:07:33Z","snapshot_observed_at":"2026-07-06T17:02:09.539730Z","submitted_at":"2023-12-14T23:07:33Z","title":"Weak-to-Strong Generalization: Eliciting Strong Capabilities With Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09390","snapshot_observed_at":"2026-08-07T05:04:05.579670Z","title":"Weak-to-strong gener- alization: Eliciting strong capabilities with weak supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.579670Z"},"links":{"cited_paper":"/paper/2312.09390","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:4535602783435b5750713da43dc1fdf7f0a2b18796dcdea7ba8f23e37b2ae78a","observation_id":"9f6fd665-91f9-4179-8453-e912d012597c","resolution":{"observed_at":"2026-08-07T05:04:05.579670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02544","last_updated":"2025-09-05T09:21:10Z","snapshot_observed_at":"2026-08-08T05:48:26.856044Z","submitted_at":"2024-08-05T15:16:22Z","title":"Caution for the Environment: Multimodal LLM Agents are Susceptible to Environmental Distractions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02544","snapshot_observed_at":"2026-08-07T05:04:05.585725Z","title":"Caution for the environment: Multimodal agents are susceptible to environmental distractions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.585725Z"},"links":{"cited_paper":"/paper/2408.02544","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:6b25ad06712e49ee8d9842e9ece2c0153924e650ce0a04e82f4929ad4f9b8e50","observation_id":"e927330d-dead-4118-a1f3-07d2f5c8d149","resolution":{"observed_at":"2026-08-07T05:04:05.585725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:06.742888Z","title":"Hello gpt-4o, 2024","venue":null,"work_id":"fda39c59-892f-469c-9fae-b806e45df730","year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.594368Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:5f8dad1568fc297f59f03eef74cbd8b1a1de2d267281f9ee9daecdee6abcf9b5","observation_id":"8d8c3f67-09cc-4857-8540-11d8452de19b","resolution":{"observed_at":"2026-08-07T05:04:06.746456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:06.732788Z","title":"Os-atlas: A foundation action model for generalist gui agents","venue":null,"work_id":"12275000-9885-440f-8505-ef91612bbdea","year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.599559Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:84681f1bce1773fe687314281166441c4e44914adfbf23687e6d82af58d10cb7","observation_id":"56dcd7ac-9385-460d-9d99-ef339ba0c3a0","resolution":{"observed_at":"2026-08-07T05:04:06.736365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:06.719539Z","title":"Ui-tars: Pioneering automated gui interaction with native agents","venue":null,"work_id":"ba3e0bcf-0fc9-4dba-a6a6-8bac1852474d","year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.608331Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:6c21ac9c5f16fc2a91b0fb4a5819cfb41a0bad0eaed3a7ae46de4e41514dfa77","observation_id":"4b7e302e-95f3-40b8-bfef-113de7c92a36","resolution":{"observed_at":"2026-08-07T05:04:06.725797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-07-06T20:28:33.378335Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-07T05:04:05.615825Z","title":"Thoughts are all over the place: On the underthinking of o1-like llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.615825Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:0b18d034f75564453814656952ea4309615f67f05b495b64bd56dc1bfe7026b0","observation_id":"18dac5ce-0d04-446d-9fa6-7808f1a8d6e6","resolution":{"observed_at":"2026-08-07T05:04:05.615825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:05.623583Z","title":"Language models don’t always say what they think: Unfaithful explanations in chain-of-thought prompting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.623583Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:a9b9999449d424ab23eeedf1cd11aa4662c4e9c5b034ce860c859e9a99e03ee8","observation_id":"53a8a851-0d63-4cb5-8708-049dd6a9b3e1","resolution":{"observed_at":"2026-08-07T05:04:05.623583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13702","last_updated":"2023-07-17T01:08:39Z","snapshot_observed_at":"2026-07-31T04:21:27.501709Z","submitted_at":"2023-07-17T01:08:39Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13702","snapshot_observed_at":"2026-08-07T05:04:05.631673Z","title":"Measuring faithfulness in chain-of-thought reasoning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.631673Z"},"links":{"cited_paper":"/paper/2307.13702","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:e58d4be98ae63ccd35e88aeafb43676830e322589ca4bf16f2c9d0c45a6f2de7","observation_id":"0623ede6-6f91-4c9e-bdc0-147e34fa4012","resolution":{"observed_at":"2026-08-07T05:04:05.631673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:04:05.638229Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.638229Z"},"links":{"citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:05fde31573f22bbc7db0b18bf6de82a74e43ec74895b50df73d22e8ea82efbe1","observation_id":"7e42798b-55b3-4b7e-9137-3cc6e15ca230","resolution":{"observed_at":"2026-08-07T05:04:05.638229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09686","last_updated":"2024-11-02T17:17:32Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T00:57:10Z","title":"Generalization of Compositional Tasks with Logical Specification via Implicit Planning","version":2},"cited_work":{"arxiv_id":"2410.09686","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09686","snapshot_observed_at":"2026-08-07T05:04:05.704768Z","title":"Generalization of Compositional Tasks with Logical Specification via Implicit Planning","venue":"cs.AI","work_id":"d52a3968-5b8e-436f-9096-5dc20bba1318","year":2024},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.646663Z"},"links":{"cited_paper":"/paper/2410.09686","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:6174ccbc444f251b840f1190807ac9bbdfc61d561359b7b23da120c17377891c","observation_id":"4b5f6469-e8d6-46bc-a53a-34c4d79205f9","resolution":{"observed_at":"2026-08-07T05:04:05.711176Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18751","last_updated":"2024-12-31T04:24:16Z","snapshot_observed_at":"2026-08-04T17:33:01.014751Z","submitted_at":"2023-11-30T17:50:47Z","title":"Exposing Limitations of Language Model Agents in Sequential-Task Compositions on the Web","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18751","snapshot_observed_at":"2026-08-07T05:04:05.654823Z","title":"ping-pong","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:05.654823Z"},"links":{"cited_paper":"/paper/2311.18751","citing_paper":"/paper/2506.08972"},"observation_digest":"sha256:a8ea58aae5b4b3eeea1cfe8ebc1e25ffa3e0f62c0afc71367f26bdefe3d92b35","observation_id":"cb9d142b-512e-4d4d-956a-427eb70795ad","resolution":{"observed_at":"2026-08-07T05:04:05.654823Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.08972","last_updated":"2025-06-10T16:45:29Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:38:06.207367Z","submitted_at":"2025-06-10T16:45:29Z","title":"Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":61,"verified_exact":3,"verified_fuzzy":9},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 0 inbound Pith citation observations for arXiv:2506.08972."}