{"as_of":"2026-08-05T12:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d3c62478ec5b3fb440c1e3e58d4e60192d3f6380bc10cb4a162e59e52601b2d7","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T07:31:33.690689Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.17697/citation-record","integrity":"/paper/2506.17697/integrity","json":"/paper/2506.17697/citation-record.json","paper":"/paper/2506.17697"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Camel: Commu- nicative agents for\" mind\" exploration of large language model society.NeurIPS, 36:51991–52008","venue":null,"work_id":"8b7b9e16-f257-42e2-8dec-8672096a2f8a","year":2023},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:f001ca90bcd9469e44d990cc3b94ae4f9e6854e47f746f15ce28e3c41f7f698d","observation_id":"07d46df5-c3ad-4237-9e6b-65635a632ea6","resolution":{"observed_at":"2026-05-19T07:32:09.643323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tora: A tool-integrated reasoning agent for mathematical problem solving","venue":null,"work_id":"480cb9c6-a78c-4503-80a2-525348caa34c","year":2023},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:8752dbd289012e981381c92e7ba2d7958e3cb10fafc50df5f6b51b13a15f6a8c","observation_id":"fd9f01dd-d766-47f6-a643-946b03742edf","resolution":{"observed_at":"2026-05-19T07:32:09.624287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A review of large language models and autonomous agents in chemistry.Chemical Science","venue":null,"work_id":"d10288e2-fa65-4845-aed0-b18fc3587dd9","year":2025},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:70352746d1d5d81752ed75bea95882a22f3228dfc94deaf5d52f7ece19835640","observation_id":"289bb91d-ce81-41aa-8a7f-078c8cc4143b","resolution":{"observed_at":"2026-05-19T07:32:09.641299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-evolving multi-agent collaboration networks for software development","venue":null,"work_id":"2f8fcb78-9664-4dc4-acc6-5110ac866b15","year":2025},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:af9919e1387758c75db61610684b6a49c41b41e9ab5fbe6c21f60d278d1c5c82","observation_id":"be0c0399-53a8-4087-93f2-91d82aa159de","resolution":{"observed_at":"2026-05-19T07:32:09.661794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Androidinthewild: A large-scale dataset for android device control.NeurIPS, 36","venue":null,"work_id":"89766331-d350-49f2-8c91-ad6c78aa2b4a","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:a7431188835c4736c299837bc82e79b420a9108e8e36db8bbc0010fea1e6c544","observation_id":"fa55ceda-e9c7-4550-85d4-c64db1dea685","resolution":{"observed_at":"2026-05-19T07:32:09.657134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14573","last_updated":"2025-04-06T20:37:50Z","snapshot_observed_at":"2026-07-06T18:18:39.093732Z","submitted_at":"2024-05-23T13:48:54Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","version":5},"cited_work":{"arxiv_id":"2405.14573","doi":"10.48550/arxiv.2405.14573","metadata_source":"pith","pith_arxiv_id":"2405.14573","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","venue":"cs.AI","work_id":"c5116d19-d3d3-40fd-9620-f7489812a9ba","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2405.14573","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:7c98c2e85067ee525d0a8524f16c217085f48fe328ffd442ba2a229b7d5a0dde","observation_id":"2c349e69-d9b9-485e-b060-14e5dc78642a","resolution":{"observed_at":"2026-05-19T07:32:08.756384Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01014","last_updated":"2024-06-03T05:50:00Z","snapshot_observed_at":"2026-07-06T18:24:13.721696Z","submitted_at":"2024-06-03T05:50:00Z","title":"Mobile-Agent-v2: Mobile Device Operation Assistant with Effective Navigation via Multi-Agent Collaboration","version":1},"cited_work":{"arxiv_id":"2406.01014","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.01014","snapshot_observed_at":"2026-07-04T10:59:46.546874Z","title":"Mobile-agent-v2: Mobile device operation assistant with effective navigation via multi-agent collaboration","venue":null,"work_id":"306c15cc-9c0a-4b57-9ab1-08680dbd0011","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2406.01014","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:c2a4ceda2a6cce12aa7b4b4e4aa047c18d5dd899c54982233bd6de7167273af0","observation_id":"336fa2fc-e533-4114-a8a4-0d5971d30030","resolution":{"observed_at":"2026-05-19T07:32:08.753491Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14803","last_updated":"2025-02-21T16:23:59Z","snapshot_observed_at":"2026-07-06T19:36:15.200874Z","submitted_at":"2024-10-18T18:19:56Z","title":"DistRL: An Asynchronous Distributed Reinforcement Learning Framework for On-Device Control Agents","version":5},"cited_work":{"arxiv_id":"2410.14803","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.14803","snapshot_observed_at":"2026-07-02T16:47:09.654706Z","title":"Distrl: An asynchronous distributed reinforcement learning framework for on-device control agents","venue":null,"work_id":"6cf7a629-0e5b-4f79-92fd-deea4355750d","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2410.14803","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:e4e7b1b93ef881f98e038a55cd73b7f133f7f9ae6eb85bee9327782555be37ea","observation_id":"fa606721-5759-4a79-8959-d11cae58e30c","resolution":{"observed_at":"2026-05-19T07:32:08.768556Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spa-bench: A comprehensive benchmark for smartphone agent evaluation","venue":null,"work_id":"260ea765-f865-4c98-92d2-787ce4627545","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:8a50804f352ee9de7ff36eb74367f57a8ce4ab5a1d99e6477c36ec22315cc429","observation_id":"560664f2-5171-41c6-91c9-2d8b4e06bbd8","resolution":{"observed_at":"2026-05-19T07:32:09.659630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17883","last_updated":"2025-02-12T17:51:51Z","snapshot_observed_at":"2026-07-06T19:38:26.783620Z","submitted_at":"2024-10-23T13:57:00Z","title":"Lightweight Neural App Control","version":2},"cited_work":{"arxiv_id":"2410.17883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.17883","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lightweight neural app control","venue":null,"work_id":"abeab7f7-3069-4a07-ad50-8fdeb00e3411","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2410.17883","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:09b56b2d8ef5bcbb131224f2832763c5a703fa279cacda3279fe686806638417","observation_id":"cb5ffc83-6523-44c0-8493-69f4d94d5419","resolution":{"observed_at":"2026-05-19T07:32:08.737899Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Appagent: Multimodal agents as smartphone users","venue":null,"work_id":"48e6ffd4-9db5-407b-8646-cdef843c15ab","year":2023},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:f24cccfcdd3ccc20ffaf4898493e1f5d45b3162b2dd669b81b0c82e9d04d1ee1","observation_id":"b314e664-fe38-45fc-8682-15458a3aa298","resolution":{"observed_at":"2026-05-19T07:32:09.651906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03679","last_updated":"2024-11-13T16:42:22Z","snapshot_observed_at":"2026-08-01T00:25:01.821032Z","submitted_at":"2024-06-06T01:49:29Z","title":"On the Effects of Data Scale on UI Control Agents","version":6},"cited_work":{"arxiv_id":"2406.03679","doi":"10.48550/arxiv.2406.03679","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.03679","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"On the effects of data scale on ui control agents","venue":"arXiv (Cornell University)","work_id":"545dec08-900c-409f-a10c-7b966b5016f1","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2406.03679","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:3593c5dc0c72730de8c5c9a99a6939cabcccd09e2ec3a58b5db64fcda72cfe7d","observation_id":"254a7d91-7519-40d7-aba5-e6f0d4b3be98","resolution":{"observed_at":"2026-05-19T07:32:08.732022Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning.Advances in Neural Information Processing Systems, 37:12461–12495","venue":null,"work_id":"2e961d17-0417-4946-a3f7-d055113ecfc6","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:b7d1ea914bd5cefde3af2cac68d6bd2b6e1e817be2b317a3e939214ed0db5174","observation_id":"11e07277-07d5-45a8-ae91-360f21b4c219","resolution":{"observed_at":"2026-05-19T07:32:09.654574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MIT press","venue":null,"work_id":"bc5863f6-7581-4880-ad16-40282aae7ed2","year":1981},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:09e4b0840c9e293fd4111ea86dc8f284802ffd10fbd7b33e677236780526a9ae","observation_id":"92306ef5-7d40-4a89-9b4d-1ffe74e7c923","resolution":{"observed_at":"2026-05-19T07:32:09.649930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13232","last_updated":"2025-03-29T08:59:09Z","snapshot_observed_at":"2026-08-05T09:13:49.732299Z","submitted_at":"2024-10-17T05:37:00Z","title":"Web Agents with World Models: Learning and Leveraging Environment Dynamics in Web Navigation","version":2},"cited_work":{"arxiv_id":"2410.13232","doi":"10.48550/arxiv.2410.13232","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.13232","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Web agents with world models: Learning and leveraging environment dynamics in web navigation","venue":"arXiv (Cornell University)","work_id":"ed121023-5e3f-4d27-bb09-1bf5b716c294","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2410.13232","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:d7b789cbc6fd2a7da8818f877b88beb5c7d64b1cc6871978a805628bd16e2949","observation_id":"68e8f1bb-e42b-4366-93bf-99e81b565c3d","resolution":{"observed_at":"2026-05-19T07:32:08.729111Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04575","last_updated":"2025-01-08T15:45:21Z","snapshot_observed_at":"2026-08-05T04:06:23.326388Z","submitted_at":"2025-01-08T15:45:21Z","title":"InfiGUIAgent: A Multimodal Generalist GUI Agent with Native Reasoning and Reflection","version":1},"cited_work":{"arxiv_id":"2501.04575","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.04575","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2501.04575 , year =","venue":null,"work_id":"158ad17f-ecff-470e-891b-d18558f04270","year":2025},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2501.04575","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:869c5f3db6070951f411acfa3619def7029dc67b2c5a42b4c050f39e8c337bbe","observation_id":"a81a23ca-e5ba-460f-b77b-ae3d7af39032","resolution":{"observed_at":"2026-05-19T07:32:08.747298Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A path towards autonomous machine intelligence version 0.9","venue":null,"work_id":"4f69c1f2-bd8d-4847-b27e-5faffeb1c9a2","year":2022},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:b88d13ba1b1fad359bd291604fd5050e6f214984f97b6fea6d2d2bd7b6747e8c","observation_id":"2770fa58-a26c-472d-b1e5-aabceadb56d0","resolution":{"observed_at":"2026-05-19T07:32:09.648102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.14499","doi":"10.48550/arxiv.2411.14499","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Understanding world or predicting future? a comprehensive survey of world models","venue":"arXiv (Cornell University)","work_id":"e72331de-c7bf-4552-ae35-8bd31147ef24","year":2025},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:e9f14cfaf49651c7b662c0e9b4590622f1afc7268cc75cdbcda78044890990f3","observation_id":"4f83ab78-444f-4016-9db6-614b7e08e1fe","resolution":{"observed_at":"2026-05-19T07:32:08.743833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06114","last_updated":"2024-09-26T17:14:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-09T19:42:22Z","title":"Learning Interactive Real-World Simulators","version":3},"cited_work":{"arxiv_id":"2310.06114","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.06114","snapshot_observed_at":"2026-07-04T17:09:59.117795Z","title":"Learning Interactive Real-World Simulators","venue":"cs.AI","work_id":"16f38691-7ab6-4e23-bba5-6b656579e579","year":2023},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2310.06114","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:41a125181df19508eab1d4e4f7f46308c783cc3cf1522c590743a4282968bc24","observation_id":"fec2d149-a9ef-4b91-a1b4-e57f7cd248ba","resolution":{"observed_at":"2026-05-19T07:32:08.740683Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09631","last_updated":"2024-03-14T17:58:41Z","snapshot_observed_at":"2026-07-06T17:44:45.924645Z","submitted_at":"2024-03-14T17:58:41Z","title":"3D-VLA: A 3D Vision-Language-Action Generative World Model","version":1},"cited_work":{"arxiv_id":"2403.09631","doi":"10.48550/arxiv.2403.09631","metadata_source":"pith","pith_arxiv_id":"2403.09631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"3D-VLA: A 3D Vision-Language-Action Generative World Model","venue":"cs.CV","work_id":"aebf924c-e761-437e-9cee-f1ccc2e427bd","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2403.09631","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:b8268e4a4ff6a964e04f0fada6214a3c079f6ac69da727597f6d1a2afee4b543","observation_id":"336692a1-eda4-4520-9bc3-b1f0b07728e7","resolution":{"observed_at":"2026-05-19T07:32:08.750282Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12377","last_updated":"2024-04-18T17:58:03Z","snapshot_observed_at":"2026-08-02T11:29:41.147175Z","submitted_at":"2024-04-18T17:58:03Z","title":"RoboDreamer: Learning Compositional World Models for Robot Imagination","version":1},"cited_work":{"arxiv_id":"2404.12377","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.12377","snapshot_observed_at":"2026-07-10T11:47:02.936864Z","title":"RoboDreamer: Learning Compositional World Models for Robot Imagination","venue":"cs.RO","work_id":"b1231baa-7c16-4ecf-a6a8-ef49d0875212","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2404.12377","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:5fa3d7e0fa1159d9486f9531799bb95f28488721219dbb14f646b01c54640acd","observation_id":"5c24657a-1f1f-40a8-a742-21469979ed69","resolution":{"observed_at":"2026-05-19T07:32:08.759287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compositional foundation models for hierarchical planning.Advances in Neural Information Processing Systems, 36:22304–22325","venue":null,"work_id":"fcd2d152-c489-4895-9fc6-fdb90ed87bb7","year":2023},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:7898778f42d59157273b5ef5c35002b78aa6b531ad7fa964f865efa76d91c7da","observation_id":"124b3522-7167-4077-bca2-f128391635d6","resolution":{"observed_at":"2026-05-19T07:32:09.634723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06559","last_updated":"2025-04-01T05:04:47Z","snapshot_observed_at":"2026-07-06T19:48:10.800324Z","submitted_at":"2024-11-10T18:50:51Z","title":"Is Your LLM Secretly a World Model of the Internet? Model-Based Planning for Web Agents","version":2},"cited_work":{"arxiv_id":"2411.06559","doi":"10.48550/arxiv.2411.06559","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.06559","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is your llm secretly a world model of the internet? model-based planning for web agents","venue":"arXiv (Cornell University)","work_id":"30c2e3ae-88b7-41e6-986b-6f097fe53d5f","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2411.06559","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:b40c56798a75f8d657da7cd4bdc8f4ac7bd47d909007a97358e4eb4852a69c55","observation_id":"c2d6d82a-e7e9-4f4c-bf0b-6713dfc5797b","resolution":{"observed_at":"2026-05-19T07:32:08.765321Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A picture is worth a thousand words: Language models plan from pixels","venue":null,"work_id":"27feace1-ad2b-4303-818a-3e05ec5cc192","year":2023},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:41f382c3363bc866a33b605d97ac37129dea393c20acb089e038650452900984","observation_id":"a577393c-d440-4437-a719-289c6f41b3f3","resolution":{"observed_at":"2026-05-19T07:32:09.637035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simple statistical gradient-following algorithms for connectionist reinforcement learning.Machine learning, 8:229–256","venue":null,"work_id":"faaf6e0f-850b-4674-8329-34c95e305f84","year":1992},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:9c2e2228a39c57c7f5b689bdf0a689956acf6d848e7d0e61c815a7fec76613c5","observation_id":"e55c3e53-7389-422e-be53-14063b077fb4","resolution":{"observed_at":"2026-05-19T07:32:09.639087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":"2112.09332","doi":"10.48550/arxiv.2112.09332","metadata_source":"pith","pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebGPT: Browser-assisted question-answering with human feedback","venue":"cs.CL","work_id":"e25ef3e1-4848-4cb9-bf28-67a420591165","year":2021},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:d3086a88df44e4811c2b4d6d3ad406de2a676bb78da67a7c0b72f7b550e73ef6","observation_id":"9085e049-d3e5-44e6-bb98-17e728330be9","resolution":{"observed_at":"2026-05-19T07:32:08.734852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T18:16:26.555721Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744","venue":null,"work_id":"aa3e2ba7-4265-495b-8612-615b2ddc9991","year":2022},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:4f264dd836e3c59d62e670ae7cce349997bab1692e8076a5ce26d339552249df","observation_id":"eb7f7722-032f-4429-b102-1c5abbfa8ac8","resolution":{"observed_at":"2026-05-19T07:32:09.645806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"972098e9-586e-4c9d-8389-d27c2ba29c7b","year":2023},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:b94c10cc2d4e6df40f0f309ceeb6f3a0a90b642fca61dbfcb2c57e97b37ae5cd","observation_id":"84384865-87cd-4157-b8f8-d88727f32f33","resolution":{"observed_at":"2026-05-19T07:32:09.628999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:36:29.610478Z","title":"Bert: Pre-training of deep bidi- rectional transformers for language understanding","venue":null,"work_id":"1809bfb7-594d-445a-a5e7-fb928992f39d","year":2019},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:106bd46fd9567067949a65a37c3c2fa07044192c67711f851e90991deeb86ccb","observation_id":"4d175ee8-6e68-45ea-abe3-e546d2abd256","resolution":{"observed_at":"2026-05-19T07:32:09.632713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24024","last_updated":"2024-11-04T05:57:31Z","snapshot_observed_at":"2026-07-31T23:46:33.472074Z","submitted_at":"2024-10-31T15:25:20Z","title":"AndroidLab: Training and Systematic Benchmarking of Android Autonomous Agents","version":2},"cited_work":{"arxiv_id":"2410.24024","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.24024","snapshot_observed_at":"2026-06-30T11:04:37.706999Z","title":"Androidlab: Training and systematic benchmarking of android autonomous agents","venue":null,"work_id":"d4c7bd50-4424-4163-851b-adadf7473a45","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"cited_paper":"/paper/2410.24024","citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:b5c6bc60cb812568956349ed7cca90eb3b0a030cf09b8b85b7238456550e3a6d","observation_id":"4fbb17d6-a480-49be-9e68-1b415fd15f0d","resolution":{"observed_at":"2026-05-19T07:32:08.762377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing gemini 2.0: our new ai model for the agentic era, December 2024","venue":null,"work_id":"b0c4dc21-c981-429a-bceb-a31ea618dd30","year":2024},"citing_paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-19T07:31:33.690689Z"},"links":{"citing_paper":"/paper/2506.17697"},"observation_digest":"sha256:6d681db60446accbc5777146dc967ac2e15e1d393a4c69e44706d9cfe6b7b804","observation_id":"85fe4db0-2803-4220-b45d-76b0ef32474d","resolution":{"observed_at":"2026-05-19T07:32:09.626722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.17697","last_updated":"2026-04-06T20:47:33Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-21T12:08:19Z","title":"Beyond Syntax: Action Semantics Learning for App Agents"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":14,"verified_fuzzy":17},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2506.17697."}