{"as_of":"2026-08-22T16:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5a1d11a22b907aa1deeedd0ed9972f6221eb86fd3f9870683e29f5d67c23d0be","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:18:57.759016Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:18:11.054622Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T20:56:13.527455Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"cited_work":{"arxiv_id":"2508.20018","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.20018","snapshot_observed_at":"2026-07-01T20:56:13.527455Z","title":"arXiv preprint arXiv:2508.20018 , year =","venue":null,"work_id":"5334f363-0dfd-45a6-9cfe-56dfcd508018","year":null},"citing_paper":{"arxiv_id":"2606.01249","last_updated":"2026-06-17T04:44:10Z","snapshot_observed_at":"2026-08-12T03:28:30.781632Z","submitted_at":"2026-05-31T14:04:51Z","title":"Trust Region On-Policy Distillation","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-28T17:38:50.313305Z"},"links":{"cited_paper":"/paper/2508.20018","citing_paper":"/paper/2606.01249"},"observation_digest":"sha256:4143f7b5a135822cdc0adda5a2bd0736cba558188f3e86f5b5e229ab6f2536e3","observation_id":"9d05a0cc-0145-4168-b782-a48fe1b9e486","resolution":{"observed_at":"2026-07-01T20:56:13.528809Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20018","snapshot_observed_at":"2026-08-11T04:18:11.054622Z","title":"Ng, and Ping Luo","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07813","last_updated":"2026-08-07T23:23:00Z","snapshot_observed_at":"2026-08-21T11:38:18.475945Z","submitted_at":"2026-08-07T23:23:00Z","title":"When the Judge Should Not Decide: Evidence-Locked, Non-Compensatory Selection Bounds LLM-Judge Failure in Reasoning Pipelines","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-11T04:18:11.054622Z"},"links":{"cited_paper":"/paper/2508.20018","citing_paper":"/paper/2608.07813"},"observation_digest":"sha256:3018cd53079a41560b0f8ba1b38ecfd14a675beb58889dedb652be18e16028fe","observation_id":"d7be8218-0e2a-4828-bc27-b9e00949bb21","resolution":{"observed_at":"2026-08-11T04:18:11.054622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.20018/citation-record","integrity":"/paper/2508.20018/integrity","json":"/paper/2508.20018/citation-record.json","paper":"/paper/2508.20018"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.08679","last_updated":"2026-06-16T17:36:22Z","snapshot_observed_at":"2026-08-16T12:51:00.810519Z","submitted_at":"2025-03-11T17:56:30Z","title":"Chain-of-Thought Reasoning In The Wild Is Not Always Faithful","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08679","snapshot_observed_at":"2026-08-05T15:18:50.382652Z","title":"Chain-of-thought reasoning in the wild is not always faithful","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:50.382652Z"},"links":{"cited_paper":"/paper/2503.08679","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:dcd3d3e99ae67307185606366b517e059a1c431a3df899398b59f322ab99f46e","observation_id":"19a9428a-3b77-4944-a35d-8b37187c5f34","resolution":{"observed_at":"2026-08-05T15:18:50.382652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-21T16:02:41.546193Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T15:18:50.510010Z","title":"Qwen2.5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:50.510010Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:af53c177e2a569ad62fc80f200d72de48445d349649245b4508ce06fe33fe658","observation_id":"9247b188-b405-46f1-9e63-c098dcd87294","resolution":{"observed_at":"2026-08-05T15:18:50.510010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:50.622301Z","title":"Distributed optimization and statistical learning via the alternating direction method of multipliers","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:50.622301Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:5cbe7048159d06b0c1061a50a09625c12df4ffd04ae9b2fd4783c480b92edd31","observation_id":"7b7b667c-f0b0-4f93-8021-8422d711e038","resolution":{"observed_at":"2026-08-05T15:18:50.622301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:50.743598Z","title":"Multi-agent reinforcement learning: A review of challenges and applications","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:50.743598Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:34c7ae12c1be78b59eff9a7840d2c5d966677e2fe8e2ef8536ca9ddca170ef3e","observation_id":"51f022b9-3a0f-4636-a5d4-c2f0a9355429","resolution":{"observed_at":"2026-08-05T15:18:50.743598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17490","last_updated":"2025-05-29T02:43:50Z","snapshot_observed_at":"2026-08-18T09:21:02.901770Z","submitted_at":"2024-07-03T17:59:58Z","title":"AMEX: Android Multi-annotation Expo Dataset for Mobile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17490","snapshot_observed_at":"2026-08-05T15:18:50.874256Z","title":"Amex: Android multi-annotation expo dataset for mobile gui agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:50.874256Z"},"links":{"cited_paper":"/paper/2407.17490","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:6c42f2d9cc497d3f43a69f551d517bd067c1a121e3c8fc276e532e0caf74709f","observation_id":"e3fbfef5-8364-43bf-84be-fef9801b2dbc","resolution":{"observed_at":"2026-08-05T15:18:50.874256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-16T13:42:22.094291Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T15:18:50.998350Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:50.998350Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:656feb2b41ac3d3f3dacac5b35360eb1d7fada29329c5a25b3910a87d45f1339","observation_id":"7693ce73-db26-4be6-956f-e200c9cea4bc","resolution":{"observed_at":"2026-08-05T15:18:50.998350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:59.709197Z","title":"Multi-agent deep reinforcement learning for large-scale traffic signal control","venue":null,"work_id":"1b6a3860-3946-4808-bc96-f327672a0627","year":2019},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:51.107151Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:7c4791c5d29ef0cb94ef05fd017515692db237e1d3ca329ed2768dc745a7f6bc","observation_id":"4b37cf8a-1c2e-437e-95f0-0a5b2c3764b7","resolution":{"observed_at":"2026-08-05T15:18:59.714977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17161","last_updated":"2025-05-26T17:16:45Z","snapshot_observed_at":"2026-08-09T18:26:12.869738Z","submitted_at":"2025-01-28T18:59:44Z","title":"SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17161","snapshot_observed_at":"2026-08-05T15:18:51.219851Z","title":"Sft memorizes, rl generalizes: A comparative study of foundation model post-training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:51.219851Z"},"links":{"cited_paper":"/paper/2501.17161","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:ef7d8eede8139619b33a316e0a774ff3c65728ee7ba35a0aca753ade83769507","observation_id":"cee11735-16f4-47b2-8c2f-cc3bc3750374","resolution":{"observed_at":"2026-08-05T15:18:51.219851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-05T15:18:51.304192Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:51.304192Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:87e9c47e02b0efa0ed924973f0d7ebe4b10c0739d87a5131964c3551e23918f9","observation_id":"c1ab69ff-a89c-409e-af21-f5939873460b","resolution":{"observed_at":"2026-08-05T15:18:51.304192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-08-20T04:08:34.710482Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-05T15:18:51.436257Z","title":"Process reinforcement through implicit rewards","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:51.436257Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:fedf480564e32ae132d43dd1a8b94f8be3c32f18270598244a588ca1ed8afed5","observation_id":"31f0b094-f876-40d6-88b3-88b02d3ba3a4","resolution":{"observed_at":"2026-08-05T15:18:51.436257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-19T03:09:02.515007Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T15:18:51.513389Z","title":"Is independent learning all you need in the starcraft multi-agent challenge? arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:51.513389Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:f1880a28699de8de00abbfc37a02cb784896f17a400624a909e20fb5cd4e1d87","observation_id":"0bc4c11f-ff7c-463c-8aba-3745abd36ad5","resolution":{"observed_at":"2026-08-05T15:18:51.513389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:51.621480Z","title":"Improving factuality and reasoning in language models through multiagent debate","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:51.621480Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:8f56b9cf751474b6b613d84c87bd1a730de7523705f2d58558e7dd6d25255054","observation_id":"9c28e3fa-83d7-488c-847c-7abee908cccf","resolution":{"observed_at":"2026-08-05T15:18:51.621480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09572","last_updated":"2025-04-22T17:56:22Z","snapshot_observed_at":"2026-08-14T20:53:01.569151Z","submitted_at":"2025-03-12T17:40:52Z","title":"Plan-and-Act: Improving Planning of Agents for Long-Horizon Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09572","snapshot_observed_at":"2026-08-05T15:18:51.734773Z","title":"Plan-and-act: Improving planning of agents for long-horizon tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:51.734773Z"},"links":{"cited_paper":"/paper/2503.09572","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:fd3bc1c99fbb3b100037b39e90fbe3d9b532cb2f85165c786f481149cc7de2cc","observation_id":"e5a78a3a-f459-42be-9329-c28463a4b888","resolution":{"observed_at":"2026-08-05T15:18:51.734773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:59.670537Z","title":"On alternating direction methods of multipliers: a historical perspective","venue":null,"work_id":"4270a674-6a1a-4268-9df1-92a474f99049","year":2014},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:51.853425Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:601d7f3c28c4175b50e1ce005f3cfc0478995c3c8820f5a95b9cdb357d6e9603","observation_id":"dcd2a098-f0f9-4964-882c-fd237304bff4","resolution":{"observed_at":"2026-08-05T15:18:59.677196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13411","last_updated":"2023-05-24T02:22:40Z","snapshot_observed_at":"2026-08-16T15:30:55.934030Z","submitted_at":"2023-05-22T18:51:12Z","title":"Towards Efficient Multi-Agent Learning Systems","version":2},"cited_work":{"arxiv_id":"2305.13411","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.13411","snapshot_observed_at":"2026-08-05T15:18:59.140845Z","title":"Towards Efficient Multi-Agent Learning Systems","venue":"cs.MA","work_id":"2a1ae09a-a60b-4104-a1da-fa3dfcf645ed","year":2023},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:51.963528Z"},"links":{"cited_paper":"/paper/2305.13411","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:eb8acd1aeb9b42f0c3bdfe4eb2f3dc578c47f639f9774fd403e43ed6a7e3819f","observation_id":"0d5f1473-ec08-49cf-adb0-92ed47a6983b","resolution":{"observed_at":"2026-08-05T15:18:59.149753Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07062","last_updated":"2025-05-11T17:28:30Z","snapshot_observed_at":"2026-08-20T20:37:36.775968Z","submitted_at":"2025-05-11T17:28:30Z","title":"Seed1.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07062","snapshot_observed_at":"2026-08-05T15:18:52.028713Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:52.028713Z"},"links":{"cited_paper":"/paper/2505.07062","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:9953ab90e0ab183489941d30911d1ff1cd341ef83d479b4939047ac5be4e4ced","observation_id":"6a21393a-2d07-49a2-841b-36ec9af8bfe8","resolution":{"observed_at":"2026-08-05T15:18:52.028713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03578","last_updated":"2026-01-28T04:55:23Z","snapshot_observed_at":"2026-07-06T17:25:53.950578Z","submitted_at":"2024-02-05T23:06:42Z","title":"LLM Multi-Agent Systems: Challenges and Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03578","snapshot_observed_at":"2026-08-05T15:18:52.148823Z","title":"Llm multi-agent systems: Challenges and open problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:52.148823Z"},"links":{"cited_paper":"/paper/2402.03578","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:9e63741ab9ed0d7595b2265e1cd4cf518892e1eb305f81e7f1e64f8f6316d311","observation_id":"afb744fa-3099-443c-8f5c-25843fb7e772","resolution":{"observed_at":"2026-08-05T15:18:52.148823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-08-21T04:25:41.592030Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-05T15:18:52.263559Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:52.263559Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:70c160a09bf2831e0e0fe4f219bd89a8ba2b1237a2bad6db6a98d09898d5d90c","observation_id":"73c21b1c-42f9-43f4-9768-03b570521f72","resolution":{"observed_at":"2026-08-05T15:18:52.263559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11143","last_updated":"2025-10-09T12:22:46Z","snapshot_observed_at":"2026-08-21T13:23:40.871665Z","submitted_at":"2024-05-20T01:04:40Z","title":"OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11143","snapshot_observed_at":"2026-08-05T15:18:52.384772Z","title":"Openrlhf: An easy-to-use, scalable and high-performance rlhf framework","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:52.384772Z"},"links":{"cited_paper":"/paper/2405.11143","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:c14abd7f569969e25e60d5b84970bf99f37f5445a3bd9cea353376396213b452","observation_id":"3e0bcf3f-125c-4b0a-83a4-b367c3b90271","resolution":{"observed_at":"2026-08-05T15:18:52.384772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23885","last_updated":"2025-06-11T01:42:53Z","snapshot_observed_at":"2026-08-15T07:48:24.532787Z","submitted_at":"2025-05-29T17:51:58Z","title":"OWL: Optimized Workforce Learning for General Multi-Agent Assistance in Real-World Task Automation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23885","snapshot_observed_at":"2026-08-05T15:18:52.500880Z","title":"Owl: Optimized workforce learning for general multi-agent assistance in real-world task automation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:52.500880Z"},"links":{"cited_paper":"/paper/2505.23885","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:d024be24a5e59877baad4da88ce32db27da32b6ebd2e25262ce7e8e24b613e65","observation_id":"fd5fd225-1cce-4510-83b4-7298b75cac67","resolution":{"observed_at":"2026-08-05T15:18:52.500880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-05T15:18:52.630612Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:52.630612Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:82ca27e19de2d8a64531c1332ef135d9510129aac2d32a0ae62ddb61d2bb3b6b","observation_id":"479c9983-0611-44a2-a6f6-92044d09bca0","resolution":{"observed_at":"2026-08-05T15:18:52.630612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:59.642954Z","title":"Omniact: A dataset and benchmark for enabling multimodal generalist autonomous agents for desktop and web","venue":null,"work_id":"7eaa0689-827c-4068-8bdf-509f8d3d2aaf","year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:52.735866Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:c741653f047a403212b58017caef585ccc9cbd98d1b112de275ca622ff2d24e5","observation_id":"53723fdb-ad20-4a58-8efc-0330967c96f2","resolution":{"observed_at":"2026-08-05T15:18:59.653591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:52.862777Z","title":"Os-harm: A benchmark for measuring safety of computer use agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:52.862777Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:d6261edbe48008234a298d2153d75546e794db84191ec0e5eecfb16adc08417e","observation_id":"516ac072-e338-4278-8f3a-b64ce774873d","resolution":{"observed_at":"2026-08-05T15:18:52.862777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:52.977243Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:52.977243Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:50783a4675ce0411cac6aea239d011930e20f04bef548be93504c02910915b1d","observation_id":"ebb81904-c3bd-4d6b-a063-2e0271315e49","resolution":{"observed_at":"2026-08-05T15:18:52.977243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15259","last_updated":"2025-05-24T15:08:35Z","snapshot_observed_at":"2026-08-12T04:35:04.329051Z","submitted_at":"2025-05-21T08:36:18Z","title":"ReGUIDE: Data Efficient GUI Grounding via Spatial Reasoning and Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15259","snapshot_observed_at":"2026-08-05T15:18:53.098539Z","title":"Reguide: Data efficient gui grounding via spatial reasoning and search","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:53.098539Z"},"links":{"cited_paper":"/paper/2505.15259","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:75e52fe35e0f9deffc8355d88053d970dba13bf1b5b008f206672b1577fa507b","observation_id":"5005a91c-eea3-4a3f-8c6b-4264ded03b52","resolution":{"observed_at":"2026-08-05T15:18:53.098539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18915","last_updated":"2025-05-31T11:18:02Z","snapshot_observed_at":"2026-08-16T13:48:16.440401Z","submitted_at":"2024-05-29T09:17:46Z","title":"Towards Better Chain-of-Thought: A Reflection on Effectiveness and Faithfulness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18915","snapshot_observed_at":"2026-08-05T15:18:53.252747Z","title":"Towards better chain-of-thought: A reflection on effectiveness and faithfulness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:53.252747Z"},"links":{"cited_paper":"/paper/2405.18915","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:89dc81153a537102d10229afef84cbd0534ce5a0e6ba36f68e5b820b603abf2c","observation_id":"9dd64cb2-b43d-4f66-ab36-7672dd6ce78c","resolution":{"observed_at":"2026-08-05T15:18:53.252747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03679","last_updated":"2024-11-13T16:42:22Z","snapshot_observed_at":"2026-08-16T13:45:42.719434Z","submitted_at":"2024-06-06T01:49:29Z","title":"On the Effects of Data Scale on UI Control Agents","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03679","snapshot_observed_at":"2026-08-05T15:18:53.370344Z","title":"On the effects of data scale on computer control agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:53.370344Z"},"links":{"cited_paper":"/paper/2406.03679","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:e5b0bab5aac81f706a0cd1e522811794c17fb195b08fbda4ab647fd9b7d885ba","observation_id":"e8bc6389-2215-4eb6-b20b-a0c28e13307d","resolution":{"observed_at":"2026-08-05T15:18:53.370344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16129","last_updated":"2026-05-30T09:48:39Z","snapshot_observed_at":"2026-08-18T01:57:24.551549Z","submitted_at":"2025-04-21T07:03:54Z","title":"MARFT: Multi-Agent Reinforcement Fine-Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16129","snapshot_observed_at":"2026-08-05T15:18:53.497423Z","title":"Marft: Multi-agent reinforcement fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:53.497423Z"},"links":{"cited_paper":"/paper/2504.16129","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:13d9720c5085cf0283e3b22df8e337647d27903cd95748400b72ef60bb164021","observation_id":"7284a6bd-a9f8-495d-a1aa-f45307bd4211","resolution":{"observed_at":"2026-08-05T15:18:53.497423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14239","last_updated":"2025-04-19T09:25:55Z","snapshot_observed_at":"2026-08-17T01:19:33.866701Z","submitted_at":"2025-04-19T09:25:55Z","title":"InfiGUI-R1: Advancing Multimodal GUI Agents from Reactive Actors to Deliberative Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14239","snapshot_observed_at":"2026-08-05T15:18:53.536887Z","title":"Infigui-r1: Advancing multimodal gui agents from reactive actors to deliberative reasoners","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:53.536887Z"},"links":{"cited_paper":"/paper/2504.14239","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:6d5510aee18f28eba4f7979ed2d5c932851855a97d02e46f0c3679104c69ffc0","observation_id":"7b9a3d2f-7874-4a61-8926-71a1fd82fa76","resolution":{"observed_at":"2026-08-05T15:18:53.536887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08451","last_updated":"2025-08-01T03:37:57Z","snapshot_observed_at":"2026-08-16T13:43:38.458825Z","submitted_at":"2024-06-12T17:44:26Z","title":"GUIOdyssey: A Comprehensive Dataset for Cross-App GUI Navigation on Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08451","snapshot_observed_at":"2026-08-05T15:18:53.611757Z","title":"Gui odyssey: A comprehensive dataset for cross-app gui navigation on mobile devices","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:53.611757Z"},"links":{"cited_paper":"/paper/2406.08451","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:e8353b48d1d78f719511d31eae130c3bb05f47d32e55ec71e0ba441ccb5325c5","observation_id":"458cafae-0407-4869-9f4c-0e3ea612a27f","resolution":{"observed_at":"2026-08-05T15:18:53.611757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21620","last_updated":"2025-05-24T08:46:08Z","snapshot_observed_at":"2026-08-16T12:01:58.640468Z","submitted_at":"2025-03-27T15:39:30Z","title":"UI-R1: Enhancing Efficient Action Prediction of GUI Agents by Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21620","snapshot_observed_at":"2026-08-05T15:18:53.726458Z","title":"Ui-r1: Enhancing efficient action prediction of gui agents by reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:53.726458Z"},"links":{"cited_paper":"/paper/2503.21620","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:c38b922f16cfe1c7560829e5cf855d4c66a78fc7f899fc4d688ef80f0ef66394","observation_id":"4c2810cd-48c7-49a7-8fa4-e2f458c9bf5a","resolution":{"observed_at":"2026-08-05T15:18:53.726458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10458","last_updated":"2025-10-01T04:55:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:45:54Z","title":"GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10458","snapshot_observed_at":"2026-08-05T15:18:53.855437Z","title":"Gui-r1: A generalist r1-style vision-language action model for gui agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:53.855437Z"},"links":{"cited_paper":"/paper/2504.10458","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:47e60bc728949d1d5e22dab52a8d5a437cfe089a4d45e6543310ed6700e964c8","observation_id":"3a582d7b-166c-462e-a4f8-e4788bf0d221","resolution":{"observed_at":"2026-08-05T15:18:53.855437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-08-13T20:16:31.803514Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-05T15:18:53.972497Z","title":"Mm-eureka: Exploring the frontiers of multimodal reasoning with rule-based reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:53.972497Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:900341020ba5472adf40091fe0777f73c94c4cfa5ce2e1106677d029d4747ce7","observation_id":"49d3dfd9-8be8-4b2a-928c-4195f544d630","resolution":{"observed_at":"2026-08-05T15:18:53.972497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14141","last_updated":"2025-05-20T09:45:55Z","snapshot_observed_at":"2026-08-15T08:40:45.907734Z","submitted_at":"2025-05-20T09:45:55Z","title":"Building a Stable Planner: An Extended Finite State Machine Based Planning Module for Mobile GUI Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14141","snapshot_observed_at":"2026-08-05T15:18:54.078626Z","title":"Building a stable planner: An extended finite state machine based planning module for mobile gui agent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:54.078626Z"},"links":{"cited_paper":"/paper/2505.14141","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:b245a2bcf752e7644c43664d4f8d6e5e29eab1415594b5fdec65516fc27c101e","observation_id":"09649300-7f31-4425-9b3b-92956ccfcfbc","resolution":{"observed_at":"2026-08-05T15:18:54.078626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07945","last_updated":"2024-02-09T02:33:45Z","snapshot_observed_at":"2026-08-21T07:59:34.098972Z","submitted_at":"2024-02-09T02:33:45Z","title":"ScreenAgent: A Vision Language Model-driven Computer Control Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07945","snapshot_observed_at":"2026-08-05T15:18:54.236190Z","title":"Screenagent: A vision language model-driven computer control agent","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:54.236190Z"},"links":{"cited_paper":"/paper/2402.07945","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:1234d2afe0c583d89e6e7a83d44e679f16d71365e3657d70ef29355e635271f9","observation_id":"bdbf12c8-a705-442d-aefb-097151b4c606","resolution":{"observed_at":"2026-08-05T15:18:54.236190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:59.608946Z","title":"Introducing gpt-5","venue":null,"work_id":"cfd82f9c-0864-4e91-bedf-fb1daba04510","year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:54.371511Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:0f11f372ccb54a7567a918ee75229e45612a1645d4f94785ad6712a6a2188520","observation_id":"0d78ccc9-e24d-4360-8109-b5a779693a66","resolution":{"observed_at":"2026-08-05T15:18:59.614982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-08-16T21:34:35.147772Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-08-05T15:18:54.490511Z","title":"Ui-tars: Pioneering automated gui interaction with native agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:54.490511Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:562d080fd344c76c7ca32269de7b887f0315a147c6a53d689c30ad157b9d4f53","observation_id":"3b7fe2e0-b28c-4a28-af38-7d38bba51389","resolution":{"observed_at":"2026-08-05T15:18:54.490511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:54.649045Z","title":"Monotonic value function factorisation for deep multi-agent reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:54.649045Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:dad516b76a48d21bff6c2983d4ac19a4ede2bd24f011b95cdfa6176dfac6bb74","observation_id":"de128de1-a07d-49ec-a34e-c52f80ad201d","resolution":{"observed_at":"2026-08-05T15:18:54.649045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-05T15:18:54.784911Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:54.784911Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:32a8a94fea3e6129a21891c3cc65b63adf99a832bc985def4616ce4dc4cac0d0","observation_id":"7b1898c5-e4b7-4cb8-a89d-fab0c23d349a","resolution":{"observed_at":"2026-08-05T15:18:54.784911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10088","last_updated":"2023-10-27T14:24:31Z","snapshot_observed_at":"2026-08-19T12:35:25.416859Z","submitted_at":"2023-07-19T15:57:24Z","title":"Android in the Wild: A Large-Scale Dataset for Android Device Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10088","snapshot_observed_at":"2026-08-05T15:18:54.955390Z","title":"Android in the wild: A large-scale dataset for android device control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:54.955390Z"},"links":{"cited_paper":"/paper/2307.10088","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:67286efa6ab6306b8fd53af0ba802354ea0f36aeddb0e57d3f5591bfd21bf16e","observation_id":"e8eb95c4-8a04-4a12-9b7e-00b83ed2644f","resolution":{"observed_at":"2026-08-05T15:18:54.955390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:55.056102Z","title":"Trust region policy optimization","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:55.056102Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:1d09ab9d0734c8a92b42d1f37406045b072cd8d8fa3d6d420c0f2c2dac375516","observation_id":"ee5652ef-c26f-4dd3-aada-6a145d69455b","resolution":{"observed_at":"2026-08-05T15:18:55.056102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T15:18:55.169460Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:55.169460Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:0e0077a1a6df5ee327cb4eefdac1a1313e5d99200a163fa227917b98420504f0","observation_id":"05916953-5ccd-4cb2-90e9-7a4c871e725b","resolution":{"observed_at":"2026-08-05T15:18:55.169460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T15:18:55.330893Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:55.330893Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:58568363294a04efc89c748757eb61fa032ba9b80ac6f2fb951b2f44dd49d50c","observation_id":"3e2203b9-d430-43a6-96c6-5973b923525a","resolution":{"observed_at":"2026-08-05T15:18:55.330893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:55.493051Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:55.493051Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:7ee8a5d2a64495a1699976643b02f90fde88cae3d793d718bc44b6378c581f68","observation_id":"cafeca55-bc45-4a98-9a89-3e4a2671c7c3","resolution":{"observed_at":"2026-08-05T15:18:55.493051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:55.630193Z","title":"Towards trustworthy gui agents: A survey","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:55.630193Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:bf60c7c930f3cbddd85116ba91b81cb63a09b225e941ed8e3c5163ba558fe522","observation_id":"8a1a5993-fd84-49b9-85bc-de438734ccf1","resolution":{"observed_at":"2026-08-05T15:18:55.630193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14596","last_updated":"2025-02-10T14:09:46Z","snapshot_observed_at":"2026-08-16T13:07:58.372786Z","submitted_at":"2024-10-18T16:49:36Z","title":"Teaching Models to Balance Resisting and Accepting Persuasion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14596","snapshot_observed_at":"2026-08-05T15:18:55.797459Z","title":"Teaching models to balance resisting and accepting persuasion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:55.797459Z"},"links":{"cited_paper":"/paper/2410.14596","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:ae96cb645d5f5214e7c15bbeaf7620b5e5e7c1b75713c2454444811aa9375778","observation_id":"f4e37ba6-4650-44be-9ec0-6ace697b82f9","resolution":{"observed_at":"2026-08-05T15:18:55.797459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05707","last_updated":"2025-03-03T18:58:16Z","snapshot_observed_at":"2026-08-16T12:59:23.869246Z","submitted_at":"2025-01-10T04:35:46Z","title":"Multiagent Finetuning: Self Improvement with Diverse Reasoning Chains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05707","snapshot_observed_at":"2026-08-05T15:18:55.902002Z","title":"Multiagent finetuning: Self improvement with diverse reasoning chains","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:55.902002Z"},"links":{"cited_paper":"/paper/2501.05707","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:de2872e04be5c561386dda85df011ee9a269092974b90457e4ade9de32ebf43c","observation_id":"42ad7824-693b-46b6-be49-870abb151ffb","resolution":{"observed_at":"2026-08-05T15:18:55.902002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-08-14T20:53:35.783079Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-05T15:18:56.030027Z","title":"Value-decomposition networks for cooperative multi-agent learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:56.030027Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:063cc11e5680da3cad4007a4148bd5f91cc54bd5b072438e2e1346b53b1f3fc7","observation_id":"06b385d4-bb0a-4e4e-8317-be9f29a75b0d","resolution":{"observed_at":"2026-08-05T15:18:56.030027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15846","last_updated":"2025-07-28T16:54:13Z","snapshot_observed_at":"2026-08-12T12:54:07.864402Z","submitted_at":"2025-07-21T17:53:42Z","title":"GUI-G$^2$: Gaussian Reward Modeling for GUI Grounding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15846","snapshot_observed_at":"2026-08-05T15:18:56.155953Z","title":"Gui-g ^2 : Gaussian reward modeling for gui grounding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:56.155953Z"},"links":{"cited_paper":"/paper/2507.15846","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:98bb3f2d035b10ee22f17c17024d39f72312d3822e78865ccaa0272d247fad3a","observation_id":"efee8467-2e75-4412-b4ee-714b52fea9a2","resolution":{"observed_at":"2026-08-05T15:18:56.155953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06322","last_updated":"2025-01-10T19:56:50Z","snapshot_observed_at":"2026-08-21T16:35:49.553660Z","submitted_at":"2025-01-10T19:56:50Z","title":"Multi-Agent Collaboration Mechanisms: A Survey of LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06322","snapshot_observed_at":"2026-08-05T15:18:56.487424Z","title":"Multi-agent collaboration mechanisms: A survey of llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:56.487424Z"},"links":{"cited_paper":"/paper/2501.06322","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:a954dba34885c2f565cd2624b9fb48137731fed9d6cd6bab3f06d0f15c5aded6","observation_id":"3ea87f0f-c321-4b53-88f4-05c8e77552d2","resolution":{"observed_at":"2026-08-05T15:18:56.487424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:56.755000Z","title":"Language models don't always say what they think: Unfaithful explanations in chain-of-thought prompting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:56.755000Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:d3c329ee952775eddc4bc6bc77d714ceda3b60f61772e694f23be68ce2a77c71","observation_id":"15dfc07d-049f-45d0-b2ef-0db6b380bb91","resolution":{"observed_at":"2026-08-05T15:18:56.755000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04890","last_updated":"2025-02-13T10:09:37Z","snapshot_observed_at":"2026-08-18T09:21:41.196519Z","submitted_at":"2024-11-07T17:28:10Z","title":"GUI Agents with Foundation Models: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04890","snapshot_observed_at":"2026-08-05T15:18:56.900795Z","title":"Gui agents with foundation models: A comprehensive survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:56.900795Z"},"links":{"cited_paper":"/paper/2411.04890","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:d82fa4118b7c611f5db5302a9e66ea716ea3f8860108caaa0501a5505d955d3c","observation_id":"36e0ce03-7710-4111-bb7d-cc717cf9c8ed","resolution":{"observed_at":"2026-08-05T15:18:56.900795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10603","last_updated":"2022-03-20T17:24:47Z","snapshot_observed_at":"2026-08-16T17:13:11.186656Z","submitted_at":"2022-03-20T17:24:47Z","title":"Model-based Multi-agent Reinforcement Learning: Recent Progress and Prospects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10603","snapshot_observed_at":"2026-08-05T15:18:57.030594Z","title":"Model-based multi-agent reinforcement learning: Recent progress and prospects","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.030594Z"},"links":{"cited_paper":"/paper/2203.10603","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:cc508a0986c346bde2bb78b04f80ddaf37c2dfab7b27278adafac88d52a73c61","observation_id":"a5853eb5-71da-4db5-a308-a125ecdc7a41","resolution":{"observed_at":"2026-08-05T15:18:57.030594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06205","last_updated":"2023-02-26T17:13:07Z","snapshot_observed_at":"2026-08-16T15:55:49.388871Z","submitted_at":"2023-02-13T09:24:34Z","title":"Order Matters: Agent-by-agent Policy Optimization","version":2},"cited_work":{"arxiv_id":"2302.06205","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.06205","snapshot_observed_at":"2026-08-05T15:18:58.163791Z","title":"Order Matters: Agent-by-agent Policy Optimization","venue":"cs.AI","work_id":"d6130689-c197-4ed2-9137-b64ab5dd84c2","year":2023},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.147045Z"},"links":{"cited_paper":"/paper/2302.06205","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:722fd5a3f611050cba082d4821d3cd3360b6083d7fdffcb482ae90a0a0900968","observation_id":"c4aa2014-ce7f-4a6d-bfa6-8d1e0746810c","resolution":{"observed_at":"2026-08-05T15:18:58.169804Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:59.527931Z","title":"Mp-gui: Modality perception with mllms for gui understanding","venue":null,"work_id":"7ca0cc2e-3da2-4d52-8d82-9726d7edef4e","year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.243786Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:94b5c5af2f1f6856f3e48e75deb2c69af9189a72488f7ea593f6082941ab6ae0","observation_id":"4ac9fbff-9eb4-47ba-b500-9f9db7afe815","resolution":{"observed_at":"2026-08-05T15:18:59.533792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:57.352490Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.352490Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:e00f700068a113fa5ddc078001bee0d70c842244a2201699e46640fdd3b7dc68","observation_id":"9a0bd143-9fe1-4573-be92-c8a2cd182172","resolution":{"observed_at":"2026-08-05T15:18:57.352490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16636","last_updated":"2023-06-29T02:19:50Z","snapshot_observed_at":"2026-08-19T23:06:24.993115Z","submitted_at":"2023-06-29T02:19:50Z","title":"CMATH: Can Your Language Model Pass Chinese Elementary School Math Test?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.16636","snapshot_observed_at":"2026-08-05T15:18:57.423607Z","title":"Cmath: Can your language model pass chinese elementary school math test? arXiv preprint arXiv:2306.16636, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.423607Z"},"links":{"cited_paper":"/paper/2306.16636","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:584c49ed7f59dfc78916f1669e4d10f6b6d8b63ebcba7bf952f0a37cbc1723b4","observation_id":"c95e31b8-acbe-416a-93d9-b2944dca21e5","resolution":{"observed_at":"2026-08-05T15:18:57.423607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:57.545356Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.545356Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:b1072784d7dba3eb43daf43986d811969b50f9d869188500b5c3585fead288e8","observation_id":"bbbc11b9-4f2a-471b-9fcc-94d29a09fc57","resolution":{"observed_at":"2026-08-05T15:18:57.545356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23218","last_updated":"2024-10-30T17:10:19Z","snapshot_observed_at":"2026-08-19T18:35:24.681471Z","submitted_at":"2024-10-30T17:10:19Z","title":"OS-ATLAS: A Foundation Action Model for Generalist GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23218","snapshot_observed_at":"2026-08-05T15:18:57.651708Z","title":"Os-atlas: A foundation action model for generalist gui agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.651708Z"},"links":{"cited_paper":"/paper/2410.23218","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:111c2f1eef615fe4dc83c07ffe74af442741e3bc90776ce5030ec38e44525616","observation_id":"7648e41d-0bf0-4f75-911c-fcebbbcfce67","resolution":{"observed_at":"2026-08-05T15:18:57.651708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04682","last_updated":"2025-01-08T18:42:48Z","snapshot_observed_at":"2026-08-19T22:21:38.527415Z","submitted_at":"2025-01-08T18:42:48Z","title":"Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04682","snapshot_observed_at":"2026-08-05T15:18:57.675232Z","title":"Towards system 2 reasoning in llms: Learning how to think with meta chain-of-thought","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.675232Z"},"links":{"cited_paper":"/paper/2501.04682","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:4ba606a81481609ce5dba45456d898bc37135f18c95d64ab228ecc6fdda28d0c","observation_id":"12716f24-d199-44e6-a838-6115cd11bfe8","resolution":{"observed_at":"2026-08-05T15:18:57.675232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20138","last_updated":"2025-06-03T05:45:06Z","snapshot_observed_at":"2026-08-19T03:39:45.124567Z","submitted_at":"2024-12-28T12:54:06Z","title":"TradingAgents: Multi-Agents LLM Financial Trading Framework","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20138","snapshot_observed_at":"2026-08-05T15:18:57.680409Z","title":"Tradingagents: Multi-agents llm financial trading framework","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.680409Z"},"links":{"cited_paper":"/paper/2412.20138","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:46647a26739437d68ccb7b0e197c4893e032a8343b0a2ce150ad335398dbb0fe","observation_id":"8517c31a-4e46-4c87-a23f-9a9cacc65512","resolution":{"observed_at":"2026-08-05T15:18:57.680409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04454","last_updated":"2025-05-05T16:17:20Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:58:26Z","title":"Aguvis: Unified Pure Vision Agents for Autonomous GUI Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04454","snapshot_observed_at":"2026-08-05T15:18:57.686718Z","title":"Aguvis: Unified pure vision agents for autonomous gui interaction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.686718Z"},"links":{"cited_paper":"/paper/2412.04454","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:8977e06b5232fdf83ff00bd2b292bddc7362ae2aaf50971014ec15ef3ff7405e","observation_id":"3a10d33a-8219-4629-be6d-f6b3f46e4223","resolution":{"observed_at":"2026-08-05T15:18:57.686718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.03700","last_updated":"2022-08-23T11:19:06Z","snapshot_observed_at":"2026-08-20T09:25:24.787500Z","submitted_at":"2022-08-07T11:28:50Z","title":"A Survey of ADMM Variants for Distributed Optimization: Problems, Algorithms and Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.03700","snapshot_observed_at":"2026-08-05T15:18:57.691983Z","title":"A survey of admm variants for distributed optimization: Problems, algorithms and features","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.691983Z"},"links":{"cited_paper":"/paper/2208.03700","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:f7d34d9a8520c939e747aaa31f0ccce1c6f26886edbda7ccda9c3f61f383e11e","observation_id":"62017697-9004-444f-bc61-ed919caba547","resolution":{"observed_at":"2026-08-05T15:18:57.691983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12370","last_updated":"2025-05-24T03:01:02Z","snapshot_observed_at":"2026-08-17T13:59:43.463445Z","submitted_at":"2025-05-18T11:22:04Z","title":"Enhancing Visual Grounding for GUI Agents via Self-Evolutionary Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12370","snapshot_observed_at":"2026-08-05T15:18:57.697193Z","title":"Enhancing visual grounding for gui agents via self-evolutionary reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.697193Z"},"links":{"cited_paper":"/paper/2505.12370","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:befa06edd9dd752d1d6123d003c61adffebec7b0f477fbe21996e4ebbe56e9b5","observation_id":"acbf7106-55c1-414b-9fcf-700eac3af2cc","resolution":{"observed_at":"2026-08-05T15:18:57.697193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02713","last_updated":"2024-07-13T02:12:30Z","snapshot_observed_at":"2026-08-20T15:17:38.662850Z","submitted_at":"2024-03-05T07:09:35Z","title":"Android in the Zoo: Chain-of-Action-Thought for GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02713","snapshot_observed_at":"2026-08-05T15:18:57.701929Z","title":"Android in the zoo: Chain-of-action-thought for gui agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.701929Z"},"links":{"cited_paper":"/paper/2403.02713","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:a24698cd7998a34a91f8bf08390c2a152aac9424b214722abf3aeb32081fdbc7","observation_id":"1d4c849e-b94b-4919-854d-6ae0ccbc72bf","resolution":{"observed_at":"2026-08-05T15:18:57.701929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16788","last_updated":"2025-03-21T01:52:43Z","snapshot_observed_at":"2026-08-21T06:30:54.424736Z","submitted_at":"2025-03-21T01:52:43Z","title":"Does Chain-of-Thought Reasoning Help Mobile GUI Agent? An Empirical Study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16788","snapshot_observed_at":"2026-08-05T15:18:57.707774Z","title":"Does chain-of-thought reasoning help mobile gui agent? an empirical study","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.707774Z"},"links":{"cited_paper":"/paper/2503.16788","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:351bd011bafc53b6f39752588af0e3882bf5b9bbefe8f18252bcee1ed8f968c6","observation_id":"54090172-8602-4cd3-a23d-2e31ad3adf6e","resolution":{"observed_at":"2026-08-05T15:18:57.707774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11550","last_updated":"2024-03-13T07:16:42Z","snapshot_observed_at":"2026-08-20T11:30:07.772982Z","submitted_at":"2024-02-18T11:46:52Z","title":"LongAgent: Scaling Language Models to 128k Context through Multi-Agent Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11550","snapshot_observed_at":"2026-08-05T15:18:57.713495Z","title":"Longagent: scaling language models to 128k context through multi-agent collaboration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.713495Z"},"links":{"cited_paper":"/paper/2402.11550","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:00d461df992fd11e032f385bdb22645d68130c9bf2bffb02c51fbd92d5b5a2b2","observation_id":"68065708-a7ee-4821-a03d-6e3de2cb1aee","resolution":{"observed_at":"2026-08-05T15:18:57.713495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04780","last_updated":"2025-02-07T09:33:44Z","snapshot_observed_at":"2026-08-17T22:59:55.680923Z","submitted_at":"2025-02-07T09:33:44Z","title":"SiriuS: Self-improving Multi-agent Systems via Bootstrapped Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04780","snapshot_observed_at":"2026-08-05T15:18:57.718882Z","title":"Sirius: Self-improving multi-agent systems via bootstrapped reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.718882Z"},"links":{"cited_paper":"/paper/2502.04780","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:2854a4b68344742c67935bceddcb2c63c214707880d06c53f08ac710302be43a","observation_id":"c1f48cc3-e73f-4732-98c0-d28292401d05","resolution":{"observed_at":"2026-08-05T15:18:57.718882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15168","last_updated":"2024-10-19T17:42:49Z","snapshot_observed_at":"2026-08-20T12:09:29.603869Z","submitted_at":"2024-10-19T17:42:49Z","title":"An Electoral Approach to Diversify LLM-based Multi-Agent Collective Decision-Making","version":1},"cited_work":{"arxiv_id":"2410.15168","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15168","snapshot_observed_at":"2026-08-05T15:18:57.847381Z","title":"An Electoral Approach to Diversify LLM-based Multi-Agent Collective Decision-Making","venue":"cs.CL","work_id":"a8ab8901-5bd7-4443-8afa-0ff7c7c5a00a","year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.723824Z"},"links":{"cited_paper":"/paper/2410.15168","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:7d87825e44aead86a6d6e5f843c8cfd17b8089d55a7291b094ee159af0b9a01b","observation_id":"ae57306c-22d6-4f8f-adc4-9a549141dbf7","resolution":{"observed_at":"2026-08-05T15:18:57.856062Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:59.476285Z","title":"Heterogeneous-agent reinforcement learning","venue":null,"work_id":"8877e218-20fd-4b3e-b1aa-45977c153ffa","year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.728971Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:55bba6a0bb9c2fb402bcb1e7113ad3077099dcd3dd24fe4b93d8e4d2cf44306f","observation_id":"255449bd-01f8-40f9-952c-d365d48d31fc","resolution":{"observed_at":"2026-08-05T15:18:59.481072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15810","last_updated":"2025-05-22T11:15:23Z","snapshot_observed_at":"2026-08-21T23:32:11.537033Z","submitted_at":"2025-05-21T17:59:09Z","title":"GUI-G1: Understanding R1-Zero-Like Training for Visual Grounding in GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15810","snapshot_observed_at":"2026-08-05T15:18:57.734021Z","title":"Gui-g1: Understanding r1-zero-like training for visual grounding in gui agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.734021Z"},"links":{"cited_paper":"/paper/2505.15810","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:db29155f91d45ad7d6d39408530eaa311711dc24e9169b6ea649fa34b26a9694","observation_id":"94bccebf-59c1-42b4-8859-a20ac12ff831","resolution":{"observed_at":"2026-08-05T15:18:57.734021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-17T09:56:52.502317Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-05T15:18:57.739096Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.739096Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:64392526b870b8c7f57c64a1d40b7011f3d79ce3bc36e84480efaf791133547b","observation_id":"58f85316-a1b2-4b03-8e32-8a89c58b8ed1","resolution":{"observed_at":"2026-08-05T15:18:57.739096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:57.745032Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.745032Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:44fc5397f44a9b5c8d22c3d7318155270cfd0dae4321e255b38a6bca5678d414","observation_id":"15fab545-d472-4144-b1a3-d03e31c4904f","resolution":{"observed_at":"2026-08-05T15:18:57.745032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:57.753369Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.753369Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:8c4b5f2036e55148899a2b5c5c53735b81a4e1183b36f307a446855fbb19358b","observation_id":"965654c6-fcef-47ac-a38e-df6f1c5d873b","resolution":{"observed_at":"2026-08-05T15:18:57.753369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:18:57.759016Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:57.759016Z"},"links":{"citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:6eb1ea9199559bb121c11754d5e5cedceb0cfbe416d519c99a6afa4b72ce1ea7","observation_id":"c4935e77-8b93-42f9-9a55-92011d974d5f","resolution":{"observed_at":"2026-08-05T15:18:57.759016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-15T13:03:03.060918Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":66,"verified_exact":3,"verified_fuzzy":6},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 2 inbound Pith citation observations for arXiv:2508.20018."}