{"as_of":"2026-08-06T08:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e1020076cbc85175f15892c03dbadf32627005c91ef3e0b2c7710bc68ffe50fe","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T16:00:52.709643Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T14:04:46.670034Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.09773","snapshot_observed_at":"2026-07-31T14:04:46.670034Z","title":"arXiv preprint arXiv:2607.09773 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28227","last_updated":"2026-07-30T13:58:41Z","snapshot_observed_at":"2026-08-04T06:59:54.896655Z","submitted_at":"2026-07-30T13:58:41Z","title":"Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents","version":1},"reference_index":197,"source":"arxiv_source","source_observed_at":"2026-07-31T14:04:46.670034Z"},"links":{"cited_paper":"/paper/2607.09773","citing_paper":"/paper/2607.28227"},"observation_digest":"sha256:66d97faf3d74bafcdd1f191f43437fa4b326281f9c77b336b62066640e78e04b","observation_id":"27aad222-a72a-41cf-9a1b-e6a3de33970a","resolution":{"observed_at":"2026-07-31T14:04:46.670034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.09773/citation-record","integrity":"/paper/2607.09773/integrity","json":"/paper/2607.09773/citation-record.json","paper":"/paper/2607.09773"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:88a4c9ae32ccc40856943d16da239bfb5d08c67753bbe372a136f5be47a368c8","observation_id":"ed431483-db9b-4367-ac6f-d2adc7b33572","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Xinyuan Wang, Bowen Wang, Dunjie Lu, Junlin Yang, Tianbao Xie, Junli Wang, Jiaqi Deng, Xiaole Guo, Yiheng Xu, Chen Henry Wu, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:85433df0e3dca9a44a60a86bd9b1284b35379b1e33ea9db47814029387213b25","observation_id":"30da3f35-9b80-4151-a2d1-1b1e0cb8d40a","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Zhihong Shao, Peiyi Wang, Qihao Zhu, Runxin Xu, Junxiao Song, Xiao Bi, Haowei Zhang, Mingchuan Zhang, YK Li, Yang Wu, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:3cdbf77c990ad63fc0654194f4b6a361c33f75494eaf162df9b2f07eea905549","observation_id":"d5ee4706-7dc8-41a3-9389-79ce4b75d5cb","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:b7c04418b13155a49e2c959f90f1f5f8e6ae258c506f92613659f5be9a7a1ecf","observation_id":"ad25127f-d659-4ace-92ec-b86f0013b9be","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:df26f11279cc54cf945a1a3cd4e8ef54912468e298e71050233e30a4963e1d5c","observation_id":"ba6f4292-b5d8-476e-9aca-8823c6ea59a7","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Haolong Yan, Jia Wang, Xin Huang, Yeqing Shen, Ziyang Meng, Zhimin Fan, Kaijun Tan, Jin Gao, Lieyu Shi, Mi Yang, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:129530a22f9486e3c9efefd5e6ff7dee64ad63880133cb5fd866f2d5c952e925","observation_id":"7c85903f-3c22-46ad-8e7f-98ae6e507e37","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Qwen Team","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:8e229f51c34897e716e85cae40da422462176c72d857ed732e640ac8b0c718bd","observation_id":"26583e83-970d-4f7d-b981-62d9bd62333b","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Yujia Qin, Yining Ye, Junjie Fang, Haoming Wang, Shihao Liang, Shizuo Tian, Junda Zhang, Jiahao Li, Yunxin Li, Shi- jue Huang, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:65af67c8740b9cd0cd8f46b25a977e04a117a288531fe843c2c3fe6d293dacf8","observation_id":"23396511-308e-46b2-bc01-3b095fb38738","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15144","last_updated":"2025-09-01T05:38:34Z","snapshot_observed_at":"2026-07-06T22:15:55.690108Z","submitted_at":"2025-08-21T00:39:12Z","title":"Mobile-Agent-v3: Fundamental Agents for GUI Automation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15144","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Mobile-agent-v3: Foundamental agents for gui automation.arXiv preprint arXiv:2508.15144,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2508.15144","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:6577883ac74ea3cec309ccd1d059ad6d5dc581cf04dcd4208f30ce62155653a3","observation_id":"120c9b0d-907d-450a-88f3-61e14e84bc60","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.25624","last_updated":"2026-06-08T08:32:35Z","snapshot_observed_at":"2026-08-04T20:10:29.546282Z","submitted_at":"2026-05-25T09:28:03Z","title":"CUA-Gym: Scaling Verifiable Training Environments and Tasks for Computer-Use Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.25624","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Kimi Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2605.25624","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:155d0709b5d85b21468d91d619976bcf1e859f17d12cdadd717a66f5a21c156d","observation_id":"502f1b07-d573-4f22-acc8-33313231f7e7","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08264","last_updated":"2024-09-13T20:17:13Z","snapshot_observed_at":"2026-08-05T14:11:56.506073Z","submitted_at":"2024-09-12T17:56:43Z","title":"Windows Agent Arena: Evaluating Multi-Modal OS Agents at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08264","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2409.08264","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:031d7548ee032f0e61e2a1e7b2c2fc05d90b0845c81ea7356c9ffd5423079847","observation_id":"9692b6c4-f382-46db-a7cc-936503549022","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15760","last_updated":"2025-02-13T18:55:14Z","snapshot_observed_at":"2026-07-06T20:40:39.302105Z","submitted_at":"2025-02-13T18:55:14Z","title":"Digi-Q: Learning Q-Value Functions for Training Device-Control Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15760","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Digi-q: Learning q-value functions for training device-control agents.arXiv preprint arXiv:2502.15760, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2502.15760","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:625cfa0f57f75c78eb8f27623965846dbba78efe9c960910e0a8c2f202ac61d8","observation_id":"9c60e594-4b8e-47be-976d-e07e74f2696a","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Webarena: A realistic web environment for building autonomous agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:30868ce21c416ae48292910b4d2236dd733486d26a483faa55d0e3a549c206c0","observation_id":"4c40db38-e88f-4f15-944b-6de5e52afe14","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.05044","last_updated":"2026-04-14T08:14:14Z","snapshot_observed_at":"2026-08-03T03:21:53.279816Z","submitted_at":"2026-03-05T10:51:34Z","title":"WebFactory: Automated Compression of Foundational Language Intelligence into Grounded Web Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.05044","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Visualwebarena: Evaluating multimodal agents on realistic visual web tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2603.05044","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:628240a1c57195540e6b38d61e165adef0224fc507f8ae6296c65503f7c75b31","observation_id":"5680e1c6-393c-4d1b-a1c6-f7c00d71f8d6","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Webagent-r1: Training web agents via end-to-end multi-turn reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:478405119f112508b78f4b10a05949d2f53370012e9b84c63f2b6a449a7d42dd","observation_id":"84f9d961-b2f2-45cc-baff-2608e971f185","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Ui-s1: Advancing gui automation via semi-online reinforcement learning.arXiv preprint arXiv:2509.11543,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:9d27b6e346827b4545da85f91276956b340b7b0db9cbc8b1403a8d34b5164c4f","observation_id":"b006e2c5-2e0d-400e-a10f-3f7c569761ca","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Efficient multi-turn rl for gui agents via decoupled training and adaptive data curation.arXiv preprint arXiv:2509.23866,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:aba14f155e8ecd1e33848fab3f4c8b1b5bb8bbf2b406d0658cb5d861ff48e06d","observation_id":"8a8e46ba-7e5e-4102-972c-beca49e2ad4d","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-03T08:58:34.548329Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 1 inbound Pith citation observation for arXiv:2607.09773."}