{"as_of":"2026-08-08T00:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:373fae0feadee5b5191771ec712dc4a2a3ec2513463aef1b1104d1a9ee572440","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T19:16:37.302399Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T09:20:19.104036Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.04425","snapshot_observed_at":"2026-07-31T14:04:39.216655Z","title":"UI-MOPD : Multi-platform on-policy distillation for continual GUI agent learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28227","last_updated":"2026-07-30T13:58:41Z","snapshot_observed_at":"2026-08-04T06:59:54.896655Z","submitted_at":"2026-07-30T13:58:41Z","title":"Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-31T14:04:39.216655Z"},"links":{"cited_paper":"/paper/2607.04425","citing_paper":"/paper/2607.28227"},"observation_digest":"sha256:555e0543f828a23a402172d3c978ca3e5fabc6b9710f167e5964ca55f4d4a4ef","observation_id":"4a2cd700-446b-4d0c-9771-9a76942551eb","resolution":{"observed_at":"2026-07-31T14:04:39.216655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.04425","snapshot_observed_at":"2026-08-03T09:20:19.104036Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29320","last_updated":"2026-07-31T11:51:04Z","snapshot_observed_at":"2026-08-06T01:21:57.429804Z","submitted_at":"2026-07-31T11:51:04Z","title":"MAGA: Multi-Platform Self-Fusion of GUI Agents via Structured Action Distillation","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-03T09:20:19.104036Z"},"links":{"cited_paper":"/paper/2607.04425","citing_paper":"/paper/2607.29320"},"observation_digest":"sha256:d61907863c1d8b6910cf5cfc98d9e172cb70cfaf776daf6e8f1c5fcee49b9049","observation_id":"56214e94-25c1-4180-8070-851175630d4b","resolution":{"observed_at":"2026-08-03T09:20:19.104036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.04425/citation-record","integrity":"/paper/2607.04425/integrity","json":"/paper/2607.04425/citation-record.json","paper":"/paper/2607.04425"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Introducing claude opus 4.6","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:2043a5ea6fd4136360186b019d5365073c6491ae5641cbfb52d9e9f1c7d6b827","observation_id":"8161e85c-1527-4bf5-9592-ecdb220c3205","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:9e5875ead7f5bf5dcb99f14c7edba2e1fc9465a20830049865367a7a5cea887c","observation_id":"d62fe1b8-d2df-43d6-9c16-65295eb0383e","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08264","last_updated":"2024-09-13T20:17:13Z","snapshot_observed_at":"2026-08-05T14:11:56.506073Z","submitted_at":"2024-09-12T17:56:43Z","title":"Windows Agent Arena: Evaluating Multi-Modal OS Agents at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08264","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Windows agent arena: Evaluating multi-modal os agents at scale.arXiv preprint arXiv:2409.08264, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2409.08264","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:65891f28a43278bb9e43122e6aaed32754b498a61b231fdaf7f98a301558f16d","observation_id":"fbeb1a9b-6677-4b65-9965-dd75bed08d7b","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Seed2.0 model card: Towards intelligence frontier for real-world complexity.arXiv preprint arXiv:2603.11103, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:91a52fe63c0a12ce4a2ac211070537233875cd1b6a5ad87ba6ca339aab135fa2","observation_id":"d21a3e25-35ac-4e3e-93da-237130938ff5","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.31410","last_updated":"2026-07-01T03:59:21Z","snapshot_observed_at":"2026-07-07T00:05:07.912609Z","submitted_at":"2026-06-30T09:36:35Z","title":"Xiaomi-GUI-0 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.31410","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Xiaomi-gui-0 technical report, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2606.31410","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:11d3c0be6fa72787db35c09790ee1b82c28e653a1d03749d796aed85cd2c81e3","observation_id":"c7102f04-7de1-4df9-9231-0e8589c87870","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08455","last_updated":"2026-04-09T16:50:50Z","snapshot_observed_at":"2026-07-06T22:57:31.046146Z","submitted_at":"2026-04-09T16:50:50Z","title":"KnowU-Bench: Towards Interactive, Proactive, and Personalized Mobile Agent Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08455","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Knowu-bench: Towards interactive, proactive, and personalized mobile agent evaluation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2604.08455","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:621a3a2b00d7aebea18c9aab6bf4b9a1fc1b3a454432fb342e3d34465aa4a2ef","observation_id":"01cc85d9-8a50-40df-a209-25f77f0816ae","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15093","last_updated":"2026-04-16T14:53:08Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T14:53:08Z","title":"OpenMobile: Building Open Mobile Agents with Task and Trajectory Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.15093","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Openmobile: Building open mobile agents with task and trajectory synthesis.arXiv preprint arXiv:2604.15093, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2604.15093","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:72a91d6ac85d015a965532bdc71ad42e3698ca77b03d47590a5c56cf745aaa82","observation_id":"28c997f6-88d2-42ee-8ceb-c7c2cabccc10","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07397","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Audio-oscar: A multi-agent system for complex audio scene generation, orchestration, and refinement","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2606.07397","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:79fe163fd81451a1c2fa188979ae429372f42931b8836e4ebd9ea24eb6a88c10","observation_id":"958ab685-f1ac-4763-8078-a11d6c5bfaa5","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Gemini 3.1 pro model card","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:043ecbab18cd9a61ab473e1e4dd0bd10ff45c23741d27a58371ae4cd94f12f64","observation_id":"fad5d392-d3ef-4da6-b6da-9f7e2192cdbd","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07062","last_updated":"2025-05-11T17:28:30Z","snapshot_observed_at":"2026-08-02T16:13:31.498470Z","submitted_at":"2025-05-11T17:28:30Z","title":"Seed1.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07062","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Seed1.5-vl technical report.arXiv preprint arXiv:2505.07062, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2505.07062","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:692ee861b60bc50cd299c8705dc80b4c26428ac82989d5781158fe8781d7eef0","observation_id":"eb471240-ce53-48c8-8a72-c9aca56b42df","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03677","last_updated":"2026-07-06T06:34:16Z","snapshot_observed_at":"2026-08-03T02:52:57.588273Z","submitted_at":"2026-05-05T12:15:21Z","title":"Uni-OPD: Unifying On-Policy Distillation with a Dual-Perspective Recipe","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03677","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Uni-opd: Unifying on-policy distillation with a dual-perspective recipe.arXiv preprint arXiv:2605.03677, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2605.03677","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:1e900e11bd5b73a5b5143293decc911c6f1933a6e6f4ac4342dcde3e1816aeb9","observation_id":"7b7bb050-e1e9-4ea0-8aef-afe9dd742b0d","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Visualwebarena: Evaluating multimodal agents on realistic visual web tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:8181524168164d9261f32948997dbc515b65058ae4ecdabd281a811e623ac881","observation_id":"ab2a7b33-d13c-4bb7-b242-17ec6af0cd28","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Mobileworld: Benchmarking autonomous mobile agents in agent-user interactive and mcp-augmented environments.arXiv preprint arXiv:2512.19432, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:9ee4a9e470e9ea6f062071cf2a9f15785ad5b9373154b195137315499b6e2f06","observation_id":"b51f6ffc-e2f3-4979-9ae6-6d34c0d6b41f","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:c8c97526b50ec05eb5a89fb763d128f54a0814617977909e99909e53c85b9a09","observation_id":"7ac64117-ea55-4cc6-9811-3d20e71d757f","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Computerrl: Scaling end-to-end online reinforcement learning for computer use agents.arXiv preprint arXiv:2508.14040, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:44e2a8bdc2c7b1796ce75c23e3aec47244ac9e6210313571b6f68a2649ae176c","observation_id":"17c9b607-1a47-4c68-8e68-662cc4bb5810","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Screenspot-pro: Gui grounding for professional high-resolution computer use","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:ae3adeb54b9b7cc97181bc380e5546147e09905d9ce32d9aeb9afaaa266c16e0","observation_id":"50188716-f718-4acc-aaa6-6a9101dd0220","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"On the effects of data scale on ui control agents.Advances in Neural Information Processing Systems, 37: 92130–92154, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:3f81120480cf0f1aad2952a4aeca704aaec1585322618415827fea77c5c39093","observation_id":"9869d23c-bf29-49ac-9e73-252291a43cf3","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.01455","last_updated":"2026-04-21T05:06:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-02T05:12:45Z","title":"From Verbatim to Gist: Distilling Pyramidal Multimodal Memory via Semantic Information Bottleneck for Long-Horizon Video Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.01455","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"From verbatim to gist: Distilling pyramidal multimodal memory via semantic information bottleneck for long-horizon video agents.arXiv preprint arXiv:2603.01455, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2603.01455","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:9721fc7deae643eeb911b08f278c5e29a58b2fc2ef348eea34f03c2c1b17dee7","observation_id":"baf01ff1-873c-48ed-839b-1b9b7c85d152","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Ui-r1: Enhancing efficient action prediction of gui agents by reinforcement learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:f22abed982d9b94fc49a2c251b26b5d88b81fd175578efd400d3844c28fa632e","observation_id":"3f8044eb-8c2b-4618-860c-41afa8ba8c4e","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15155","last_updated":"2026-05-14T17:51:26Z","snapshot_observed_at":"2026-08-06T01:14:44.790846Z","submitted_at":"2026-05-14T17:51:26Z","title":"Self-Distilled Agentic Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15155","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Self-distilled agentic reinforcement learning.arXiv preprint arXiv:2605.15155, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2605.15155","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:14dd15f8a4b3aac5d1b9a9598d313e1675d678835d6b3eeef1071516bd0557c3","observation_id":"aef8a658-fd6e-49bc-a6b3-356dd1da25c8","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Computer-using agent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:c9ebce79d773e06ff385853c0798d1db2d34155c32cd8b368190d0113b00f4e6","observation_id":"43e6f612-65a8-4b64-bb92-5daedcbbc9e6","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Ui-tars: Pioneering automated gui interaction with native agents, 2025.URL https://arxiv","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:7e08efcb7abf30bc8874854f9399f032318b1c76289767b754e3d314db5625bf","observation_id":"6b3408f5-74dd-4e0a-8ba8-773366ab3e19","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Androidworld: A dynamic benchmarking environment for autonomous agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:02124c79a076a1cb82580cd8fb8980e6a545c2cc93f878ff1e59de62f55f2032","observation_id":"420b80a8-1bfe-4130-a07c-bc12570a67f9","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.19897","last_updated":"2026-01-27T18:59:08Z","snapshot_observed_at":"2026-07-06T22:43:12.468415Z","submitted_at":"2026-01-27T18:59:08Z","title":"Self-Distillation Enables Continual Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.19897","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Self-distillation enables continual learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2601.19897","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:56ef4e3a33753721edd1eda6bee7477e2c06d3a196a4710cbe8ce9a72a474ec2","observation_id":"dae7c779-a17c-4b27-bc63-85d3b2c619c4","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:61e00b973a7631a7883579d10363792addaf11007b33e78c0b9f3a60b0cb7347","observation_id":"8356ccac-91f4-4c3c-bb16-9f2fd1d517f5","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Megatron-lm: Training multi-billion parameter language models using model parallelism.arXiv preprint arXiv:1909.08053, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:9643fa4ad35456c4932054102a1b3adad23333a276d9d7dcf236c9649d80deba","observation_id":"c66a4991-0c9d-4fa5-8fc6-3494d37f4708","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Scaling laws for optimal data mixtures.Advances in Neural Information Processing Systems, 38:129554–129579, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:89e466ae30883240fb5f6ec38f5516b07217d327bb2caa131a918811bd793fcc","observation_id":"78ef349e-514a-4e67-9658-3710b5a250b7","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11784","last_updated":"2026-04-13T17:52:04Z","snapshot_observed_at":"2026-08-02T20:50:33.982200Z","submitted_at":"2026-04-13T17:52:04Z","title":"ClawGUI: A Unified Framework for Training, Evaluating, and Deploying GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11784","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Clawgui: A unified framework for training, evaluating, and deploying gui agents.arXiv preprint arXiv:2604.11784, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2604.11784","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:b63cd7cc087762c3c4db25c92d0f81f211f068c9cd68410952d325f5bc84af2a","observation_id":"2da4a4da-4a7c-4ce4-90a5-ac11cc56b030","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Kimi k2: Open agentic intelligence.arXiv preprint arXiv:2507.20534, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:717dc4c6ba0ec7fabac228df5757f9c6d49cf1938f19c51ff109050094ee5359","observation_id":"495bffc9-4bf9-4a20-a1ee-092e3bf742b6","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Ui-venus-1.5 technical report.arXiv preprint arXiv:2602.09082, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:cf7abc6d1a3d358f85441c611a7bc5bf0a5e27a8bdf844fe9999b953bf161556","observation_id":"9f3e1f25-cd14-463a-a0ea-714207e9d60b","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Consensus-driven multi-agent cognitive reasoning for enhancing the emotional intelligence of large language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:965efb609e1f373c5fede348bb4edb67de5c3c6a5a84241760a6e2e9076fd283","observation_id":"bdb7bd18-2f5e-433a-a0ab-c480c5ed2ef8","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-08-05T09:41:26.544360Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02544","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Ui-tars-2 technical report: Advancing gui agent with multi-turn reinforcement learning.arXiv preprint arXiv:2509.02544, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2509.02544","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:36ff5be5048f61d297467631484e186ffeb7da75f3e25bed35a7016d451ad5e8","observation_id":"3d42dae9-7f89-4a89-8db2-12c2e3b14198","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Opencua: Open foundations for computer-use agents.Advances in Neural Information Processing Systems, 38:139756–139806, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:9edf3c308f7a383273f55a5ecf8af3a19b924358d4d0d4a1baa9c6e0b7e3142e","observation_id":"839a3956-249e-4029-8b32-69b0475a801c","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.06078","last_updated":"2026-05-07T12:00:40Z","snapshot_observed_at":"2026-07-31T11:42:00.304740Z","submitted_at":"2026-05-07T12:00:40Z","title":"Milestone-Guided Policy Learning for Long-Horizon Language Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.06078","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Milestone-guided policy learning for long-horizon language agents.arXiv preprint arXiv:2605.06078, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2605.06078","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:56f30d94ceff0dc3aaa4b56150fb438a535003c1db5287829d8b67bf7da855a7","observation_id":"aca5a806-9a51-46fd-b9cc-7fe5b5a02594","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Model soups: averaging weights of multiple fine-tuned models improves accuracy without increasing inference time","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:81e053ee8171c084082e3e497c6e34d05234bf71647fee50297c017f44544695","observation_id":"5bbdc4ad-ad9a-45fb-8653-8ba75ac8113d","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Os-atlas: Foundation action model for generalist gui agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:fffab311468dd1763a483008f7d3eab6fecbe24cd75e561bd3e38d8c099a9be9","observation_id":"71d2110c-3fa3-4f32-866f-ae4de3def13a","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02780","last_updated":"2026-01-08T05:52:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-06T07:31:47Z","title":"MiMo-V2-Flash Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.02780","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Mimo-v2-flash technical report.arXiv preprint arXiv:2601.02780, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2601.02780","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:fac6ba9fb15816a661c72e0aaf99227301c7b7726d64acffcd64a166409fd2a8","observation_id":"de43ff55-1967-475c-b553-1b29d4c39c6b","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer environments.Advances in Neural Information Processing Systems, 37:52040–52094, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:ed1f7f810bd07d7e60ba75672f3424f4bb0f0b9df6af561eac6ce6478757cf56","observation_id":"86e06eef-20c4-47c0-b8d3-a8fb0ebb1d5c","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Scaling computer-use grounding via user interface decomposition and synthesis","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:a6325fa740fe14d2978aa67a1e5c37d885ed3e9092803075172aeda042aacda0","observation_id":"062f9356-b29c-4bb3-8998-39b858ef9f07","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Deepseek-v4: Towards highly efficient million-token context intelligence.arXiv preprint arXiv:2606.19348, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:6e0216191b7afdfd40815fd27f707ce5db4cae92e6bfd2d11c3277e9c7c7d101","observation_id":"4a54aafa-5ad6-4a7b-8b88-0793ef4c83dc","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Mobile-agent-v3","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:5cdf0d05268b23511a4de18fc4c7356927bdc2f333241e799bdfe4039c591898","observation_id":"49dae88b-7396-40b6-ade7-007e870f21b3","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Evocua: Evolving computer use agents via learning from scalable synthetic experience.arXiv preprint arXiv:2601.15876, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:601cf6bcb28ff872a301fed1729986dbfc8e49ca74d75ac5077279cd51b7cd3f","observation_id":"770eb853-1fa2-4fb8-92bf-dbdea335b8f5","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Ties-merging: Resolving interference when merging models.Advances in neural information processing systems, 36:7093–7115, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:9b679bcf25a0a77325d0799de33ee0ab64eba376b36594f664b2cb828c118cad","observation_id":"67cfe5ba-a0a1-4594-a63b-02e6f8c3e79c","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Step-gui technical report.arXiv preprint arXiv:2512.15431, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:0bfe0d7c93ec8640b190a4ce1b483c89f5f75b64200652c37afbc5d2db646564","observation_id":"5d72dd75-2191-4764-8f95-398c08c9060e","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"macosworld: A multilingual interactive benchmark for gui agents","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:d253790362cbfd563878c22382af14b9d9e90705b91a357e60c10aa5e20139e5","observation_id":"e3919420-d76a-4d7c-aedb-c87a1e8f1385","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12125","last_updated":"2026-02-26T13:26:22Z","snapshot_observed_at":"2026-07-31T18:08:52.441829Z","submitted_at":"2026-02-12T16:14:29Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12125","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Learning beyond teacher: Generalized on-policy distillation with reward extrapolation.arXiv preprint arXiv:2602.12125, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2602.12125","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:55ab8392f49c8eb970ef7537963936cd8b7cfbed69cfe8f01ce482685d191c07","observation_id":"63250040-fa70-48c4-a92a-9434f657eac2","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Nemotron-cascade 2: Post-training llms with cascade rl and multi-domain on-policy distillation.arXiv preprint arXiv:2603.19220, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:7b5fd247ad8a1364f415cd2e8b68a1ddf80988f163411aa48fab0dc43bef771d","observation_id":"4e9dcf68-63e4-4d72-90ae-4d960d6be6e2","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15144","last_updated":"2025-09-01T05:38:34Z","snapshot_observed_at":"2026-07-06T22:15:55.690108Z","submitted_at":"2025-08-21T00:39:12Z","title":"Mobile-Agent-v3: Fundamental Agents for GUI Automation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15144","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Mobile-agent-v3: Fundamental agents for gui automation, 2025.URL https://arxiv","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2508.15144","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:d45772acb95c8521b6416bedc65c7366d14e7b1db28829bf44ec5753626fc5d0","observation_id":"612f8354-fea9-48b4-80af-fa284954663f","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12275","last_updated":"2026-03-23T13:11:10Z","snapshot_observed_at":"2026-07-06T22:45:39.557598Z","submitted_at":"2026-02-12T18:58:28Z","title":"On-Policy Context Distillation for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12275","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"On-policy context distillation for language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2602.12275","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:a7ddbe2fb4ff33b0e6c6c8abeb84b00a22317a19daaf3e36f2242ea1f8e4dd6a","observation_id":"05a204fb-e7ea-40a7-8d71-d51effaa3e4d","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Glm-5: from vibe coding to agentic engineering.arXiv preprint arXiv:2602.15763, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:1b30012442ebd8104ba95d82814e9f41e4eade9406cc3e5dee9cdcd8921d0d93","observation_id":"3c634df0-d68a-4d94-b65c-4d9869bc24a9","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-08-07T20:24:25.671681Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Self-distilled reasoner: On-policy self-distillation for large language models.arXiv preprint arXiv:2601.18734, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:cc1fa8f29e4ce88aa5292b113796dd4f45b5e701b1535b055efa3843b402c773","observation_id":"8a9cc120-ac5c-4c25-8eef-e6204e4c2bf3","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Sglang: Efficient execution of structured language model programs.Advances in neural information processing systems, 37:62557–62583, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:2cf8f2f81900aeb0a3a0656d599479fc519f50931241fc973db88c016318ac18","observation_id":"f69572a5-1359-4b39-b224-72537d74d371","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"price.docx\\","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:83f6f44ff6d6a8675d925c21a607e0f31bea9f80260e402b305bc290de393773","observation_id":"a2cf2296-561d-4790-9a87-ac6718b6b447","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:f77db82587aba50b28f5924404a45bbd16539e99b4aa5a2bf9d2576a95cc74da","observation_id":"5ac95a3e-c6bb-4cd4-a559-79e2cbabfc01","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"name\": <function-name>,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:e42f57d2910c44ee8fc5f3dbb179b588a0af262a0e7e9773957b53ef0b824c8e","observation_id":"5f1ad482-5143-4371-b3ad-30ea0c0e8b14","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:45546db28558354b5e2ed9bdd03f129d8fbca3f3c8919098cf47a1dff5ecdea9","observation_id":"3ede704c-d5a3-4620-a172-8d18e5e248b1","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:8cd948c0d27564128052d81f609fa583acb7ec3e3aca26ca0890aab0b0e2f0b1","observation_id":"2fce0700-0ed2-4c70-95dd-5c24f5367c88","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"name\": <function-name>,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:70edcb08d59b5b9c28ed9fca4efc9c43e5a44647788d00c5a41f607e4802cbfe","observation_id":"96bfa400-1c10-4337-aec2-bd36bbf83500","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"- Follow the user instruction strictly, e.g., only return a single number, only return True or False, or only return items separated by comma","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:44713e36a19a7fb88fd801206b9431e7bf28354d290072df3fb09a5e2a74f3c7","observation_id":"1974f2ec-083d-444d-ab69-4f53ad2b1106","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"- If an action fails twice, try alternatives, e.g., long_press instead of click","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:cea138cbc0abbdd6882f3609c21f0a3ccf2e98e06ec7b470cb948a02107473d7","observation_id":"8f078a95-f8d6-46cc-8ba5-28aed14c7a9b","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"- For scrolling, scroll direction is inverse to swipe direction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:9ea8b41e99cc6970bd197bcb352c93adb601d4e1f0ca4d1fc2ee638006333ef3","observation_id":"de680007-44c7-413e-99fd-a53bca7fdbc3","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"- For text manipulation, long press to select, use selection bar options, and delete by selecting then cutting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:2c2231136d3feef06c4635bb3a7315f6d7852d74cd135e2fa4d902abc2f84257","observation_id":"69da12cb-17be-4cf1-9136-3d87138e2510","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"# Decision Process","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:256b569dbeb249fae386bc1a8992f5ae296c04c58cddad75ba79a13495b72cdc","observation_id":"7627ab6f-cd0d-4e3e-b7bd-61bcd5b494d2","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:c7e29eb9e28320a3497618a4a5430414f7214fbbe63a049eaa9bc68a2bca05d4","observation_id":"a7b62370-f99f-46c7-a96b-576b630a0c3c","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:2fff07c80df1abeb0c3d0660bf1f45e4a3ec53ea0a570f1df95fc2f46ea6307e","observation_id":"223410a4-d497-498c-a7f0-830ab9ba4f37","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:324b73dc9da395c6e620660071b8585d5813d48ecc85a04b3d21bb4260395231","observation_id":"6a1d48cf-078e-4e7e-8ca5-84a9b0b6dabf","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"The action must be a valid JSON string","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:1b115e4af34847691215dca41bbe713fc7d46c90ef94bf1b9b665ef967ffffc4","observation_id":"d1155179-dd92-4853-89a8-ff7b45f1da40","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"action_type","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:851bfd0bc68848676773b8d1e6449fc76854f69c6fa08af355a5a898840e29f8","observation_id":"ca26e53c-7927-49c7-bb5a-0d7af0bf718f","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 2 inbound Pith citation observations for arXiv:2607.04425."}