{"as_of":"2026-08-09T05:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:981e242f56762545bc6c1db7405ff1b413fd202612bd3cbb586478ee2384ebab","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:25:32.961759Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T22:10:13.680388Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T07:04:21.802447Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":"2507.19478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-06-30T07:04:21.802447Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents","venue":null,"work_id":"2c7aacbc-11c2-453e-9ce4-34c68821600e","year":2025},"citing_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"reference_index":146,"source":"pdf_text","source_observed_at":"2026-05-10T11:58:58.660564Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2508.18265"},"observation_digest":"sha256:3a987695eb0fa88695fdaa155b2fd064f68a94b9cc020969011d2ca43d0442e3","observation_id":"bb59a01b-7548-4a08-a39e-02a1d6acdc41","resolution":{"observed_at":"2026-05-10T11:58:58.864118Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":"2507.19478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-06-30T07:04:21.802447Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents","venue":null,"work_id":"2c7aacbc-11c2-453e-9ce4-34c68821600e","year":2025},"citing_paper":{"arxiv_id":"2509.07553","last_updated":"2026-04-03T02:36:28Z","snapshot_observed_at":"2026-07-06T22:26:22.911328Z","submitted_at":"2025-09-09T09:46:01Z","title":"VeriOS: Query-Driven Proactive Human-Agent-GUI Interaction for Trustworthy OS Agents","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-18T18:06:12.349285Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2509.07553"},"observation_digest":"sha256:e96fa19e95665c8d8cfdcadd22601ad3d1391c7f47c47a84b5fcec34291b2f7a","observation_id":"ef55e30c-bf22-4e05-be8f-e8b445cc223f","resolution":{"observed_at":"2026-05-18T18:06:42.607225Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-08-03T23:06:05.091486Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.07332","last_updated":"2026-06-09T21:30:32Z","snapshot_observed_at":"2026-08-07T05:40:52.575532Z","submitted_at":"2025-11-10T17:35:21Z","title":"Grounding Computer Use Agents on Human Demonstrations","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-03T23:06:05.091486Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2511.07332"},"observation_digest":"sha256:cc105cae222802a00f894db064c518e3b7f7d6b64bdf768cfdc43e2360f748cf","observation_id":"c0785da3-2323-4630-8062-c38256276b9d","resolution":{"observed_at":"2026-08-03T23:06:05.091486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-08-03T12:10:24.749980Z","title":"InProceed- ings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Pa- pers), pages 5555–5579","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.04126","last_updated":"2026-06-30T13:54:32Z","snapshot_observed_at":"2026-08-03T12:10:23.636506Z","submitted_at":"2026-01-07T17:40:08Z","title":"InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T12:10:24.749980Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2601.04126"},"observation_digest":"sha256:868cd78d204f1fb95e2f71f5fdfccaa48eef78448e0dfa16c58fcb46ad720041","observation_id":"b81f1466-b459-4f30-b29f-2cd0fc952c87","resolution":{"observed_at":"2026-08-03T12:10:24.749980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":"2507.19478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-06-30T07:04:21.802447Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents","venue":null,"work_id":"2c7aacbc-11c2-453e-9ce4-34c68821600e","year":2025},"citing_paper":{"arxiv_id":"2602.11724","last_updated":"2026-04-23T15:00:58Z","snapshot_observed_at":"2026-08-08T07:08:31.421339Z","submitted_at":"2026-02-12T08:51:07Z","title":"WebTestPilot: Agentic End-to-End Web Testing against Natural Language Specification by Inferring Oracles with Symbolized GUI Elements","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-16T06:02:14.073712Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2602.11724"},"observation_digest":"sha256:e2e8cccd9ab09acd16d4f005d341ca63eae75707bd760cd0026bcf6514ab804d","observation_id":"342c43f2-c4ca-4243-a528-6630052f0dd0","resolution":{"observed_at":"2026-05-16T06:02:24.917164Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":"2507.19478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-06-30T07:04:21.802447Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents","venue":null,"work_id":"2c7aacbc-11c2-453e-9ce4-34c68821600e","year":2025},"citing_paper":{"arxiv_id":"2604.21268","last_updated":"2026-04-23T04:23:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-23T04:23:31Z","title":"Measure Twice, Click Once: Co-evolving Proposer and Visual Critic via Reinforcement Learning for GUI Grounding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-09T23:05:05.251150Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2604.21268"},"observation_digest":"sha256:6054d8b78e4f0d47ca01c631e96c876cbd860d604e653ff0ec762c3728ccb344","observation_id":"f44c841e-20bb-46db-ad38-17d405b04571","resolution":{"observed_at":"2026-05-11T14:16:05.593705Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":"2507.19478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-06-30T07:04:21.802447Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents","venue":null,"work_id":"2c7aacbc-11c2-453e-9ce4-34c68821600e","year":2025},"citing_paper":{"arxiv_id":"2604.24348","last_updated":"2026-04-27T11:44:26Z","snapshot_observed_at":"2026-07-31T20:25:37.534799Z","submitted_at":"2026-04-27T11:44:26Z","title":"OS-SPEAR: A Toolkit for the Safety, Performance,Efficiency, and Robustness Analysis of OS Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T03:51:54.310805Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2604.24348"},"observation_digest":"sha256:e697ffd9816f29e9a79557ac838745e5b8047ed5e0f1b7cb53696ddfe4b6eb62","observation_id":"8241fc52-4b42-40fa-b1f6-21cf51b1c7eb","resolution":{"observed_at":"2026-05-11T21:56:11.981915Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":"2507.19478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-06-30T07:04:21.802447Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents","venue":null,"work_id":"2c7aacbc-11c2-453e-9ce4-34c68821600e","year":2025},"citing_paper":{"arxiv_id":"2605.00642","last_updated":"2026-05-10T03:40:15Z","snapshot_observed_at":"2026-08-09T01:59:27.097779Z","submitted_at":"2026-05-01T13:23:26Z","title":"Learn where to Click from Yourself: On-Policy Self-Distillation for GUI Grounding","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-09T19:36:42.309114Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2605.00642"},"observation_digest":"sha256:dcd248639fa41a2714ac5c96ad9fd126d8808b816436e9138b9faa0769812306","observation_id":"f2821c7c-78b8-495b-9412-3bd7cba012cd","resolution":{"observed_at":"2026-05-11T15:36:07.942074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":"2507.19478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-06-30T07:04:21.802447Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents","venue":null,"work_id":"2c7aacbc-11c2-453e-9ce4-34c68821600e","year":2025},"citing_paper":{"arxiv_id":"2605.00642","last_updated":"2026-05-10T03:40:15Z","snapshot_observed_at":"2026-08-09T01:59:27.097779Z","submitted_at":"2026-05-01T13:23:26Z","title":"Learn where to Click from Yourself: On-Policy Self-Distillation for GUI Grounding","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-12T02:01:51.292863Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2605.00642"},"observation_digest":"sha256:4742c56333409c6fa83c3f0a1f19bc8b777162379f3860e671b490d66739341a","observation_id":"05683cfe-3c97-4307-b5cc-058097b43242","resolution":{"observed_at":"2026-05-12T07:46:26.661819Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":"2507.19478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-06-30T07:04:21.802447Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents","venue":null,"work_id":"2c7aacbc-11c2-453e-9ce4-34c68821600e","year":2025},"citing_paper":{"arxiv_id":"2605.06761","last_updated":"2026-05-07T17:17:10Z","snapshot_observed_at":"2026-07-06T23:19:10.574595Z","submitted_at":"2026-05-07T17:17:10Z","title":"Weblica: Scalable and Reproducible Training Environments for Visual Web Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-11T01:25:44.578007Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2605.06761"},"observation_digest":"sha256:e8d4dc3efb31dba6e4ecf8f3a926db23516b9b86e760672108d9878a6cb9cac3","observation_id":"6c9a2e14-0300-4d57-95af-123aad36236b","resolution":{"observed_at":"2026-05-11T04:25:57.017303Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":"2507.19478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-06-30T07:04:21.802447Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents","venue":null,"work_id":"2c7aacbc-11c2-453e-9ce4-34c68821600e","year":2025},"citing_paper":{"arxiv_id":"2605.12549","last_updated":"2026-05-10T07:04:07Z","snapshot_observed_at":"2026-08-01T19:38:23.111665Z","submitted_at":"2026-05-10T07:04:07Z","title":"What Happens Before Decoding? Prefill Determines GUI Grounding in VLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T21:43:29.737867Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2605.12549"},"observation_digest":"sha256:aa50e6d98d85797a5ec53f4b936d2ae625f672065596a43ba0669deaab3f1d57","observation_id":"eb6e3f0b-8d57-4f90-a609-d478aff921e0","resolution":{"observed_at":"2026-05-14T21:48:01.070942Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":"2507.19478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-06-30T07:04:21.802447Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents","venue":null,"work_id":"2c7aacbc-11c2-453e-9ce4-34c68821600e","year":2025},"citing_paper":{"arxiv_id":"2605.19260","last_updated":"2026-05-19T02:13:29Z","snapshot_observed_at":"2026-07-06T23:30:02.207108Z","submitted_at":"2026-05-19T02:13:29Z","title":"AQuaUI: Visual Token Reduction for GUI Agents with Adaptive Quadtrees","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T06:20:33.874919Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2605.19260"},"observation_digest":"sha256:577375a336830e5f4e10f7191282cf33944cc0322695dc32622005f60b9823a1","observation_id":"e100977d-094b-47f2-bd8e-db3e64dbbfe5","resolution":{"observed_at":"2026-05-20T06:23:05.534472Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":"2507.19478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-06-30T07:04:21.802447Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents","venue":null,"work_id":"2c7aacbc-11c2-453e-9ce4-34c68821600e","year":2025},"citing_paper":{"arxiv_id":"2605.27761","last_updated":"2026-05-26T23:19:42Z","snapshot_observed_at":"2026-07-06T23:37:27.309837Z","submitted_at":"2026-05-26T23:19:42Z","title":"AndroidDaily: A Verifiable Benchmark for Mobile GUI Agents on Real-World Closed-Source Applications","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-29T17:52:03.395181Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2605.27761"},"observation_digest":"sha256:4926d826a53c8417db0a681c7ea208731a399ed4845468e6efef4e4f12b4e7fc","observation_id":"a1ad9e33-03c3-45fd-a773-7e2dc7b445d1","resolution":{"observed_at":"2026-06-29T17:53:46.942035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":"2507.19478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-06-30T07:04:21.802447Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents","venue":null,"work_id":"2c7aacbc-11c2-453e-9ce4-34c68821600e","year":2025},"citing_paper":{"arxiv_id":"2606.30084","last_updated":"2026-06-29T10:20:39Z","snapshot_observed_at":"2026-08-05T10:34:24.326234Z","submitted_at":"2026-06-29T10:20:39Z","title":"One Forward Beats Two: InnerZoom for Accurate and Efficient GUI Grounding","version":1},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-06-30T06:58:01.734975Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2606.30084"},"observation_digest":"sha256:9ece83a00cd23737122213b340112aa677dd414f6ec67e7e1a28ded27e0daa30","observation_id":"8b590869-ca96-4300-9e81-a470cc8c2223","resolution":{"observed_at":"2026-06-30T07:04:21.804145Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-08-02T01:50:33.149774Z","title":"Mmbench-gui: Hierarchical multi-platform evaluation framework for gui agents.arXiv preprint arXiv:2507.19478, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14548","last_updated":"2026-07-16T04:12:42Z","snapshot_observed_at":"2026-08-08T06:29:32.569249Z","submitted_at":"2026-07-16T04:12:42Z","title":"HyMobileAgent: Data-Environment Co-Scaling for Efficient GUI Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T01:50:33.149774Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2607.14548"},"observation_digest":"sha256:52aa9d32525a8c46be6878f0965026e44184de27ae80c1e392488b39220a4525","observation_id":"0d340c09-b362-4753-b5b8-5d48137c8195","resolution":{"observed_at":"2026-08-02T01:50:33.149774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-07-31T14:04:45.506969Z","title":"arXiv preprint arXiv:2507.19478 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28227","last_updated":"2026-07-30T13:58:41Z","snapshot_observed_at":"2026-08-08T13:39:17.708611Z","submitted_at":"2026-07-30T13:58:41Z","title":"Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-07-31T14:04:45.506969Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2607.28227"},"observation_digest":"sha256:e329dd22f6b77af1826dfaac5453674a6f5c2962da8255f9045035379679dd08","observation_id":"7af5dc2c-18be-44bf-b3f1-a310ed81d62b","resolution":{"observed_at":"2026-07-31T14:04:45.506969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.19478","snapshot_observed_at":"2026-08-05T22:10:13.680388Z","title":"Wu,Q.;Cheng,K.;Yang,R.;Zhang,C.;Yang,J.;Jiang,H.; Mu, J.; Peng, B.; Qiao, B.; Tan, R.; Qin, S.; Liden, L.; Lin, Q.; Zhang, H.; Zhang, T.; Zhang, J.; Zhang, D.; and Gao, J.2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03270","last_updated":"2026-08-04T07:47:37Z","snapshot_observed_at":"2026-08-07T23:10:49.821379Z","submitted_at":"2026-08-04T07:47:37Z","title":"GUI-Lens: Coarse-to-Fine Cropping for GUI Grounding with General-Purpose VLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T22:10:13.680388Z"},"links":{"cited_paper":"/paper/2507.19478","citing_paper":"/paper/2608.03270"},"observation_digest":"sha256:8053a2b59ba6a5540e7dfbef9de59cc92d7d46adb5aa1a5b23e33556dcf8a86c","observation_id":"153b09e9-2319-4db2-80ce-174f6a2bc99d","resolution":{"observed_at":"2026-08-05T22:10:13.680388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.19478/citation-record","integrity":"/paper/2507.19478/integrity","json":"/paper/2507.19478/citation-record.json","paper":"/paper/2507.19478"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.08264","last_updated":"2024-09-13T20:17:13Z","snapshot_observed_at":"2026-08-05T14:11:56.506073Z","submitted_at":"2024-09-12T17:56:43Z","title":"Windows Agent Arena: Evaluating Multi-Modal OS Agents at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08264","snapshot_observed_at":"2026-08-06T14:25:32.827918Z","title":"Windows agent arena: Evaluating multi-modal os agents at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.827918Z"},"links":{"cited_paper":"/paper/2409.08264","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:e503c3ee6edd9d1ab03b90891d00928cdb28609cc93c8609446fcab146feef10","observation_id":"419ca033-3e6d-4cb4-aa67-7929c2cb7219","resolution":{"observed_at":"2026-08-06T14:25:32.827918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11854","last_updated":"2024-02-25T16:21:00Z","snapshot_observed_at":"2026-07-06T15:29:50.743434Z","submitted_at":"2023-05-19T17:44:34Z","title":"Multimodal Web Navigation with Instruction-Finetuned Foundation Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11854","snapshot_observed_at":"2026-08-06T14:25:32.842742Z","title":"doi: 10.18653/v1/2024.acl-long.505","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.842742Z"},"links":{"cited_paper":"/paper/2305.11854","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:2a5358337ab2a416073e089afc691b332ba64b7eddcc1232349a5adca273757e","observation_id":"c6c3ca2d-669c-4c44-be52-66877fbf8a6b","resolution":{"observed_at":"2026-08-06T14:25:32.842742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13108","last_updated":"2024-01-01T14:26:39Z","snapshot_observed_at":"2026-07-06T17:06:00.378648Z","submitted_at":"2023-12-20T15:28:38Z","title":"ASSISTGUI: Task-Oriented Desktop Graphical User Interface Automation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13108","snapshot_observed_at":"2026-08-06T14:25:32.847804Z","title":"Assistgui: Task-oriented desktop graphical user interface automation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.847804Z"},"links":{"cited_paper":"/paper/2312.13108","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:c9f469afc069e83c81ce385860512178c81f734f42c11acdd9374e2e902a3e11","observation_id":"7bff1ff0-58b2-4f34-bc26-f66c16bdcce1","resolution":{"observed_at":"2026-08-06T14:25:32.847804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05243","last_updated":"2025-06-17T15:06:02Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:47:50Z","title":"Navigating the Digital World as Humans Do: Universal Visual Grounding for GUI Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05243","snapshot_observed_at":"2026-08-06T14:25:32.853541Z","title":"Navigating the digital world as humans do: Universal visual grounding for gui agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.853541Z"},"links":{"cited_paper":"/paper/2410.05243","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:6c5cf88b575c79c28aa076c8007cdc6ebc0c1e9c9014a582d85c17252f95874b","observation_id":"a4f0b9cb-e87f-4f60-9ecb-8ef523e78967","resolution":{"observed_at":"2026-08-06T14:25:32.853541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13919","last_updated":"2024-06-06T18:37:34Z","snapshot_observed_at":"2026-08-07T11:03:34.753698Z","submitted_at":"2024-01-25T03:33:18Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13919","snapshot_observed_at":"2026-08-06T14:25:32.858418Z","title":"Webvoyager: Building an end-to-end web agent with large multimodal models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.858418Z"},"links":{"cited_paper":"/paper/2401.13919","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:56529610762f0e024f7e00865a4d80065866c325ee9f94a3125c997ac824382e","observation_id":"7ef12b34-a66b-41b3-9e53-8edf2d6aecf6","resolution":{"observed_at":"2026-08-06T14:25:32.858418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.08199","last_updated":"2025-02-09T21:09:17Z","snapshot_observed_at":"2026-07-06T13:53:13.702355Z","submitted_at":"2022-09-16T23:49:00Z","title":"ScreenQA: Large-Scale Question-Answer Pairs over Mobile App Screenshots","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.08199","snapshot_observed_at":"2026-08-06T14:25:32.863192Z","title":"Screenqa: Large-scale question-answer pairs over mobile app screenshots","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.863192Z"},"links":{"cited_paper":"/paper/2209.08199","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:03034495a2147869676ae2ae07c803f4a7c13cc96a6d57273b363f7d2da83cd0","observation_id":"520fa9fb-0a2f-46ad-b41e-a37b52061f29","resolution":{"observed_at":"2026-08-06T14:25:32.863192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07981","last_updated":"2025-04-04T14:25:17Z","snapshot_observed_at":"2026-08-07T16:08:52.673312Z","submitted_at":"2025-04-04T14:25:17Z","title":"ScreenSpot-Pro: GUI Grounding for Professional High-Resolution Computer Use","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07981","snapshot_observed_at":"2026-08-06T14:25:32.872481Z","title":"Screenspot-pro: Gui grounding for professional high-resolution computer use","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.872481Z"},"links":{"cited_paper":"/paper/2504.07981","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:01a1f101ad6b68f1cc61177cb886dfbc6555d60272a54b51419bff36e2fe0c5b","observation_id":"8c71eb38-bff6-4de5-8f07-ec57704dd005","resolution":{"observed_at":"2026-08-06T14:25:32.872481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17465","last_updated":"2024-11-26T14:29:47Z","snapshot_observed_at":"2026-07-06T19:57:18.481261Z","submitted_at":"2024-11-26T14:29:47Z","title":"ShowUI: One Vision-Language-Action Model for GUI Visual Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17465","snapshot_observed_at":"2026-08-06T14:25:32.876994Z","title":"Tsung-Yi Lin, Michael Maire, Serge Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Dollár, and C Lawrence Zitnick","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.876994Z"},"links":{"cited_paper":"/paper/2411.17465","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:6065bb77c50f3569ab48af182bc5a8b62114be4d8f90bd30b860763b16c65c8a","observation_id":"1faa229f-368a-4280-a1e4-b9a998812fdc","resolution":{"observed_at":"2026-08-06T14:25:32.876994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08451","last_updated":"2025-08-01T03:37:57Z","snapshot_observed_at":"2026-08-03T18:32:07.479349Z","submitted_at":"2024-06-12T17:44:26Z","title":"GUIOdyssey: A Comprehensive Dataset for Cross-App GUI Navigation on Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08451","snapshot_observed_at":"2026-08-06T14:25:32.885740Z","title":"Mmbench: Is your multi-modal model an all-around player? In European conference on computer vision, pp","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.885740Z"},"links":{"cited_paper":"/paper/2406.08451","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:57bf7f5e6a963739df7760cc9878cfc08ac1f6b8b0c8954088237480b847fab8","observation_id":"4aa18170-3631-4c89-a57f-17fff81d8d03","resolution":{"observed_at":"2026-08-06T14:25:32.885740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10244","last_updated":"2022-03-19T05:00:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-19T05:00:30Z","title":"ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10244","snapshot_observed_at":"2026-08-06T14:25:32.890769Z","title":"Chartqa: A bench- mark for question answering about charts with visual and logical reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.890769Z"},"links":{"cited_paper":"/paper/2203.10244","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:e4e70bc985c984b19892e114797cea12ce51cbd9e7386961c313163520e50904","observation_id":"1dc2abd8-d83f-4c28-99e2-184b1d42ab69","resolution":{"observed_at":"2026-08-06T14:25:32.890769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15661","last_updated":"2025-05-06T17:43:11Z","snapshot_observed_at":"2026-08-07T16:50:46.247768Z","submitted_at":"2025-03-19T19:26:17Z","title":"UI-Vision: A Desktop-centric GUI Benchmark for Visual Perception and Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15661","snapshot_observed_at":"2026-08-06T14:25:32.896122Z","title":"Ui-vision: A desktop- centric gui benchmark for visual perception and interaction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.896122Z"},"links":{"cited_paper":"/paper/2503.15661","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:fad42216dd200ff1d44b85a01ac910a7b861b262b9d5c1fd3e425f9ebaca036f","observation_id":"be8cab84-b359-40bb-9640-7ced47b8d95a","resolution":{"observed_at":"2026-08-06T14:25:32.896122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-08-06T14:25:32.901235Z","title":"Ui-tars: Pioneering automated gui interaction with native agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.901235Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:a175f7bb5edae6e8822c2f480945f0a1db148f130008d50ccb2530b57728fabe","observation_id":"c5c26015-bc2c-4d5d-ba0d-d4ffde388ba7","resolution":{"observed_at":"2026-08-06T14:25:32.901235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14573","last_updated":"2025-04-06T20:37:50Z","snapshot_observed_at":"2026-08-07T08:11:20.950548Z","submitted_at":"2024-05-23T13:48:54Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14573","snapshot_observed_at":"2026-08-06T14:25:32.906279Z","title":"Androidworld: A dynamic benchmarking environment for autonomous agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.906279Z"},"links":{"cited_paper":"/paper/2405.14573","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:347bffdfa4f0ed9d903074884418ae37ae1fe4451b6944ed015dc4302d9f32b5","observation_id":"79e7ddc0-9c30-4df7-8d19-14de33e0d162","resolution":{"observed_at":"2026-08-06T14:25:32.906279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19723","last_updated":"2025-06-27T08:25:48Z","snapshot_observed_at":"2026-08-07T22:32:37.258577Z","submitted_at":"2024-12-27T16:21:58Z","title":"OS-Genesis: Automating GUI Agent Trajectory Construction via Reverse Task Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19723","snapshot_observed_at":"2026-08-06T14:25:32.910881Z","title":"Os-genesis: Automating gui agent trajectory construction via reverse task synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.910881Z"},"links":{"cited_paper":"/paper/2412.19723","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:d5956a7e40b37fc2a2779c1339e3571a0961285b078a3f4c0463b518ebc82acb","observation_id":"99fac140-38b0-4fc3-a360-189edc4a3749","resolution":{"observed_at":"2026-08-06T14:25:32.910881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19897","last_updated":"2026-04-20T16:29:04Z","snapshot_observed_at":"2026-07-06T21:30:37.657153Z","submitted_at":"2025-05-26T12:27:27Z","title":"ScienceBoard: Evaluating Multimodal Autonomous Agents in Realistic Scientific Workflows","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19897","snapshot_observed_at":"2026-08-06T14:25:32.915779Z","title":"Scienceboard: Evaluating multimodal autonomous agents in realistic scientific workflows","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.915779Z"},"links":{"cited_paper":"/paper/2505.19897","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:cd42ee2548973a3d01fc629785bee4140b0789431dcc92b7cff740e38f90b462","observation_id":"f22fef1a-5d29-46fb-b8d9-ec2924085f5d","resolution":{"observed_at":"2026-08-06T14:25:32.915779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07491","last_updated":"2025-06-23T13:45:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T06:48:26Z","title":"Kimi-VL Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07491","snapshot_observed_at":"2026-08-06T14:25:32.920533Z","title":"Kimi-vl technical report.arXiv preprint arXiv:2504.07491,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.920533Z"},"links":{"cited_paper":"/paper/2504.07491","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:1916cec354f93896cf4c147e5d4822b2be7280398a25e026263a0bdbf3d53374","observation_id":"893a0765-3bfa-4e8b-b81c-2950de264dac","resolution":{"observed_at":"2026-08-06T14:25:32.920533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T14:25:32.925425Z","title":"Peng Wang, Shuai Bai, Sinan Tan, Shijie Wang, Zhihao Fan, Jinze Bai, Keqin Chen, Xuejing Liu, Jialin Wang, Wenbin Ge, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.925425Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:fe621951bd26556338de36a7287a754cb30eecc8755af7716f6a69666c44f264","observation_id":"393ecb2a-3d34-41e6-a0ff-c7bdb1aa092a","resolution":{"observed_at":"2026-08-06T14:25:32.925425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03143","last_updated":"2025-06-03T17:59:08Z","snapshot_observed_at":"2026-08-07T22:35:47.263115Z","submitted_at":"2025-06-03T17:59:08Z","title":"GUI-Actor: Coordinate-Free Visual Grounding for GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03143","snapshot_observed_at":"2026-08-06T14:25:32.930636Z","title":"Gui-actor: Coordinate-free visual grounding for gui agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.930636Z"},"links":{"cited_paper":"/paper/2506.03143","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:96d8a4ff7dbac13810873910a37216dab4bf1756ed8f7e2ea9a5cda23fd298ec","observation_id":"91083ed1-3f55-4432-9cfc-2ee47f2afd48","resolution":{"observed_at":"2026-08-06T14:25:32.930636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07456","last_updated":"2024-02-15T09:30:48Z","snapshot_observed_at":"2026-08-08T22:28:54.714585Z","submitted_at":"2024-02-12T07:29:22Z","title":"OS-Copilot: Towards Generalist Computer Agents with Self-Improvement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07456","snapshot_observed_at":"2026-08-06T14:25:32.935306Z","title":"Os-copilot: Towards generalist computer agents with self-improvement","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.935306Z"},"links":{"cited_paper":"/paper/2402.07456","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:b02362e234b6bfb112f7cb478a41cc1891272d80acc82494f3143d9913b58ffa","observation_id":"b82da8f1-e3fa-4130-b4c9-4f867e439fa6","resolution":{"observed_at":"2026-08-06T14:25:32.935306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03569","last_updated":"2025-06-04T04:32:54Z","snapshot_observed_at":"2026-08-07T10:57:30.804332Z","submitted_at":"2025-06-04T04:32:54Z","title":"MiMo-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03569","snapshot_observed_at":"2026-08-06T14:25:32.939651Z","title":"Tianbao Xie, Danyang Zhang, Jixuan Chen, Xiaochuan Li, Siheng Zhao, Ruisheng Cao, Toh J Hua, Zhoujun Cheng, Dongchan Shin, Fangyu Lei, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.939651Z"},"links":{"cited_paper":"/paper/2506.03569","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:aca9242bf24e4994b77d2e78598a3ac70de98854a93acb802606e6b63c399b4d","observation_id":"cf116d3b-3523-42a2-b6d4-71f203e48e34","resolution":{"observed_at":"2026-08-06T14:25:32.939651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:25:32.944456Z","title":"Scaling computer-use grounding via user interface decomposition and synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.944456Z"},"links":{"citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:40a3d85940e2998a8c30a9661aebc050f2d47a8be6e3fd9f47593c79bcaa0e74","observation_id":"85419a01-3bc7-4ee2-ad1c-b7be68f8bd2a","resolution":{"observed_at":"2026-08-06T14:25:32.944456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24024","last_updated":"2024-11-04T05:57:31Z","snapshot_observed_at":"2026-08-09T03:47:02.202066Z","submitted_at":"2024-10-31T15:25:20Z","title":"AndroidLab: Training and Systematic Benchmarking of Android Autonomous Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24024","snapshot_observed_at":"2026-08-06T14:25:32.948730Z","title":"Androidlab: Training and systematic benchmarking of android autonomous agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.948730Z"},"links":{"cited_paper":"/paper/2410.24024","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:f1661ba72a5bf740fa84d1b0825472fe590c7f218e496eff5fba7c2c57d33855","observation_id":"073e4f19-7a05-4704-b9dd-06b706eacac5","resolution":{"observed_at":"2026-08-06T14:25:32.948730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10127","last_updated":"2025-04-15T17:13:46Z","snapshot_observed_at":"2026-08-07T16:05:56.294915Z","submitted_at":"2025-04-14T11:35:02Z","title":"Breaking the Data Barrier -- Building GUI Agents Through Task Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10127","snapshot_observed_at":"2026-08-06T14:25:32.953149Z","title":"Breaking the data barrier–building gui agents through task generalization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.953149Z"},"links":{"cited_paper":"/paper/2504.10127","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:5b2190455c1b43ae1e15a8be172117e97fa3b74cbb3455650c2071c8d0fbcb87","observation_id":"2c649eab-e4ba-4314-b7da-229227142272","resolution":{"observed_at":"2026-08-06T14:25:32.953149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-06T14:25:32.957430Z","title":"Shuyan Zhou, Frank F Xu, Hao Zhu, Xuhui Zhou, Robert Lo, Abishek Sridhar, Xianyi Cheng, Tianyue Ou, Yonatan Bisk, Daniel Fried, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.957430Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:d67aa4d28bc51bf34c53a0b65cc547dbfab39516477e3cb5a7616f938bfb5c1f","observation_id":"88559ae0-b5e3-47ed-891c-4afc77f23d61","resolution":{"observed_at":"2026-08-06T14:25:32.957430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-06T14:25:32.961759Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.961759Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:693b28f034c3888da7b096bd01fa96b51a63752dadb36e151cab3d890ddaf825","observation_id":"6dd127d9-bbd4-4d9b-a3f2-be684f7e1dd3","resolution":{"observed_at":"2026-08-06T14:25:32.961759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00820","last_updated":"2024-10-28T17:05:10Z","snapshot_observed_at":"2026-08-08T14:45:39.949674Z","submitted_at":"2024-10-28T17:05:10Z","title":"AutoGLM: Autonomous Foundation Agents for GUIs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00820","snapshot_observed_at":"2026-08-06T14:25:32.881409Z","title":"Autoglm: Autonomous foundation agents for guis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.881409Z"},"links":{"cited_paper":"/paper/2411.00820","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:dfe0d3f64278ae91f4953267b7207aea917b9e361d0c8eef6922a7e117671f49","observation_id":"76c44c37-408c-446a-beab-a7d5296f7d19","resolution":{"observed_at":"2026-08-06T14:25:32.881409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-06T14:25:32.837921Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.837921Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:2ee0194da099ce18da89d5764d488b8823294432d8254b3389ad165aa5e93b6f","observation_id":"da3458e7-e624-4105-be63-28f59200aca3","resolution":{"observed_at":"2026-08-06T14:25:32.837921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T14:25:32.867974Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.867974Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:a39cb3ad116a33641cae5ae81c999f5bd8d0077c067e1a4f0b59f6e635835980","observation_id":"ff510cd0-9d3e-485b-9988-fb948f99be44","resolution":{"observed_at":"2026-08-06T14:25:32.867974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T14:25:32.822935Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.822935Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:7bbcfad37d63dcd8d115b5f728d79d62f8c50c50244b6b6e5afe0251d99e83a8","observation_id":"aa36d262-e75c-4381-9556-9231b9a9a776","resolution":{"observed_at":"2026-08-06T14:25:32.822935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-06T14:25:32.832933Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.832933Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:4b8d472217cc92dfe6163b9d0eb50a6f23f25c0783d45af88b78ec9187cdb117","observation_id":"f5039d17-565b-4412-bb19-ed50f5980e3d","resolution":{"observed_at":"2026-08-06T14:25:32.832933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T14:25:32.817777Z","title":"com/news/claude-3-7-sonnet","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.817777Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:4978af26f11ddfae95657f263dd6baf6c0c755bf324a316e12f5febc21c8c8ac","observation_id":"f4bca1fe-7b3e-4544-b975-c1eff04500ac","resolution":{"observed_at":"2026-08-06T14:25:32.817777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 17 inbound Pith citation observations for arXiv:2507.19478."}