{"as_of":"2026-08-07T07:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:19c83dd5d59e87eb9a0d8a4ce810a1ec00dae4412eedc762935624ecf6e23c36","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:17:59.198656Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T14:24:48.938948Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T14:27:24.243476Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"cited_work":{"arxiv_id":"2509.04243","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04243","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning active perception via self- evolving preference optimization for gui grounding","venue":null,"work_id":"3723c0cb-7d97-4b5f-9e16-842e936ab2b7","year":2025},"citing_paper":{"arxiv_id":"2605.15542","last_updated":"2026-05-15T02:27:41Z","snapshot_observed_at":"2026-08-01T22:59:27.797060Z","submitted_at":"2026-05-15T02:27:41Z","title":"DRS-GUI: Dynamic Region Search for Training-Free GUI Grounding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T14:24:48.938948Z"},"links":{"cited_paper":"/paper/2509.04243","citing_paper":"/paper/2605.15542"},"observation_digest":"sha256:911a30f40c28908f031a55e5af0a3e3bc4ffae643fab02eaa8190ae3fb73b343","observation_id":"f7e38fa0-b9c5-45cd-99db-71c21005896a","resolution":{"observed_at":"2026-05-19T14:27:24.245090Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.04243/citation-record","integrity":"/paper/2509.04243/integrity","json":"/paper/2509.04243/citation-record.json","paper":"/paper/2509.04243"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:17:59.042313Z","title":"arXiv preprint arXiv:2505.20272","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.042313Z"},"links":{"citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:b88213362e02b138976c3a05dc7fc7ceb2dcf35527ab7070aa0f595ef0184450","observation_id":"a50b85eb-42ff-4fb8-b63d-7de7fd27ae09","resolution":{"observed_at":"2026-08-05T10:17:59.042313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-05T10:17:59.048480Z","title":"arXiv preprint arXiv:2503.09567","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.048480Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:c46689f834f95431c31226ffb755eb414d094046ff7200498bbd24150f51711d","observation_id":"6e027198-d1b9-4fef-88d9-d6adf7da15b3","resolution":{"observed_at":"2026-08-05T10:17:59.048480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10935","last_updated":"2024-02-23T04:36:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-17T08:10:35Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10935","snapshot_observed_at":"2026-08-05T10:17:59.059404Z","title":"arXiv preprint arXiv:2401.10935","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.059404Z"},"links":{"cited_paper":"/paper/2401.10935","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:f4830706a5812f767461a7e54f0d31a5051fbda569511154eee5dac764607b2a","observation_id":"ec0add16-468f-477e-835c-69dd9f66da52","resolution":{"observed_at":"2026-08-05T10:17:59.059404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05243","last_updated":"2025-06-17T15:06:02Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:47:50Z","title":"Navigating the Digital World as Humans Do: Universal Visual Grounding for GUI Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05243","snapshot_observed_at":"2026-08-05T10:17:59.066630Z","title":"Hong, W.; Wang, W.; Lv, Q.; Xu, J.; Yu, W.; Ji, J.; Wang, Y .; Wang, Z.; Dong, Y .; Ding, M.; et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.066630Z"},"links":{"cited_paper":"/paper/2410.05243","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:b1356de6993552a4aaf14989c123a073c6cafd73835ed3bb655b17cbb2d2036b","observation_id":"4bd59021-7d4f-4189-a3ea-4b2b0e1c6928","resolution":{"observed_at":"2026-08-05T10:17:59.066630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02716","last_updated":"2024-02-05T04:25:24Z","snapshot_observed_at":"2026-07-06T17:25:14.115360Z","submitted_at":"2024-02-05T04:25:24Z","title":"Understanding the planning of LLM agents: A survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02716","snapshot_observed_at":"2026-08-05T10:17:59.073173Z","title":"arXiv preprint arXiv:2402.02716","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.073173Z"},"links":{"cited_paper":"/paper/2402.02716","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:e1ce632a9147cf88d9c423304493b2200b62c71e71689d79c019b68e4df142bb","observation_id":"72b709d3-f758-4b82-ba34-795e4ea39d38","resolution":{"observed_at":"2026-08-05T10:17:59.073173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T10:17:59.084357Z","title":"arXiv preprint arXiv:2410.21276","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.084357Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:3fd144280a084d334f728cd4630f24ac2ec791d0169acfd1ce03a718c5c76a0a","observation_id":"95307b67-6919-4634-96ff-13a2d2c1422e","resolution":{"observed_at":"2026-08-05T10:17:59.084357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07981","last_updated":"2025-04-04T14:25:17Z","snapshot_observed_at":"2026-07-06T21:07:29.062389Z","submitted_at":"2025-04-04T14:25:17Z","title":"ScreenSpot-Pro: GUI Grounding for Professional High-Resolution Computer Use","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07981","snapshot_observed_at":"2026-08-05T10:17:59.093353Z","title":"arXiv preprint arXiv:2504.07981","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.093353Z"},"links":{"cited_paper":"/paper/2504.07981","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:467bc0899790ac20304c19bbced577094c1cfe9991cb38713495ea961138e4ec","observation_id":"a2ea24a2-94db-4886-96be-fa7c27bb4302","resolution":{"observed_at":"2026-08-05T10:17:59.093353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21620","last_updated":"2025-05-24T08:46:08Z","snapshot_observed_at":"2026-08-01T20:06:59.931737Z","submitted_at":"2025-03-27T15:39:30Z","title":"UI-R1: Enhancing Efficient Action Prediction of GUI Agents by Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21620","snapshot_observed_at":"2026-08-05T10:17:59.101162Z","title":"arXiv preprint arXiv:2503.21620","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.101162Z"},"links":{"cited_paper":"/paper/2503.21620","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:f04db68a98d1d46ff2762f0189faa702a05bbe36f096332f2e411a725c1a9182","observation_id":"07dac15a-233d-4014-b99e-d37547d24629","resolution":{"observed_at":"2026-08-05T10:17:59.101162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10458","last_updated":"2025-10-01T04:55:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:45:54Z","title":"GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10458","snapshot_observed_at":"2026-08-05T10:17:59.107172Z","title":"arXiv preprint arXiv:2504.10458","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.107172Z"},"links":{"cited_paper":"/paper/2504.10458","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:e552a3b63bfe77bdf3b92362b8a1444a51b3576c1e01a08a9e6b74cdb1e4667a","observation_id":"55c9e07d-5d37-4f98-b557-cd7e69f5f738","resolution":{"observed_at":"2026-08-05T10:17:59.107172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:18:00.272796Z","title":"https: //openai.com/index/o3-o4-mini-system-card/","venue":null,"work_id":"df5a243f-7dd6-4886-94c1-48dd1c36e692","year":2025},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.113099Z"},"links":{"citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:fd0978aaca6172bca40b20e419e30f4ce352c34293938dd1549fcac85e1a5187","observation_id":"36c9096e-0085-428f-b270-6ec2c5373643","resolution":{"observed_at":"2026-08-05T10:18:00.281563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-08-05T10:17:59.119944Z","title":"arXiv preprint arXiv:2501.12326","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.119944Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:b1fd263cd3d69b3b730f1dddbda963ad0bfd4e19b94f6f52569b67cfab3778bd","observation_id":"1deaa277-9d02-46b8-9e0b-489853b93817","resolution":{"observed_at":"2026-08-05T10:17:59.119944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07491","last_updated":"2025-06-23T13:45:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T06:48:26Z","title":"Kimi-VL Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07491","snapshot_observed_at":"2026-08-05T10:17:59.126766Z","title":"arXiv preprint arXiv:2504.07491","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.126766Z"},"links":{"cited_paper":"/paper/2504.07491","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:2d66065e804ed9532d9367b118a23cd164ab50bacd931286ebb9a4ba71d4a99d","observation_id":"5191626a-7adf-41c9-bc82-0d25b332f5d3","resolution":{"observed_at":"2026-08-05T10:17:59.126766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23218","last_updated":"2024-10-30T17:10:19Z","snapshot_observed_at":"2026-08-05T06:30:40.974506Z","submitted_at":"2024-10-30T17:10:19Z","title":"OS-ATLAS: A Foundation Action Model for Generalist GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23218","snapshot_observed_at":"2026-08-05T10:17:59.141447Z","title":"arXiv preprint arXiv:2410.23218","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.141447Z"},"links":{"cited_paper":"/paper/2410.23218","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:56b708751aa0c9285b4203019a7b392716dac679d371ae444f5f49b81307ed7c","observation_id":"832c4ab2-5750-4a4a-8deb-a2f2e34a6f25","resolution":{"observed_at":"2026-08-05T10:17:59.141447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:17:59.146788Z","title":"arXiv preprint arXiv:2505.13227","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.146788Z"},"links":{"citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:88662412ad69d8a0035ad3a2d12baa85387190f0366cb3d7099eda0e7f6404aa","observation_id":"d2bacd15-d514-4503-ad5b-72b764f494c6","resolution":{"observed_at":"2026-08-05T10:17:59.146788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04454","last_updated":"2025-05-05T16:17:20Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:58:26Z","title":"Aguvis: Unified Pure Vision Agents for Autonomous GUI Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04454","snapshot_observed_at":"2026-08-05T10:17:59.153421Z","title":"arXiv preprint arXiv:2412.04454","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.153421Z"},"links":{"cited_paper":"/paper/2412.04454","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:eee3ac0ecb3f58564e68c91156d105c7f1ab930d02119837a3e997830301129a","observation_id":"05b268ee-9e9a-4069-85da-ba16ba02202b","resolution":{"observed_at":"2026-08-05T10:17:59.153421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05791","last_updated":"2025-10-03T23:50:19Z","snapshot_observed_at":"2026-07-30T10:31:35.758747Z","submitted_at":"2025-07-08T08:52:18Z","title":"GTA1: GUI Test-time Scaling Agent","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05791","snapshot_observed_at":"2026-08-05T10:17:59.159913Z","title":"arXiv preprint arXiv:2507.05791","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.159913Z"},"links":{"cited_paper":"/paper/2507.05791","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:af45a644ff3f1b39903ed90defb9b68b4c9d6987b120163c2f57b10bc24fd2b3","observation_id":"4ad3a2cb-568a-4a04-93ae-b56b78fbf339","resolution":{"observed_at":"2026-08-05T10:17:59.159913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16256","last_updated":"2025-07-08T08:49:17Z","snapshot_observed_at":"2026-07-06T20:11:11.053567Z","submitted_at":"2024-12-20T07:16:57Z","title":"Aria-UI: Visual Grounding for GUI Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16256","snapshot_observed_at":"2026-08-05T10:17:59.166418Z","title":"arXiv preprint arXiv:2412.16256","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.166418Z"},"links":{"cited_paper":"/paper/2412.16256","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:60adddddd17fa2cce9212b16d4e10df21a3acc2b2955f939566020a97facfc8e","observation_id":"22d4f0a1-cba8-44cc-b13e-9f5fc856c6c9","resolution":{"observed_at":"2026-08-05T10:17:59.166418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12370","last_updated":"2025-05-24T03:01:02Z","snapshot_observed_at":"2026-07-06T21:25:46.964896Z","submitted_at":"2025-05-18T11:22:04Z","title":"Enhancing Visual Grounding for GUI Agents via Self-Evolutionary Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12370","snapshot_observed_at":"2026-08-05T10:17:59.172567Z","title":"arXiv preprint arXiv:2505.12370","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.172567Z"},"links":{"cited_paper":"/paper/2505.12370","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:1a473be3b1791a21220309e6ba6ed8483174a1f475bd228a415898162fb09ec6","observation_id":"7abe08bc-6ef1-46e9-ae9c-82cf2434754b","resolution":{"observed_at":"2026-08-05T10:17:59.172567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15436","last_updated":"2025-12-05T05:44:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-21T12:18:15Z","title":"Adaptive Chain-of-Focus Reasoning via Dynamic Visual Search and Zooming for Efficient VLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15436","snapshot_observed_at":"2026-08-05T10:17:59.179579Z","title":"arXiv preprint arXiv:2505.15436","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.179579Z"},"links":{"cited_paper":"/paper/2505.15436","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:af3e00c09649e56b62169208ad3b3bb8c81baa31428d80b5bdc18e5b7837e70b","observation_id":"19d5177d-1d48-41d2-bc68-bbb2d52e5a67","resolution":{"observed_at":"2026-08-05T10:17:59.179579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14362","last_updated":"2026-03-01T04:59:56Z","snapshot_observed_at":"2026-08-02T12:23:34.946873Z","submitted_at":"2025-05-20T13:48:11Z","title":"DeepEyes: Incentivizing \"Thinking with Images\" via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14362","snapshot_observed_at":"2026-08-05T10:17:59.185051Z","title":"arXiv preprint arXiv:2505.14362","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.185051Z"},"links":{"cited_paper":"/paper/2505.14362","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:7a7c60893ca9df72a80beb2c4d424f731a9e42e7e83b7b35b0f06dae5e7a2368","observation_id":"1290d5e6-8370-49c8-beff-0aa2fa43589b","resolution":{"observed_at":"2026-08-05T10:17:59.185051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-05T10:17:59.192008Z","title":"arXiv preprint arXiv:2307.13854","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.192008Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:c966fbe0254e15dfef7e4aee4d448963a92ade1845c76477f711f103d675c12d","observation_id":"aaff90cb-1c79-4cff-8850-bcc83d0c235c","resolution":{"observed_at":"2026-08-05T10:17:59.192008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21457","last_updated":"2026-06-08T14:20:16Z","snapshot_observed_at":"2026-07-06T21:31:35.572708Z","submitted_at":"2025-05-27T17:29:31Z","title":"ACTIVE-o3: Empowering MLLMs with Active Perception via Pure Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21457","snapshot_observed_at":"2026-08-05T10:17:59.198656Z","title":"arXiv preprint arXiv:2505.21457","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.198656Z"},"links":{"cited_paper":"/paper/2505.21457","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:6c4d49ca23736060d6ab5dd6d649f0ba1076c718e3b8c3884353b6d2b327a518","observation_id":"ca9b32fc-55d6-44e6-a355-b616183806ab","resolution":{"observed_at":"2026-08-05T10:17:59.198656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-05T10:17:59.134588Z","title":"arXiv preprint arXiv:2312.08935","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.134588Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:ee659d00734502588b49eea2aef19637ef63fbb775dfa023bdb9867ea570656f","observation_id":"25a6e7b9-77e1-4110-a5d3-99b23f3b1fd7","resolution":{"observed_at":"2026-08-05T10:17:59.134588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:18:00.305986Z","title":"https: //www.anthropic.com/news/developing-computer-use","venue":null,"work_id":"60275936-a5e2-4037-80c3-faa87fcae19a","year":2025},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.028076Z"},"links":{"citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:d4008eddf3345b83e3df24c0b1f43abed4889d0283e83b23e53fd4873e461c37","observation_id":"dc214ed5-a72b-4c17-b12c-ba17a143c73f","resolution":{"observed_at":"2026-08-05T10:18:00.312755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T10:17:59.034735Z","title":"5-vl technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.034735Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:0fdced2a5f2a722804c1dcda6f3e2e063da1e59342dc0ec25bb79857e35a352f","observation_id":"cdaedacc-94d8-4e55-a78f-de3fa83cbb14","resolution":{"observed_at":"2026-08-05T10:17:59.034735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T03:24:32.093755Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2509.04243."}