{"as_of":"2026-08-16T11:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:66caf9efb55c816897903dfe4cfe978fb033b187995183d832d5652dbb44df4a","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:08:38.331147Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T23:06:05.045839Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16704","snapshot_observed_at":"2026-08-03T23:06:05.045839Z","title":"Screen2ax: Vision-based approach for automatic macos accessibility generation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.07332","last_updated":"2026-06-09T21:30:32Z","snapshot_observed_at":"2026-08-09T15:43:09.649238Z","submitted_at":"2025-11-10T17:35:21Z","title":"Grounding Computer Use Agents on Human Demonstrations","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-03T23:06:05.045839Z"},"links":{"cited_paper":"/paper/2507.16704","citing_paper":"/paper/2511.07332"},"observation_digest":"sha256:d309278e1e2687159835c534ce83e3833da853d5fc27f4e23d3a1efa8ef14ce1","observation_id":"2f80533e-f05e-426c-b962-8a034b3f1312","resolution":{"observed_at":"2026-08-03T23:06:05.045839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16704","snapshot_observed_at":"2026-07-11T20:00:19.123214Z","title":"Park, J.; and Shim, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04334","last_updated":"2026-07-18T16:56:38Z","snapshot_observed_at":"2026-08-13T02:45:23.171486Z","submitted_at":"2026-07-05T14:33:29Z","title":"Do GUI Agents Believe Their Eyes? Diagnosing State-Belief Reliance on Pixels versus Structure","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T20:00:19.123214Z"},"links":{"cited_paper":"/paper/2507.16704","citing_paper":"/paper/2607.04334"},"observation_digest":"sha256:b6916d31dee3203adaf2fb00933c580ad302f83bbb20c903039c5debaccc7eb7","observation_id":"ff62506d-839b-4df8-aa76-e1dbc83ea341","resolution":{"observed_at":"2026-07-11T20:00:19.123214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16704","snapshot_observed_at":"2026-08-02T08:46:59.664562Z","title":"Park, J.; and Shim, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04334","last_updated":"2026-07-18T16:56:38Z","snapshot_observed_at":"2026-08-13T02:45:23.171486Z","submitted_at":"2026-07-05T14:33:29Z","title":"Do GUI Agents Believe Their Eyes? Diagnosing State-Belief Reliance on Pixels versus Structure","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T08:46:59.664562Z"},"links":{"cited_paper":"/paper/2507.16704","citing_paper":"/paper/2607.04334"},"observation_digest":"sha256:f1c89d2be84d77e61a770f32593203eb87cab87af822f256afc2cf5b61c0996b","observation_id":"bbf4ed8f-733b-46d6-9969-5d601899d01e","resolution":{"observed_at":"2026-08-02T08:46:59.664562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16704","snapshot_observed_at":"2026-08-02T02:07:38.680908Z","title":"Screen2AX: Vision-based approach for automatic macos accessibility generation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14443","last_updated":"2026-07-16T00:35:25Z","snapshot_observed_at":"2026-08-07T06:43:25.629316Z","submitted_at":"2026-07-16T00:35:25Z","title":"Tactile: Giving Computer-Using Agents Hands and Feet","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T02:07:38.680908Z"},"links":{"cited_paper":"/paper/2507.16704","citing_paper":"/paper/2607.14443"},"observation_digest":"sha256:609b8d0054b6746b093da2a404ab04edba8f3dee255583863e81d4db88d791f9","observation_id":"ba06c46e-71dd-464c-bf89-76af95b4654a","resolution":{"observed_at":"2026-08-02T02:07:38.680908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.16704/citation-record","integrity":"/paper/2507.16704/integrity","json":"/paper/2507.16704/citation-record.json","paper":"/paper/2507.16704"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:44.066207Z","title":null,"venue":null,"work_id":"a2782c54-ddd0-4410-92fb-588ca25999c0","year":2025},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:33.826386Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:2aa4d7cbc7a72bc08133774f7ad30db1da9fa2f687f4ca972f8818f6051f1bce","observation_id":"8da2a8aa-e892-4559-b2d1-073b3db0c781","resolution":{"observed_at":"2026-08-06T15:08:44.212401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:43.741041Z","title":null,"venue":null,"work_id":"85460055-be1c-4526-9bd6-2301dcd898db","year":2004},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:33.889293Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:aa58a1c4cec11d23eccc188fcb48984db378b7d27b91c74a26af8764006b26a8","observation_id":"d8b64ae5-1e05-4fe6-a9ef-80a7e7349e94","resolution":{"observed_at":"2026-08-06T15:08:43.939834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:43.488246Z","title":null,"venue":null,"work_id":"588d36ef-cce9-4d56-ad45-2e093319884b","year":2018},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:34.024815Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:ebee43d9330a8dcd9aa217c7f6119624ce6cb353292d311c8f9d59db0715d528","observation_id":"f5aedb63-89d2-4a9c-8c83-276bc651677c","resolution":{"observed_at":"2026-08-06T15:08:43.622028Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:43.265102Z","title":null,"venue":null,"work_id":"dc562f61-7f2d-492a-80bb-dd803c7b1f1d","year":2019},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:34.131892Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:b303610637f7039f329df3b26a9677865c23268c5a376906ba2166cbc1af13a7","observation_id":"eaa4a745-8e28-41e4-a855-205ae557fbf7","resolution":{"observed_at":"2026-08-06T15:08:43.364426Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:42.978302Z","title":null,"venue":null,"work_id":"9feebd27-eadd-47c2-9318-12031f647b39","year":2023},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:34.194719Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:3e17c11f37bd4252d3bf17e310a2eb9395070933c2765de8978fb6228f137609","observation_id":"a4f18e24-a84c-4c5e-aa4f-ae5c6a44cf29","resolution":{"observed_at":"2026-08-06T15:08:43.149048Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:42.677237Z","title":null,"venue":null,"work_id":"6ad3e2ac-ec34-4c29-b51e-ea4bd1cb4ade","year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:34.275257Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:9f9e62c60e8703ba5782414cc8c2b7546f4d16f018e8a2e3dd977dbe53c51375","observation_id":"fcd5298e-e42a-451a-99fc-54de88afb6d9","resolution":{"observed_at":"2026-08-06T15:08:42.843688Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:42.431348Z","title":null,"venue":null,"work_id":"78523be0-1eed-4979-8c51-56c3d5943cde","year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:34.373059Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:c681307810e063cdf89a44299cff67e3962d196ceae5c3a9c87fc55b4924dba2","observation_id":"fe625dc5-9b54-4047-8213-8510b770fa7b","resolution":{"observed_at":"2026-08-06T15:08:42.567996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:34.433056Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:34.433056Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:e613736dc5f2e6195f5af3324bc02391555a5f61401edc616a6e88b8816cd8a2","observation_id":"2e57de4e-d0c0-4a50-855e-e01e1a00c555","resolution":{"observed_at":"2026-08-06T15:08:34.433056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10935","last_updated":"2024-02-23T04:36:51Z","snapshot_observed_at":"2026-08-13T02:23:45.428162Z","submitted_at":"2024-01-17T08:10:35Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10935","snapshot_observed_at":"2026-08-06T15:08:34.518599Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:34.518599Z"},"links":{"cited_paper":"/paper/2401.10935","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:9fd7f246f3b41cc35cd7b743840a5f2da173b47d5107be21388eb35cdd88d969","observation_id":"f619303a-286b-4f82-9b73-9698e6b528bc","resolution":{"observed_at":"2026-08-06T15:08:34.518599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10935","last_updated":"2024-02-23T04:36:51Z","snapshot_observed_at":"2026-08-13T02:23:45.428162Z","submitted_at":"2024-01-17T08:10:35Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10935","snapshot_observed_at":"2026-08-06T15:08:34.593264Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:34.593264Z"},"links":{"cited_paper":"/paper/2401.10935","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:5fce2bb70211ed2bacc7946991e5f2d64d709c35dd2678140c2e30d786869258","observation_id":"6dbd9457-c3c9-4e56-94b0-a90f11e3b346","resolution":{"observed_at":"2026-08-06T15:08:34.593264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03507","last_updated":"2024-08-07T02:18:39Z","snapshot_observed_at":"2026-08-16T07:09:43.929566Z","submitted_at":"2024-08-07T02:18:39Z","title":"GUI Element Detection Using SOTA YOLO Deep Learning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03507","snapshot_observed_at":"2026-08-06T15:08:34.688594Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:34.688594Z"},"links":{"cited_paper":"/paper/2408.03507","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:153d5d9aa9f8e40794a7854fc88e92d7a325104352f85e3243086d446102320b","observation_id":"23c3bd59-879b-4210-b5b0-a3a8dd8a0592","resolution":{"observed_at":"2026-08-06T15:08:34.688594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:34.756290Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:34.756290Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:843bb038df8efbdda950fcd88840fb280f4446d8effa6d7091b56d825ad6c2ba","observation_id":"44000411-1163-4c00-955b-eff0ad110e15","resolution":{"observed_at":"2026-08-06T15:08:34.756290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08189","last_updated":"2019-04-19T02:23:52Z","snapshot_observed_at":"2026-08-14T16:45:06.764750Z","submitted_at":"2019-04-17T11:20:01Z","title":"CenterNet: Keypoint Triplets for Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08189","snapshot_observed_at":"2026-08-06T15:08:34.830855Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:34.830855Z"},"links":{"cited_paper":"/paper/1904.08189","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:42e6b4a321c4bac4817947523a12f7e97722ed1b6b31a55719cf93f5a4fb3b98","observation_id":"89159520-3b0b-4523-b5ee-6981d2b85a93","resolution":{"observed_at":"2026-08-06T15:08:34.830855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:42.189038Z","title":null,"venue":null,"work_id":"a2a7c01a-68a1-45dc-b686-3221e42f7027","year":null},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:34.921165Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:6b31143bc1d2346e6b42b187668371ab520df9442587374a0f3d54b5921581a8","observation_id":"c10bea78-a03b-46bc-b84e-0c517beb80ff","resolution":{"observed_at":"2026-08-06T15:08:42.318555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:41.894915Z","title":"Hagberg, Daniel A","venue":null,"work_id":"da977ef0-9388-4c47-9a39-0a4d164c431e","year":2008},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:35.101032Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:a8adfbed8779a2b27cd7a9154388d5048e0bde98cf20b5a7b851cf7adb34d604","observation_id":"0b9f4461-cd05-43af-a55d-65305e2d21da","resolution":{"observed_at":"2026-08-06T15:08:42.018495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13108","last_updated":"2024-01-01T14:26:39Z","snapshot_observed_at":"2026-08-14T22:49:35.799708Z","submitted_at":"2023-12-20T15:28:38Z","title":"ASSISTGUI: Task-Oriented Desktop Graphical User Interface Automation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13108","snapshot_observed_at":"2026-08-06T15:08:35.207184Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:35.207184Z"},"links":{"cited_paper":"/paper/2312.13108","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:bc93be774b27c2aabe91a58d0f84493d817ffbf80c2d190d234d2b33227e811e","observation_id":"f01b97b4-a159-4204-918e-5c8c1aafe1c8","resolution":{"observed_at":"2026-08-06T15:08:35.207184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18060","last_updated":"2024-10-07T19:04:38Z","snapshot_observed_at":"2026-08-14T22:49:26.314666Z","submitted_at":"2024-09-26T17:01:33Z","title":"Inferring Alt-text For UI Icons With Large Language Models During App Development","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18060","snapshot_observed_at":"2026-08-06T15:08:35.303129Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:35.303129Z"},"links":{"cited_paper":"/paper/2409.18060","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:bb0326cc8b28f9eab8f6fdc9c2903644df69246aaf8e9c16ab83108f6d4ffd22","observation_id":"6f32f33d-0b66-42cc-965d-7738e45f6d09","resolution":{"observed_at":"2026-08-06T15:08:35.303129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08914","last_updated":"2024-12-27T06:56:18Z","snapshot_observed_at":"2026-08-13T05:02:31.052003Z","submitted_at":"2023-12-14T13:20:57Z","title":"CogAgent: A Visual Language Model for GUI Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08914","snapshot_observed_at":"2026-08-06T15:08:35.405743Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:35.405743Z"},"links":{"cited_paper":"/paper/2312.08914","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:04750b86116dedb3206b8e84dd976a9a66abd306c6c7f0458de3b6722744bb2f","observation_id":"c8769967-487a-4cb0-973a-086bfb325e7f","resolution":{"observed_at":"2026-08-06T15:08:35.405743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03003","last_updated":"2024-10-16T08:15:53Z","snapshot_observed_at":"2026-08-14T22:49:25.998235Z","submitted_at":"2023-12-04T06:13:35Z","title":"Explore, Select, Derive, and Recall: Augmenting LLM with Human-like Memory for Mobile Task Automation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03003","snapshot_observed_at":"2026-08-06T15:08:35.476360Z","title":"Ko, Sangeun Oh, and Insik Shin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:35.476360Z"},"links":{"cited_paper":"/paper/2312.03003","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:d59042cc0f7e247cbbf1f8ffb809c17ea425c62459d18faeca11e5df7362819e","observation_id":"27c930c3-59a7-477d-b247-94ab1ba15f82","resolution":{"observed_at":"2026-08-06T15:08:35.476360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12086","last_updated":"2022-02-15T05:43:32Z","snapshot_observed_at":"2026-08-09T08:39:37.884261Z","submitted_at":"2022-01-28T12:49:48Z","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12086","snapshot_observed_at":"2026-08-06T15:08:35.573726Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:35.573726Z"},"links":{"cited_paper":"/paper/2201.12086","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:7aded143614fd4679bd58f7a550069ae2324b29008c127e7c9f5d09c776bcbf0","observation_id":"5ae2999d-18ae-4e94-a659-52a64351a8ac","resolution":{"observed_at":"2026-08-06T15:08:35.573726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17465","last_updated":"2024-11-26T14:29:47Z","snapshot_observed_at":"2026-08-16T10:14:53.516684Z","submitted_at":"2024-11-26T14:29:47Z","title":"ShowUI: One Vision-Language-Action Model for GUI Visual Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17465","snapshot_observed_at":"2026-08-06T15:08:35.653738Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:35.653738Z"},"links":{"cited_paper":"/paper/2411.17465","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:8810cb1315c8856d7afbc52e94154097ee5c4dd13c70f23bcfd8cdefb6acb530","observation_id":"fb3aec4d-05fc-4eab-ba62-092c7b43bebb","resolution":{"observed_at":"2026-08-06T15:08:35.653738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T15:08:35.724983Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:35.724983Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:4f10b3c6915daad704bdfb61284688e315c1a7d697d69c31388b03c570b3683a","observation_id":"ac017fbd-a946-40d0-957e-4477b261d3f3","resolution":{"observed_at":"2026-08-06T15:08:35.724983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00203","last_updated":"2024-08-01T00:00:43Z","snapshot_observed_at":"2026-08-12T23:10:37.552123Z","submitted_at":"2024-08-01T00:00:43Z","title":"OmniParser for Pure Vision Based GUI Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00203","snapshot_observed_at":"2026-08-06T15:08:35.836145Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:35.836145Z"},"links":{"cited_paper":"/paper/2408.00203","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:0e7b50b4db45e80c2b6796d2ff62d888282bc8199e2dd7986a84508ea4986c92","observation_id":"5d28e612-b4f5-4b41-bab8-e403f953c010","resolution":{"observed_at":"2026-08-06T15:08:35.836145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.imavis.2004.02.006","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Image and Vision Computing","work_id":"22990484-5be8-45b5-a548-16256f9cb5b0","year":2004},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:35.919981Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:a100ad862541938bc0c362b6d9f12d0e17f72e46cab9a8810a54c8ad88f96412","observation_id":"a65e62a2-1cea-45c2-baf3-9ffd312d2d54","resolution":{"observed_at":"2026-08-06T15:08:38.633384Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07945","last_updated":"2024-02-09T02:33:45Z","snapshot_observed_at":"2026-08-13T04:24:08.941136Z","submitted_at":"2024-02-09T02:33:45Z","title":"ScreenAgent: A Vision Language Model-driven Computer Control Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07945","snapshot_observed_at":"2026-08-06T15:08:36.026524Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:36.026524Z"},"links":{"cited_paper":"/paper/2402.07945","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:d40a25d7672198774b31e40f374b4fbe96e261656f3d5747b965e374956827a8","observation_id":"4b243fb2-1afb-4303-a7f4-b4ceee2bbfee","resolution":{"observed_at":"2026-08-06T15:08:36.026524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:41.640515Z","title":null,"venue":null,"work_id":"94e44170-a156-4165-85ea-e3a011d99e1e","year":2025},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:36.151937Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:cca06d299dc05013516829338c37fd0c027efa66e5f629b4e2a84642d6354916","observation_id":"290b6ddd-300d-44a5-981a-5da433ea9b9a","resolution":{"observed_at":"2026-08-06T15:08:41.745988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:41.397751Z","title":null,"venue":null,"work_id":"37eeed8a-dd99-4e55-be95-425d2736d54a","year":2023},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:36.247183Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:7f103d9fc68ce1b413c72c1cb16981c8ac3dda469cee0a9de230ba0d80291c79","observation_id":"a3c6bbf4-df3a-4b2e-861b-7137df3d90bc","resolution":{"observed_at":"2026-08-06T15:08:41.567487Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:41.182408Z","title":null,"venue":null,"work_id":"61f9ed50-7e46-4d3b-ac7b-0eaef55d708e","year":2002},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:36.325697Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:bec3cb27ed56a66bae48e0d67fd674dea7f139a53f52d7375c69fb6271bfbf01","observation_id":"8cf82ae5-2755-44fe-be52-710fc2aa297b","resolution":{"observed_at":"2026-08-06T15:08:41.260097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10088","last_updated":"2023-10-27T14:24:31Z","snapshot_observed_at":"2026-08-15T14:17:05.539082Z","submitted_at":"2023-07-19T15:57:24Z","title":"Android in the Wild: A Large-Scale Dataset for Android Device Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10088","snapshot_observed_at":"2026-08-06T15:08:36.408309Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:36.408309Z"},"links":{"cited_paper":"/paper/2307.10088","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:1ca509477263d7cfae3cbc66cf8d17313b4530f70a87c6d6c80cc2602829b972","observation_id":"b1f7845d-30ad-452f-98ef-e3b904f06018","resolution":{"observed_at":"2026-08-06T15:08:36.408309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.01497","last_updated":"2016-01-06T06:30:17Z","snapshot_observed_at":"2026-08-14T22:45:50.420062Z","submitted_at":"2015-06-04T07:58:34Z","title":"Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.01497","snapshot_observed_at":"2026-08-06T15:08:36.583085Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:36.583085Z"},"links":{"cited_paper":"/paper/1506.01497","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:64a8ea6d92c76950d0210b23ecd4eedacfd0fe747820a84f7bb1f2428560c480","observation_id":"b257e5ac-c3ad-4efd-9fef-e68c6e2dda93","resolution":{"observed_at":"2026-08-06T15:08:36.583085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:36.672902Z","title":"Wobbrock","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:36.672902Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:612b3b9ed36fdec6b47ca245faa2c0c0b17bc9701bc3464852c5f0835f9bcd6c","observation_id":"620bb966-e79d-4623-a5cd-9b0f86d69a60","resolution":{"observed_at":"2026-08-06T15:08:36.672902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:40.989795Z","title":null,"venue":null,"work_id":"a8523603-8812-4118-b823-bb4ae5a8cf6f","year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:36.811752Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:f48f124cec0ff710fc387efdfe368d6c8998cd2976f8c56e474993cec8bc3038","observation_id":"79e46e05-9003-4d4a-9db0-b3253d43eb65","resolution":{"observed_at":"2026-08-06T15:08:41.086275Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:40.798173Z","title":null,"venue":null,"work_id":"66c3d5cf-bd92-48b8-92a8-42f8bc6b68ab","year":null},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:36.932205Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:2bfa42dbb18428d876e2a3a95a49a2eafd160527331cd463caef0ff5c173e6cf","observation_id":"d71ee041-eb80-4d40-92e0-c12232a4f666","resolution":{"observed_at":"2026-08-06T15:08:40.916737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02663","last_updated":"2022-10-06T03:48:54Z","snapshot_observed_at":"2026-08-13T14:12:11.284593Z","submitted_at":"2022-10-06T03:48:54Z","title":"Towards Better Semantic Understanding of Mobile Interfaces","version":1},"cited_work":{"arxiv_id":"2210.02663","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.02663","snapshot_observed_at":"2026-08-06T15:08:39.460113Z","title":"Towards Better Semantic Understanding of Mobile Interfaces","venue":"cs.HC","work_id":"2725dcb3-096b-49de-adfa-da4620e60a91","year":2022},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:37.245339Z"},"links":{"cited_paper":"/paper/2210.02663","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:dc5e537ad1be1b418386b7da54841f8cef88ac1db14ddb1ecb9c76e5dcff6b13","observation_id":"1c257bd4-a691-4d16-929a-59239a4318f1","resolution":{"observed_at":"2026-08-06T15:08:39.538972Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:37.381030Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:37.381030Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:07a42a94e16d652eab7773914ff15ba539842294cfcf84fb7f8b4f7539fe26dd","observation_id":"411d8c74-65d2-436d-83ea-35b22032c13b","resolution":{"observed_at":"2026-08-06T15:08:37.381030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.5726","last_updated":"2015-06-03T01:42:20Z","snapshot_observed_at":"2026-08-14T23:10:48.763001Z","submitted_at":"2014-11-20T23:54:35Z","title":"CIDEr: Consensus-based Image Description Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.5726","snapshot_observed_at":"2026-08-06T15:08:37.533824Z","title":"Lawrence Zitnick, and Devi Parikh","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:37.533824Z"},"links":{"cited_paper":"/paper/1411.5726","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:ea2aeea9550ca82d83f089535c7b6b394725019714ce13cd4a995fd6dea144a7","observation_id":"15743e26-4b95-4b7a-bd92-9f78e24dab3e","resolution":{"observed_at":"2026-08-06T15:08:37.533824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.08655","last_updated":"2023-02-17T21:24:09Z","snapshot_observed_at":"2026-08-15T23:49:13.112692Z","submitted_at":"2022-09-18T20:58:39Z","title":"Enabling Conversational Interaction with Mobile UI using Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.08655","snapshot_observed_at":"2026-08-06T15:08:37.642376Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:37.642376Z"},"links":{"cited_paper":"/paper/2209.08655","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:8573bd6c5cd43ffcf03c4064e21ad270bbd30d88e3d4c91822b5e0cd808da6bb","observation_id":"48ff3bbb-ff10-45f8-a4a0-03806cdd46af","resolution":{"observed_at":"2026-08-06T15:08:37.642376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:40.150117Z","title":null,"venue":null,"work_id":"30283c0f-a741-4137-9747-9147c502fca6","year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:37.788237Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:c4be918421bdd030447dbeb09f58dc644cfd8ea76843a9369585bb9d06c3cb9d","observation_id":"146be943-de37-403b-a4ac-f9312e6dc09e","resolution":{"observed_at":"2026-08-06T15:08:40.317375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15272","last_updated":"2024-03-09T09:38:51Z","snapshot_observed_at":"2026-08-14T22:49:32.130610Z","submitted_at":"2023-08-29T13:02:30Z","title":"AutoDroid: LLM-powered Task Automation in Android","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15272","snapshot_observed_at":"2026-08-06T15:08:37.899612Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:37.899612Z"},"links":{"cited_paper":"/paper/2308.15272","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:5b8c7c5284107c7033df29a31781b2d09c6f7eee0c1f9dd83c801e5c475e4cd7","observation_id":"edf4d0f0-22ff-49cc-b2aa-8bf29ee50888","resolution":{"observed_at":"2026-08-06T15:08:37.899612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:39.859003Z","title":null,"venue":null,"work_id":"43428c59-9899-457b-bdf2-b3c8f31eba75","year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:37.986990Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:5118372c0e88cb59263578d5e0ba53ce74c36dc9e0d9ee059ee5df3c57933bf7","observation_id":"ade96213-e372-45b0-9c1e-06c9ceccfdc9","resolution":{"observed_at":"2026-08-06T15:08:40.026192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:38.047976Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:38.047976Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:c43ede75f60a483345d7baec08dad4c0e3c5c27fe97ddaa17cec4695b35bb053","observation_id":"4ac5c9d9-70ea-47ef-b1d3-3bbd3abe7f3c","resolution":{"observed_at":"2026-08-06T15:08:38.047976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06242","last_updated":"2023-11-10T18:59:08Z","snapshot_observed_at":"2026-08-13T05:28:13.368841Z","submitted_at":"2023-11-10T18:59:08Z","title":"Florence-2: Advancing a Unified Representation for a Variety of Vision Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06242","snapshot_observed_at":"2026-08-06T15:08:38.132772Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:38.132772Z"},"links":{"cited_paper":"/paper/2311.06242","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:0c9a8113a9889833423264b13f2fadd12e3867da9e5f5843c228ee61beccbeae","observation_id":"d699dcec-d042-49b7-9a9b-b4aae8a88552","resolution":{"observed_at":"2026-08-06T15:08:38.132772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04984","last_updated":"2024-03-08T01:52:44Z","snapshot_observed_at":"2026-08-13T00:59:39.567852Z","submitted_at":"2024-03-08T01:52:44Z","title":"UI Semantic Group Detection: Grouping UI Elements with Similar Semantics in Mobile Graphical User Interface","version":1},"cited_work":{"arxiv_id":"2403.04984","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.04984","snapshot_observed_at":"2026-08-06T15:08:39.043073Z","title":"UI Semantic Group Detection: Grouping UI Elements with Similar Semantics in Mobile Graphical User Interface","venue":"cs.SE","work_id":"3794fb0e-fc6b-4fe8-bce7-1dca2adc4ed8","year":2024},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:38.217735Z"},"links":{"cited_paper":"/paper/2403.04984","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:62e3d6b1887630826c1d976768cf05ec554ba74baa3a780574a029ff359cab0d","observation_id":"e7174ff0-d3e5-46ba-bea5-4530bbd728e2","resolution":{"observed_at":"2026-08-06T15:08:39.153521Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.04893","last_updated":"2021-01-13T05:56:15Z","snapshot_observed_at":"2026-07-06T10:32:06.735077Z","submitted_at":"2021-01-13T05:56:15Z","title":"Screen Recognition: Creating Accessibility Metadata for Mobile Applications from Pixels","version":1},"cited_work":{"arxiv_id":"2101.04893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2101.04893","snapshot_observed_at":"2026-08-06T15:08:38.774497Z","title":"Screen Recognition: Creating Accessibility Metadata for Mobile Applications from Pixels","venue":"cs.HC","work_id":"83a9b84d-9ccf-44f8-9bc3-9a572c53f038","year":2021},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:38.331147Z"},"links":{"cited_paper":"/paper/2101.04893","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:405ca081d70cc69b59231d422ea3122a278aca875311d395e48e22f4fb335517","observation_id":"0c3ba5fa-f2a4-4719-9d2e-0383a2f1ff6c","resolution":{"observed_at":"2026-08-06T15:08:38.941781Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.12872","last_updated":"2020-05-28T17:37:23Z","snapshot_observed_at":"2026-08-14T22:50:00.733302Z","submitted_at":"2020-05-26T17:06:38Z","title":"End-to-End Object Detection with Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.12872","snapshot_observed_at":"2026-08-06T15:08:35.024380Z","title":"arXiv:2005.12872 [cs.CV] https://arxiv.org/abs/2005.12872","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:35.024380Z"},"links":{"cited_paper":"/paper/2005.12872","citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:dd41d8937b89af479f566280ecc05c21dcbc7a58b2c46b93fe02f76eed80cbe3","observation_id":"079f17fb-9ec8-4507-8899-974583a648e0","resolution":{"observed_at":"2026-08-06T15:08:35.024380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:08:40.482607Z","title":"https://github.com/straussmaximilian/ocrmac","venue":null,"work_id":"31f6c6af-621e-444c-b4d9-0e6be8b168d5","year":null},"citing_paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:08:37.092152Z"},"links":{"citing_paper":"/paper/2507.16704"},"observation_digest":"sha256:72adb2e2208d029dda0fd9ef8231340810314b02e3b004dc1d269df261ce13f0","observation_id":"596bf2bd-3ea1-4da1-b72b-508c353dccf9","resolution":{"observed_at":"2026-08-06T15:08:40.610824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.16704","last_updated":"2025-07-22T15:38:12Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T07:18:31.685455Z","submitted_at":"2025-07-22T15:38:12Z","title":"Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":40,"verified_exact":3,"verified_fuzzy":2},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 4 inbound Pith citation observations for arXiv:2507.16704."}