{"as_of":"2026-07-28T17:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aa8800819162cfcfe2c61204675141e19b75c51a1e6911af18f022205acf3270","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-28T06:31:03.373048+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T12:50:16.625077Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T20:00:08.408321Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2509.02544","last_updated":"2025-09-05T14:59:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-02T17:44:45Z","title":"UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T10:13:58.774968Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2509.02544"},"observation_digest":"sha256:005e26aaced71fa5d789abc015b3b9975346ca358203e55775a0fbe71f1f6c69","observation_id":"efa7606d-90a1-4c89-a24d-f755e76324f5","resolution":{"observed_at":"2026-05-13T10:13:59.047730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2601.12538","last_updated":"2026-01-18T18:58:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-18T18:58:23Z","title":"Agentic Reasoning for Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-17T15:14:25.558878Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2601.12538"},"observation_digest":"sha256:d8ef8069406c337a97005dbabcec80896e5ff193adc74ced9bb0386114205c08","observation_id":"f7a6fa83-59c1-42f8-bd82-ecc76dcd26e5","resolution":{"observed_at":"2026-05-17T15:14:25.866371Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2604.09574","last_updated":"2026-02-24T04:29:42Z","snapshot_observed_at":"2026-07-06T22:58:25.877654Z","submitted_at":"2026-02-24T04:29:42Z","title":"Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T20:35:17.075890Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2604.09574"},"observation_digest":"sha256:ac007cbba9297ce6d4f88bc35333ef99e977d29275c3d24634f0f952fda9b770","observation_id":"a00a8d54-94c6-4eff-8a4b-afedab8048e3","resolution":{"observed_at":"2026-05-15T20:36:35.212903Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2605.01208","last_updated":"2026-05-02T02:54:36Z","snapshot_observed_at":"2026-07-06T23:14:29.125042Z","submitted_at":"2026-05-02T02:54:36Z","title":"Faithful Mobile GUI Agents with Guided Advantage Estimator","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-09T15:17:05.477466Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2605.01208"},"observation_digest":"sha256:391fcd98155a473eb0f290068f38eda1d346623c34e1ee9c7a0d582f70a56f60","observation_id":"32ddfcb8-f0f4-4f19-ad06-b0543b4f3018","resolution":{"observed_at":"2026-05-11T16:41:24.147115Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2605.02572","last_updated":"2026-05-04T13:25:05Z","snapshot_observed_at":"2026-07-06T23:15:37.099197Z","submitted_at":"2026-05-04T13:25:05Z","title":"On Training Large Language Models for Long-Horizon Tasks: An Empirical Study of Horizon Length","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-08T18:13:25.735085Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2605.02572"},"observation_digest":"sha256:ad79b23926ab0b165866e337471bb89bde4c3c21a0d0acd22cf7ae5a1063ca91","observation_id":"3ab69e72-872e-4417-b40f-66d6b72ad9eb","resolution":{"observed_at":"2026-05-09T06:40:40.641959Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2605.08978","last_updated":"2026-05-12T02:23:49Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T14:44:18Z","title":"Learning to Explore: Scaling Agentic Reasoning via Exploration-Aware Policy Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T03:00:01.549385Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2605.08978"},"observation_digest":"sha256:3bb7204eafaaba1283e8778be050bbbf0a021af915cb3d6233803d0d9974ac07","observation_id":"61a0ea97-88b7-4880-83e2-222fca09fa1a","resolution":{"observed_at":"2026-05-12T03:01:17.873771Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2605.08978","last_updated":"2026-05-12T02:23:49Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T14:44:18Z","title":"Learning to Explore: Scaling Agentic Reasoning via Exploration-Aware Policy Optimization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T00:58:25.205386Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2605.08978"},"observation_digest":"sha256:3c5f89ff1fcc8d68e0f7447f51cdbf4de57285403ec725334061e85e75be34d6","observation_id":"e43a52a5-801e-44c0-a4e7-1f00e7d6cdf0","resolution":{"observed_at":"2026-05-13T02:17:07.683646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2605.12481","last_updated":"2026-05-12T17:57:04Z","snapshot_observed_at":"2026-07-06T23:24:08.763444Z","submitted_at":"2026-05-12T17:57:04Z","title":"ToolCUA: Towards Optimal GUI-Tool Path Orchestration for Computer Use Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T03:51:54.401200Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2605.12481"},"observation_digest":"sha256:a57267efe0ddd4e1c1b6422500ffc3877e46c10bc33513135bdef16e02c40f3c","observation_id":"494b1bdb-c798-4aa8-b384-8e948dd3bd4f","resolution":{"observed_at":"2026-05-13T03:52:12.365420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2606.01281","last_updated":"2026-05-31T15:06:38Z","snapshot_observed_at":"2026-07-06T23:41:53.635605Z","submitted_at":"2026-05-31T15:06:38Z","title":"RLVR without Ineffective Samples: Group Prioritized Off-Policy Optimization for LLM Reasoning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T17:25:50.758630Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2606.01281"},"observation_digest":"sha256:315bac4cc747b5d76b27e3bcd89206980508f2f16b1a3febcac3bb87020ac9db","observation_id":"ad7335ec-cd17-4d1b-85cc-f1e71fcfc475","resolution":{"observed_at":"2026-07-01T21:16:13.369302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2606.07027","last_updated":"2026-06-05T08:17:28Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T08:17:28Z","title":"StainFlow: Entity-Stain Tracking and Evidence Linking for Process Rewards in GUI Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T22:24:41.353303Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2606.07027"},"observation_digest":"sha256:79b564792e4a4136e358b4fe2b2e2585f2380214ffd6480db5a63eeed6e4ec42","observation_id":"44daa594-25cc-420c-a599-f689908c2cdb","resolution":{"observed_at":"2026-07-02T16:47:09.594291Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2606.21943","last_updated":"2026-06-20T08:20:41Z","snapshot_observed_at":"2026-07-06T23:56:54.959593Z","submitted_at":"2026-06-20T08:20:41Z","title":"Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning","version":1},"reference_index":125,"source":"pdf_text","source_observed_at":"2026-06-26T12:15:08.304150Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2606.21943"},"observation_digest":"sha256:735a3eab40426256193fd5525bb79ce536c444a2e2bf442a2af522f662ecaa2d","observation_id":"46e7f937-ef14-4065-9ae5-ae9c9c4aa368","resolution":{"observed_at":"2026-07-04T08:09:40.731617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2606.25451","last_updated":"2026-06-24T06:26:34Z","snapshot_observed_at":"2026-07-06T23:59:52.373272Z","submitted_at":"2026-06-24T06:26:34Z","title":"Learning with a Single Rollout via Monte Carlo Pass@k Critic","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-25T20:53:10.016447Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2606.25451"},"observation_digest":"sha256:ac8d4bb73c7efe09e09f60ecc30b7929753c91a94eee9325bf4467842f652d9b","observation_id":"3450fa5e-24d1-467e-99a6-dbf7f0c44049","resolution":{"observed_at":"2026-07-04T20:00:08.409789Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay","version":1},"cited_work":{"arxiv_id":"2505.16282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16282","snapshot_observed_at":"2026-07-04T20:00:08.408321Z","title":"Arpo: End-to-end policy optimization for gui agents with experience replay","venue":null,"work_id":"80d8a156-5ad4-40ba-8380-ceee5ef6bb17","year":2025},"citing_paper":{"arxiv_id":"2606.26122","last_updated":"2026-05-27T21:21:42Z","snapshot_observed_at":"2026-07-07T00:00:31.981360Z","submitted_at":"2026-05-27T21:21:42Z","title":"DocArena: Turning Raw Documents into Controllable Training Environments for Document Search Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T12:50:16.625077Z"},"links":{"cited_paper":"/paper/2505.16282","citing_paper":"/paper/2606.26122"},"observation_digest":"sha256:92ff1a5a2973b1923b4e5e5a6e2a8d9da9c52d4685ef0e19bb3c9853ca0bed7e","observation_id":"490492e7-74a4-411e-afa8-b66bcd8c2a8d","resolution":{"observed_at":"2026-06-29T12:53:26.532661Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16282/citation-record","integrity":"/paper/2505.16282/integrity","json":"/paper/2505.16282/citation-record.json","paper":"/paper/2505.16282"},"outbound":[],"paper":{"arxiv_id":"2505.16282","last_updated":"2025-05-22T06:24:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T21:28:20.028748Z","submitted_at":"2025-05-22T06:24:32Z","title":"ARPO:End-to-End Policy Optimization for GUI Agents with Experience Replay"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"thesis":"As of 28 July 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2505.16282."}