{"as_of":"2026-08-08T16:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aabd70c6904146e0cb715a0ce80a1df61af0b658161a1ab551a039765d49de4a","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:01:25.268734Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T09:33:30.444057Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T09:37:41.944603Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.22942","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22942","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yu Gu, Boyuan Zheng, Boyu Gou, Kai Zhang, Cheng Chang, Sanjari Srivastava, Yanan Xie, Peng Qi, Huan Sun, and Yu Su","venue":null,"work_id":"8efdd46e-289c-4d2e-99b0-d77572b48a7e","year":null},"citing_paper":{"arxiv_id":"2601.22149","last_updated":"2026-04-17T18:27:53Z","snapshot_observed_at":"2026-08-03T05:49:10.484175Z","submitted_at":"2026-01-29T18:59:07Z","title":"DynaWeb: Model-Based Reinforcement Learning of Web Agents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T09:33:30.444057Z"},"links":{"cited_paper":"/paper/2505.22942","citing_paper":"/paper/2601.22149"},"observation_digest":"sha256:e6582f5a7e5b0160453a02f9eedae80b86e5aac112904553f32e5c4618f99497","observation_id":"0c5f77f0-f1c3-468c-9463-1310ddc94d86","resolution":{"observed_at":"2026-05-16T09:37:41.946935Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22942/citation-record","integrity":"/paper/2505.22942/integrity","json":"/paper/2505.22942/citation-record.json","paper":"/paper/2505.22942"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:20.246771Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.246771Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:015a46c614ab3bc47b405e5223ade6de2b3cd44ce59f601a4f6d5deeba9f0f13","observation_id":"d6d3f758-f93f-4b9f-b296-2cfa105bc81d","resolution":{"observed_at":"2026-08-07T13:01:20.246771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:20.386292Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.386292Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:f56c7fb9c3fa8857e42d971483823f0c81b7a41ff3f946aff93142aac07c347b","observation_id":"555dd279-badd-41eb-8dc7-0608c3a6e1a1","resolution":{"observed_at":"2026-08-07T13:01:20.386292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11704","last_updated":"2024-08-06T22:37:06Z","snapshot_observed_at":"2026-08-01T16:04:10.873571Z","submitted_at":"2024-06-17T16:25:04Z","title":"Nemotron-4 340B Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11704","snapshot_observed_at":"2026-08-07T13:01:20.532944Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.532944Z"},"links":{"cited_paper":"/paper/2406.11704","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:47e5b72b81e45808e77afd2097f09e7993fa734c9b18cad832d003610483b1a7","observation_id":"5c05b1af-4175-41d1-8cdf-042686b4f6e9","resolution":{"observed_at":"2026-08-07T13:01:20.532944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10935","last_updated":"2024-02-23T04:36:51Z","snapshot_observed_at":"2026-08-08T03:28:12.161766Z","submitted_at":"2024-01-17T08:10:35Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10935","snapshot_observed_at":"2026-08-07T13:01:20.699288Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.699288Z"},"links":{"cited_paper":"/paper/2401.10935","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:a783ffcaf83f5792efa88dd3b8d10c21fe3e3b1e800b914a1a31bcde30fbdff7","observation_id":"24c6ddbe-1b80-431a-a7c6-a1457d379561","resolution":{"observed_at":"2026-08-07T13:01:20.699288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05467","last_updated":"2025-02-28T16:02:27Z","snapshot_observed_at":"2026-08-06T15:44:08.375632Z","submitted_at":"2024-12-06T23:43:59Z","title":"The BrowserGym Ecosystem for Web Agent Research","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05467","snapshot_observed_at":"2026-08-07T13:01:20.809475Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.809475Z"},"links":{"cited_paper":"/paper/2412.05467","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:a9868be4ca04e070b1f11cd0a7b9898686dabdbf07425c47a2a3dc9b0f262a53","observation_id":"073aff89-ce94-4cf9-a649-f8929e728b63","resolution":{"observed_at":"2026-08-07T13:01:20.809475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:28.150305Z","title":null,"venue":null,"work_id":"c814ae0a-39e6-42cb-bede-4c69c98d10a3","year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.888771Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:604f5cf291c094c909a1327f4408a3c002bc4577c91dcbd1955b2a5b305c0bb9","observation_id":"9d04ee0b-94c0-4b75-9ba7-8a62058bd972","resolution":{"observed_at":"2026-08-07T13:01:28.232626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:27.978515Z","title":"Laradji, Manuel Del Verme, Tom Marty, David Vazquez, Nicolas Chapados, and Alexandre Lacoste","venue":null,"work_id":"338c2462-7d9f-4924-b874-07c35afce7a0","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.987141Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:14007109a0438412c642a480b70c48a7831386d531277898007d6dcea400a5f2","observation_id":"4f3f1d3d-9b9b-4994-9aa0-26ef3b260ce3","resolution":{"observed_at":"2026-08-07T13:01:28.060460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T13:01:21.057274Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.057274Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:47ce374d5bfd46060f2f9975d6eb11d3103ac333ebec084ec2c410401312e21d","observation_id":"0339ea42-1057-4d10-864d-f1d8e9ec2727","resolution":{"observed_at":"2026-08-07T13:01:21.057274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:27.812093Z","title":null,"venue":null,"work_id":"17a983f8-9f61-4e66-a08f-0e0efe4b1f4c","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.126022Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:31410988084da5de40ff6bf50eeee80f5c3c08e7a116920874d08ffa05515d99","observation_id":"5d477bd3-3331-4e95-9d3d-2fbb01500ea4","resolution":{"observed_at":"2026-08-07T13:01:27.887314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:21.198579Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.198579Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:82fb3b26020c11a394b7ccbbfef3fa30c2c9c9574932e42251226734b564f9bb","observation_id":"24b2fc55-e79a-4c59-9716-f6d51fe25a70","resolution":{"observed_at":"2026-08-07T13:01:21.198579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T13:01:21.278424Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.278424Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:6ba08e4dc30b657b12cac1ba7d6d3c02af4272d802350839adead2cdff98736c","observation_id":"83b894f4-da58-41bd-b9fd-b69d32ac0f09","resolution":{"observed_at":"2026-08-07T13:01:21.278424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12856","last_updated":"2024-02-25T16:17:43Z","snapshot_observed_at":"2026-07-06T15:57:53.178833Z","submitted_at":"2023-07-24T14:56:30Z","title":"A Real-World WebAgent with Planning, Long Context Understanding, and Program Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12856","snapshot_observed_at":"2026-08-07T13:01:21.382104Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.382104Z"},"links":{"cited_paper":"/paper/2307.12856","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:157eb5a14cec13ac117eb11d7147070aa4e628ae8a9b1c1c9dc8e2bb720ed4bd","observation_id":"68a133eb-d901-42e3-9210-9afdc67ce733","resolution":{"observed_at":"2026-08-07T13:01:21.382104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13919","last_updated":"2024-06-06T18:37:34Z","snapshot_observed_at":"2026-08-07T11:03:34.753698Z","submitted_at":"2024-01-25T03:33:18Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13919","snapshot_observed_at":"2026-08-07T13:01:21.513024Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.513024Z"},"links":{"cited_paper":"/paper/2401.13919","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:efa4adb7025667a46c9d105488ab1ae3d1234724e04e23b52c53a294c18823d6","observation_id":"b17aeedb-adc1-4c61-b128-beb80f898367","resolution":{"observed_at":"2026-08-07T13:01:21.513024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19609","last_updated":"2024-10-25T15:01:27Z","snapshot_observed_at":"2026-07-06T19:39:47.007952Z","submitted_at":"2024-10-25T15:01:27Z","title":"OpenWebVoyager: Building Multimodal Web Agents via Iterative Real-World Exploration, Feedback and Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19609","snapshot_observed_at":"2026-08-07T13:01:21.608317Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.608317Z"},"links":{"cited_paper":"/paper/2410.19609","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:336851782f4bf6a20b99c7470d157aa5ecadf59e97f6c75a8c418df48194c48e","observation_id":"60e58c5d-6d0d-4c86-bada-cbe80b64a804","resolution":{"observed_at":"2026-08-07T13:01:21.608317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T13:01:21.704241Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.704241Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:c32ef3bb3af766e155fd2b88fcdd441626b1d40e62d2e516b9000531eff2fc15","observation_id":"337f8532-e1f3-4e5b-86e5-2c897efd69c0","resolution":{"observed_at":"2026-08-07T13:01:21.704241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19100","last_updated":"2025-02-15T05:19:38Z","snapshot_observed_at":"2026-07-06T19:39:19.409512Z","submitted_at":"2024-10-24T19:03:01Z","title":"VideoWebArena: Evaluating Long Context Multimodal Agents with Video Understanding Web Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19100","snapshot_observed_at":"2026-08-07T13:01:21.774280Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.774280Z"},"links":{"cited_paper":"/paper/2410.19100","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:e52a2469dc65075ac45b911a3e5d0345b9ef87cc3dcf4647c72f6f02947ab18b","observation_id":"233fcc62-c834-4818-b132-b3642fa84a08","resolution":{"observed_at":"2026-08-07T13:01:21.774280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:27.632351Z","title":null,"venue":null,"work_id":"9d3bc326-27bf-4d22-b1b6-bc1c03fb50cc","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.867543Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:b6a8aa80331a556b281bb5d4b4bacc1d9dd56d7edbc0f0a4710f50c09a7698cb","observation_id":"18091e6e-8d27-4e9c-8127-a67f3eceb49c","resolution":{"observed_at":"2026-08-07T13:01:27.722297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:27.454551Z","title":null,"venue":null,"work_id":"4940f82b-ffda-47e1-9cd0-0445cf219cdb","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.945890Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:caf2b284d4b48949e0f715b6ce73713498aadc15ab4d794892be8da871698585","observation_id":"bddcc80b-d7c3-4d49-969a-4b5a4bd78c04","resolution":{"observed_at":"2026-08-07T13:01:27.545256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06703","last_updated":"2026-06-04T09:59:28Z","snapshot_observed_at":"2026-08-05T07:12:18.604381Z","submitted_at":"2024-10-09T09:13:38Z","title":"ST-WebAgentBench: A Benchmark for Evaluating Safety and Trustworthiness in Web Agents","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06703","snapshot_observed_at":"2026-08-07T13:01:22.017252Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.017252Z"},"links":{"cited_paper":"/paper/2410.06703","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:7ce7e39429abf3f00f76c613964f7cf905f484fe746d379eec7255932e577cfc","observation_id":"ee25ebe5-b132-47da-b113-31e06bc30f82","resolution":{"observed_at":"2026-08-07T13:01:22.017252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:22.120072Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.120072Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:5e1abe7cd3187a6500c12ea8aa4d37638f05f7b201a9e34e24b9c7166829912f","observation_id":"6658e12c-bddd-42d5-8bbc-633daa5d0b52","resolution":{"observed_at":"2026-08-07T13:01:22.120072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17657","last_updated":"2025-06-16T06:25:31Z","snapshot_observed_at":"2026-07-06T19:38:18.191612Z","submitted_at":"2024-10-23T08:19:18Z","title":"ReflecTool: Towards Reflection-Aware Tool-Augmented Clinical Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17657","snapshot_observed_at":"2026-08-07T13:01:22.236158Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.236158Z"},"links":{"cited_paper":"/paper/2410.17657","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:7b238a44de312265e60837ff86ba4709bc3790818cfb47bb5f2977899057632c","observation_id":"7c90a064-4a20-49b5-83b6-be24acdb7b0b","resolution":{"observed_at":"2026-08-07T13:01:22.236158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-06T20:36:41.418114Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-07T13:01:22.351667Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.351667Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:a32887b88cb5434c982d2b77e59df523d52cbd1d79b214f28ed77ed2f3aafbce","observation_id":"c5e43736-43ad-4bde-a342-009c3178061d","resolution":{"observed_at":"2026-08-07T13:01:22.351667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08172","last_updated":"2024-02-21T17:42:32Z","snapshot_observed_at":"2026-07-06T16:18:49.258642Z","submitted_at":"2023-09-15T05:44:08Z","title":"LASER: LLM Agent with State-Space Exploration for Web Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08172","snapshot_observed_at":"2026-08-07T13:01:22.457080Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.457080Z"},"links":{"cited_paper":"/paper/2309.08172","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:acb7d7bec327c9abe4e72ea09eef1677f08270568441ca1b24d0bb9977c0adf0","observation_id":"0fa1ecbc-8652-4784-99a3-ed2dbcd2078e","resolution":{"observed_at":"2026-08-07T13:01:22.457080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:22.596124Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.596124Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:b08e5b21fb2120f17c1a24e33de168a1ac452856ed7b85fd2410a92818efb358","observation_id":"67007de0-b117-4a67-a764-1da794453828","resolution":{"observed_at":"2026-08-07T13:01:22.596124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T13:01:22.713507Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.713507Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:5f5634cab0cfcdfbde86765366cf31009e7a13357ccd4d0f9d14ad865750c924","observation_id":"9b518536-05fb-4fb4-aae4-9fa037557982","resolution":{"observed_at":"2026-08-07T13:01:22.713507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-07T17:14:39.278754Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-07T13:01:22.826852Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.826852Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:147153ebb7017145f7151bb906062337407a893bd580a278d688b9d3119c33ed","observation_id":"83a9e7f2-1d7f-4b33-96f3-481373a19201","resolution":{"observed_at":"2026-08-07T13:01:22.826852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:27.315333Z","title":null,"venue":null,"work_id":"7518b93e-3f8d-494b-b7ca-048d65e93313","year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.893349Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:93f1d591359077f56f1e116c3f01e54bf16b490f465825400b3fab11d5cc8447","observation_id":"f4825587-3a7f-4bc0-976e-06fd526f37c9","resolution":{"observed_at":"2026-08-07T13:01:27.380947Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:27.134890Z","title":null,"venue":null,"work_id":"fc3ce86b-6a8d-4ee1-99ce-5bc8e5c3f951","year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.989790Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:4f4e88017f018f6a626efc15b185e46ee88030ccebb779815b5c982bbc6b0230","observation_id":"12d7c553-52f3-46d0-81d4-e8ea9dafa983","resolution":{"observed_at":"2026-08-07T13:01:27.223706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:26.932976Z","title":null,"venue":null,"work_id":"99b26fa6-e861-4118-b367-3fdebfdfb6a5","year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.100271Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:6857c8c12e311cdadb1b7bbc09e681766500b0f7778d2123ddfa11cd71a268b6","observation_id":"945135ee-9b28-4163-86b4-0b92a3c8fe41","resolution":{"observed_at":"2026-08-07T13:01:27.023101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06474","last_updated":"2024-10-07T14:19:37Z","snapshot_observed_at":"2026-08-03T07:29:21.763809Z","submitted_at":"2024-04-09T17:25:47Z","title":"Autonomous Evaluation and Refinement of Digital Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06474","snapshot_observed_at":"2026-08-07T13:01:23.261317Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.261317Z"},"links":{"cited_paper":"/paper/2404.06474","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:23d1ebc6c01f478f0c8113f9e390a85a2e1b130f0e9f787c54578ee89b3b31f9","observation_id":"0d76ac06-0f6b-468c-9f6c-137e27ee6005","resolution":{"observed_at":"2026-08-07T13:01:23.261317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12373","last_updated":"2024-07-16T06:19:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-18T07:58:33Z","title":"WebCanvas: Benchmarking Web Agents in Online Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12373","snapshot_observed_at":"2026-08-07T13:01:23.366902Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.366902Z"},"links":{"cited_paper":"/paper/2406.12373","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:2ff4b158f5a7cd7e8bf39178c904e2312272f9e9c77f9c74f4b40a0f2cdae44a","observation_id":"63dfd185-4092-4c15-997a-74ee35241cf1","resolution":{"observed_at":"2026-08-07T13:01:23.366902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:26.784929Z","title":null,"venue":null,"work_id":"a38f2317-12b6-4bfa-9706-da56ae59a0e7","year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.452456Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:0347c65fc64a2fa20f663853c982c8c84e8452d1d6c36dec0b2e1875fb6ec69a","observation_id":"da49da50-7f77-48e0-8e68-bb3df4780cf2","resolution":{"observed_at":"2026-08-07T13:01:26.840084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13958","last_updated":"2025-04-16T21:45:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-16T21:45:32Z","title":"ToolRL: Reward is All Tool Learning Needs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13958","snapshot_observed_at":"2026-08-07T13:01:23.554145Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.554145Z"},"links":{"cited_paper":"/paper/2504.13958","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:47af14bf1485098bb830c7311cd587ed0733d407bd4b58381afcf81503b78e40","observation_id":"dbc72f20-ca55-4d15-af67-e673b2f1ff4f","resolution":{"observed_at":"2026-08-07T13:01:23.554145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:26.617053Z","title":null,"venue":null,"work_id":"5e1955fe-9c56-41af-b797-279004f1426b","year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.664870Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:b488152a284874d1cccc2b804bf192f3c889e4829acb5ae58516c0300bb0a602","observation_id":"72453d07-1e30-4f0e-8792-46d2b5fe212c","resolution":{"observed_at":"2026-08-07T13:01:26.699032Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T13:01:23.720922Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.720922Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:7970fa7021f5d82e9feadf95d8eb81c5e6baef58357b14ffa6d6520367c60d98","observation_id":"c73efc34-93f3-4204-b6af-ed3bbdee65c8","resolution":{"observed_at":"2026-08-07T13:01:23.720922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-07T13:01:23.800865Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.800865Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:ff37741477e9f7e46f0ea2a51923271462b01d979a0f38d3ebabe6fb8f3e6e24","observation_id":"46d2388d-2d3d-4ce4-bd7b-cc6325a520cb","resolution":{"observed_at":"2026-08-07T13:01:23.800865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T13:01:23.909056Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.909056Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:34ab5b08cb98acd81dd34c703b2aac7c3f5b93f341aa3f12a48b3336e51e893c","observation_id":"02dc13a4-91d7-46d5-aa79-4997c9059013","resolution":{"observed_at":"2026-08-07T13:01:23.909056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:23.985552Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.985552Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:42e0bb23dc00690d7e92b44805bc05a4a524f3d5134afc555e107872f8b0e3d1","observation_id":"6cf7d8cc-a877-4e04-95a5-beb079905529","resolution":{"observed_at":"2026-08-07T13:01:23.985552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:26.405475Z","title":null,"venue":null,"work_id":"d7f889c1-bb9a-4a70-9dd4-fcd3d149f4c7","year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.088216Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:7d954d5759d1ec3127945f8cbd87749d9fb335114a32660cfd1918a6f9a45f2c","observation_id":"6f9d5973-3f37-4027-99f3-391fb6525e4c","resolution":{"observed_at":"2026-08-07T13:01:26.512551Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:26.265363Z","title":null,"venue":null,"work_id":"37d0936e-ce61-43fb-8a61-37633c9e66a1","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.193795Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:5ac6f43c4eac31c9b12246092e362a4495a79fcd62c2b2b87c6379d5f9d35261","observation_id":"3afd9b5f-3988-417f-bb44-1cd1a5b200a8","resolution":{"observed_at":"2026-08-07T13:01:26.316314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:24.249896Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.249896Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:602906c7b0127141b7a00a1927b5838c84d2041e228826b5effadc818c978ad2","observation_id":"8e3605c6-8824-497f-b3e2-91711b2ce922","resolution":{"observed_at":"2026-08-07T13:01:24.249896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20073","last_updated":"2025-05-26T17:19:30Z","snapshot_observed_at":"2026-08-08T11:44:11.313729Z","submitted_at":"2025-04-24T17:57:08Z","title":"RAGEN: Understanding Self-Evolution in LLM Agents via Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20073","snapshot_observed_at":"2026-08-07T13:01:24.323615Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.323615Z"},"links":{"cited_paper":"/paper/2504.20073","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:3f9928146d1e6e8b0f9f3de5769c18a17ece72e1a724be3e43eb12604d4bf0ee","observation_id":"1973b9e9-7deb-4ffe-9ccf-5fb05d9dcecd","resolution":{"observed_at":"2026-08-07T13:01:24.323615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14161","last_updated":"2025-09-10T08:35:19Z","snapshot_observed_at":"2026-08-01T16:27:28.241667Z","submitted_at":"2024-12-18T18:55:40Z","title":"TheAgentCompany: Benchmarking LLM Agents on Consequential Real World Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14161","snapshot_observed_at":"2026-08-07T13:01:24.423383Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.423383Z"},"links":{"cited_paper":"/paper/2412.14161","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:33ce0b72cb82db1417a1fd59e5a08f14170e9e37de02c59a5c469145c7b7dd94","observation_id":"47af6178-9d8f-4070-8a8d-64b8fe54ba03","resolution":{"observed_at":"2026-08-07T13:01:24.423383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T13:01:24.515562Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.515562Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:1382880fd2fd850252f063b5f34edb520aa5d92fa2897337793d1c6faae5ad72","observation_id":"148e3680-84c5-44c1-aba5-a5839a598083","resolution":{"observed_at":"2026-08-07T13:01:24.515562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:24.584038Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.584038Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:8687a42ea3e55da47a04d3d819f5c78d31ecfe8a01111165f4ad40919f76f06f","observation_id":"70230196-de45-4987-ba2e-0feb2d3e5680","resolution":{"observed_at":"2026-08-07T13:01:24.584038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:24.656432Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.656432Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:6a56face6665c306f7db4740b25a4b4bb1e963a1f8a735b08c2a814dbb579dfc","observation_id":"cbafc01e-53ce-4ff1-b7c3-a0d2912c1ecd","resolution":{"observed_at":"2026-08-07T13:01:24.656432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:24.740668Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.740668Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:64a3f08bfa01a25406d14704422a89f7579745b631819ed359363c259e16f7e0","observation_id":"c435f826-8d81-4429-85f1-58a81941880e","resolution":{"observed_at":"2026-08-07T13:01:24.740668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15711","last_updated":"2024-10-21T15:45:31Z","snapshot_observed_at":"2026-08-05T17:32:28.104029Z","submitted_at":"2024-07-22T15:18:45Z","title":"AssistantBench: Can Web Agents Solve Realistic and Time-Consuming Tasks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15711","snapshot_observed_at":"2026-08-07T13:01:24.836115Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.836115Z"},"links":{"cited_paper":"/paper/2407.15711","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:c7d8caa08d722da42b49b1f1ad5d5a28483fa48af61663ba688f7c20f7631445","observation_id":"76fe97b0-2dcd-4329-a6e2-899f652b19cf","resolution":{"observed_at":"2026-08-07T13:01:24.836115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01614","last_updated":"2024-03-12T23:14:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-03T08:33:09Z","title":"GPT-4V(ision) is a Generalist Web Agent, if Grounded","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01614","snapshot_observed_at":"2026-08-07T13:01:24.921010Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.921010Z"},"links":{"cited_paper":"/paper/2401.01614","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:e62129f277c8845a28b0082f53451f2ea12698c0b24c008d6ce9ce70de02ed4f","observation_id":"a9d98500-5871-425b-8269-0adb0b2176f0","resolution":{"observed_at":"2026-08-07T13:01:24.921010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-07T13:01:25.009096Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:25.009096Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:01f949b5fd4c8d2e7c90cb4f99d67ba6339e2961fce3700bf7bbb00c72ac6be0","observation_id":"d1f95386-dd9e-4eb1-a2a0-bc0118ab9296","resolution":{"observed_at":"2026-08-07T13:01:25.009096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:26.043270Z","title":"Rossi, Somdeb Sarkhel, and Chao Zhang","venue":null,"work_id":"e6226967-3ad0-4ab2-be1b-951b571e5ff0","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:25.083595Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:199588d1f7787823ca5a62aa63142be09c5e0681b14c6db1153be8c47ed401e0","observation_id":"d7b712e4-e754-4120-836e-84c908bc680b","resolution":{"observed_at":"2026-08-07T13:01:26.145194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:25.874862Z","title":null,"venue":null,"work_id":"a0faedad-9695-4a45-9796-735122b4999c","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:25.203793Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:ec2d81bd0312e0847fed05a3ec414b1f30a4d5784f74eca8b99d250cd5ddc079","observation_id":"65f17232-ffc7-4b7c-8295-3501c40d7130","resolution":{"observed_at":"2026-08-07T13:01:25.939759Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06589","last_updated":"2025-02-10T15:54:34Z","snapshot_observed_at":"2026-08-08T14:54:47.144621Z","submitted_at":"2025-02-10T15:54:34Z","title":"Hephaestus: Improving Fundamental Agent Capabilities of Large Language Models through Continual Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06589","snapshot_observed_at":"2026-08-07T13:01:25.268734Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:25.268734Z"},"links":{"cited_paper":"/paper/2502.06589","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:431ec3440d1fe63cf8e1e0e6c9004885750a88f86a21ea84c661d5d4d57671bb","observation_id":"99e6c23d-c187-416f-b266-476e79738164","resolution":{"observed_at":"2026-08-07T13:01:25.268734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T12:54:37.846675Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 1 inbound Pith citation observation for arXiv:2505.22942."}