{"as_of":"2026-08-08T22:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e17104ba56df643e9d43cf4e9b96e65bd91efa12b763668f0109038faf36d638","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:47:51.893563Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.01475/citation-record","integrity":"/paper/2506.01475/integrity","json":"/paper/2506.01475/citation-record.json","paper":"/paper/2506.01475"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.960155Z","title":null,"venue":null,"work_id":"36afadaa-4b25-453a-83d7-c09cd6899553","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:00.510118Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:71b1ceae1c0a3773a7c9e4dc7b637868c39fe24e0b9b2338dc3665194475a9ee","observation_id":"a36002a7-5bac-42bd-affb-97ac55fbee3c","resolution":{"observed_at":"2026-08-07T11:48:04.991948Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T11:47:00.567143Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:00.567143Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:bd9c35c46a5589d9835a5b7e2da86c64d7873428c83fba802f90f86aa6ffd9da","observation_id":"622a48e0-de72-472a-a0c6-f43cbd5a0d5a","resolution":{"observed_at":"2026-08-07T11:47:00.567143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.896431Z","title":null,"venue":null,"work_id":"143f2249-7e43-4e69-9e82-a8dbd337a146","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:00.600539Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:8b4dd2e31dfd5335faf7c9dba951e1995d245bfa4e6116bdf034deb3dafc8b46","observation_id":"cdb255ec-c282-429d-b500-d0974b2c4670","resolution":{"observed_at":"2026-08-07T11:48:04.920232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T11:47:00.634668Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:00.634668Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:ed0d80667d25cbb4160b723e4a5edcdeef58f81a11f22854a689512be17ebbd1","observation_id":"09c23844-b8de-457a-8f49-b541a72ad153","resolution":{"observed_at":"2026-08-07T11:47:00.634668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01702","last_updated":"2025-02-24T12:42:14Z","snapshot_observed_at":"2026-08-04T06:57:08.014747Z","submitted_at":"2025-01-03T08:55:19Z","title":"AgentRefine: Enhancing Agent Generalization through Refinement Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01702","snapshot_observed_at":"2026-08-07T11:47:00.667874Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:00.667874Z"},"links":{"cited_paper":"/paper/2501.01702","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:73c6f26d6e81fa0ca5d2d3f4d9f96aa144358f02c067591c79c3bc91557a4060","observation_id":"c9a98375-1970-4930-a02b-426f3af5ff02","resolution":{"observed_at":"2026-08-07T11:47:00.667874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:47:00.702676Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:00.702676Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:7c43deb2055b2f76a96a78a986d0a9a717e2b158027535a46127c32b3cb7e944","observation_id":"d1554dac-de26-4c17-a6d1-f9e56b6d969e","resolution":{"observed_at":"2026-08-07T11:47:00.702676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T11:47:00.747128Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:00.747128Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:7d4607e840331d2ffd00d5d413dc8fca10fcbb33dd44a4e336360d118cac88bb","observation_id":"4f1f6fff-9af9-4d3e-b4ac-53ce6e465792","resolution":{"observed_at":"2026-08-07T11:47:00.747128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02716","last_updated":"2024-02-05T04:25:24Z","snapshot_observed_at":"2026-07-06T17:25:14.115360Z","submitted_at":"2024-02-05T04:25:24Z","title":"Understanding the planning of LLM agents: A survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02716","snapshot_observed_at":"2026-08-07T11:47:00.789154Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:00.789154Z"},"links":{"cited_paper":"/paper/2402.02716","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:681367f279dd06cc3b36450b6cd4783eed47fa07bb2b0bd393f6f0d045148096","observation_id":"2d03f915-c74c-48f6-80cf-1086413519b4","resolution":{"observed_at":"2026-08-07T11:47:00.789154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T11:47:49.031991Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:49.031991Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:49a0ef77cdab24c3be182afe7fabbbeaba5a19149100bf29ba0c7dceea1c3e1b","observation_id":"145139b7-6a41-41b1-83c9-2d07506fb036","resolution":{"observed_at":"2026-08-07T11:47:49.031991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:47:49.594789Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:49.594789Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:f084c7b2ab78eaa264f54628ac3de6008b3a095ab457ff5e0879bf3643ea8198","observation_id":"991364c6-71ba-430b-9574-4ba73a98a6cc","resolution":{"observed_at":"2026-08-07T11:47:49.594789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00798","last_updated":"2024-08-12T17:54:32Z","snapshot_observed_at":"2026-07-06T17:23:51.547578Z","submitted_at":"2024-02-01T17:30:50Z","title":"Formal-LLM: Integrating Formal Language and Natural Language for Controllable LLM-based Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00798","snapshot_observed_at":"2026-08-07T11:47:49.662536Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:49.662536Z"},"links":{"cited_paper":"/paper/2402.00798","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:37ce27effa01a43457b80c09b86d737fb09812ea4a92a1c624a75408d5c33d18","observation_id":"c8cd9652-6ac1-47a8-b7eb-d497f3294b5b","resolution":{"observed_at":"2026-08-07T11:47:49.662536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.855822Z","title":null,"venue":null,"work_id":"b519e94a-bbe8-4094-8e1b-f1ef0dc44a6a","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:49.716341Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:c8fae7a7219812b567ee5b23083c63eb261b24de1a3601f94b76ce28c1e8503a","observation_id":"bdf620be-78d7-460a-8495-b6706a267e70","resolution":{"observed_at":"2026-08-07T11:48:04.863579Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11477","last_updated":"2023-09-27T07:29:44Z","snapshot_observed_at":"2026-08-01T15:58:01.346044Z","submitted_at":"2023-04-22T20:34:03Z","title":"LLM+P: Empowering Large Language Models with Optimal Planning Proficiency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11477","snapshot_observed_at":"2026-08-07T11:47:49.774743Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:49.774743Z"},"links":{"cited_paper":"/paper/2304.11477","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:b8917021059ac9ed342b1acf4e3e38bfc2ee8368c6db79b8c1c671b77e269257","observation_id":"ba4523f0-6713-44a6-b0b7-af57f0cb6422","resolution":{"observed_at":"2026-08-07T11:47:49.774743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05960","last_updated":"2023-08-11T06:37:54Z","snapshot_observed_at":"2026-08-02T20:56:26.359474Z","submitted_at":"2023-08-11T06:37:54Z","title":"BOLAA: Benchmarking and Orchestrating LLM-augmented Autonomous Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05960","snapshot_observed_at":"2026-08-07T11:47:49.833363Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:49.833363Z"},"links":{"cited_paper":"/paper/2308.05960","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:237010b8a79334a0a431c44afdf1ac252ed616b99aebf0f5f4a5f40c2300c356","observation_id":"5af744e2-fe28-4738-b2fc-489e74b80782","resolution":{"observed_at":"2026-08-07T11:47:49.833363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15538","last_updated":"2024-02-23T06:25:20Z","snapshot_observed_at":"2026-08-07T06:06:05.718406Z","submitted_at":"2024-02-23T06:25:20Z","title":"AgentLite: A Lightweight Library for Building and Advancing Task-Oriented LLM Agent System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15538","snapshot_observed_at":"2026-08-07T11:47:49.917199Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:49.917199Z"},"links":{"cited_paper":"/paper/2402.15538","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:1b4ac8c1b04c473cb7ac4d9f99761135796dd3f6ea32e2042ea96cf77828f164","observation_id":"a65dd59a-a1b4-411f-b430-cb9d5ee88428","resolution":{"observed_at":"2026-08-07T11:47:49.917199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.836456Z","title":null,"venue":null,"work_id":"0d1b04bc-5483-4d2a-ac44-92ad4aec402f","year":2023},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:49.986828Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:c6af9a67ae9f1f93c2d157ff968c1e1f20e10518dfa83c5f993bd477c578b442","observation_id":"332c5315-02f6-4918-b037-9877450aa16c","resolution":{"observed_at":"2026-08-07T11:48:04.843640Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19733","last_updated":"2024-06-26T01:28:35Z","snapshot_observed_at":"2026-08-06T12:20:08.657659Z","submitted_at":"2024-04-30T17:28:05Z","title":"Iterative Reasoning Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19733","snapshot_observed_at":"2026-08-07T11:47:50.045904Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.045904Z"},"links":{"cited_paper":"/paper/2404.19733","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:dabaec672a4af6b1c7788b26539daf6f4ec56ddce822f199276497e7e0547298","observation_id":"2e3e4396-081c-46b7-96e1-774db6aa8875","resolution":{"observed_at":"2026-08-07T11:47:50.045904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.811157Z","title":null,"venue":null,"work_id":"4951802a-42ef-4991-8a64-dab594c36222","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.078733Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:a0a431e5ad7bd1a33a5292861312aef31131acac8edd9ac3304b4e55f0e53155","observation_id":"4745af46-8475-4974-8e1f-1c4c094354d4","resolution":{"observed_at":"2026-08-07T11:48:04.820253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.783790Z","title":null,"venue":null,"work_id":"489a6f56-cd32-4ef9-bf58-51b2fc84f468","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.148555Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:e10a5ea69cfadb9d0bd209a2c2fc3e95cc44e5382d05c1e2e916de3c3c6f2677","observation_id":"350e6912-6345-47ef-9f5d-6cac0f3a2371","resolution":{"observed_at":"2026-08-07T11:48:04.793120Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.757997Z","title":null,"venue":null,"work_id":"020ae36e-bdb8-4735-ad34-dbed16e2061a","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.207706Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:0de711c8c8c236a2190efdfe6a9f024479bbca92e62cf821e00b6ac2c6d13e71","observation_id":"5079c6a6-cdb6-41fd-b1ab-9f9ae3cc8a4c","resolution":{"observed_at":"2026-08-07T11:48:04.769821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:47:50.267644Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.267644Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:0dbcbd04e75971f81b63ef587d2798670317cbc19045a9201b810e1a86743a72","observation_id":"931bd661-e97d-4f6f-967b-f24bcb3b0f54","resolution":{"observed_at":"2026-08-07T11:47:50.267644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.725901Z","title":null,"venue":null,"work_id":"32005723-fa34-4762-ac5a-a8cb504067aa","year":2023},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.310634Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:2474a8c23e56477aa1d66898b2a5dc05918684049d02bdfe5cf1c7ffd0eec299","observation_id":"cea3d569-e049-4f60-a72b-a5d4fdeed13b","resolution":{"observed_at":"2026-08-07T11:48:04.736404Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.695695Z","title":null,"venue":null,"work_id":"b09de8e6-a539-4db8-9f25-db157f86524b","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.357062Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:708deb34d86352feaea659e1ea44de78040ae4db4501239acc699e7439396904","observation_id":"73379426-c257-4d6d-af78-5ded0d9fbf6f","resolution":{"observed_at":"2026-08-07T11:48:04.708647Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.665967Z","title":null,"venue":null,"work_id":"28e3b972-4f7c-4371-800e-94ed7d2d2ee7","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.408001Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:40e6024f46581c2cfc9298a7ec6677ac23a12cd2710d7e3273da6b0a53a2d2db","observation_id":"4a9cee47-1aa2-4991-a7b1-7859d5b8e63e","resolution":{"observed_at":"2026-08-07T11:48:04.676944Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:47:50.456516Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.456516Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:fbc7d826cadf133abe84d0f7e16b5756a329ab4ce222f84d6ce56f9bfda1b9d0","observation_id":"64644980-8ae8-475e-abf1-d0179d441fd0","resolution":{"observed_at":"2026-08-07T11:47:50.456516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.620899Z","title":null,"venue":null,"work_id":"7435a3d5-58ae-477e-b48e-8e8bf26246ed","year":2021},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.492430Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:1471e052fdb1d9e1cc0fd5b012509ce8992c250f63af8ecb4ebd6a47855001b2","observation_id":"23f5e70d-6c64-403e-bb6b-de896eb297d7","resolution":{"observed_at":"2026-08-07T11:48:04.629814Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.577153Z","title":null,"venue":null,"work_id":"9174fe79-5015-4583-aea4-7e59316ec57f","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.552291Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:ce6b85bb4ca79fe790c59b550b8a0ee3393ccb418e56fd7695c10d6e51c70cc4","observation_id":"0fb23917-fac1-4484-b599-61a0918d3c2e","resolution":{"observed_at":"2026-08-07T11:48:04.598303Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.535326Z","title":null,"venue":null,"work_id":"e68ef790-0c85-4c56-9699-a75ff9c4fb43","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.586993Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:4cab39a7c6375de31c1d5ad74a2887a04dd16649ed46ae2ba1aa352d41164c9d","observation_id":"16145647-c582-436b-b3d2-29220fe5fe15","resolution":{"observed_at":"2026-08-07T11:48:04.545699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T11:47:50.631039Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.631039Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:f4ebd6350125334303b77f615e95968bc1f470a2a4cf2bc02e97b4b1601c7b38","observation_id":"71e2d4e4-b78d-4a1c-a11b-653df120ae42","resolution":{"observed_at":"2026-08-07T11:47:50.631039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.503597Z","title":null,"venue":null,"work_id":"f139d69c-a5c2-4559-9235-839e27ae40dc","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.667589Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:147bfc5d4bd11bbd3981058e5904d629ca6898852e1eac11fab1355a231f6062","observation_id":"2140e262-1074-482b-af60-d775f7fce3b1","resolution":{"observed_at":"2026-08-07T11:48:04.517420Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.472995Z","title":null,"venue":null,"work_id":"0ffb590f-7196-4bd8-9260-1b0165c5ff62","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.718877Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:9086d2c5b1530b290a4d35c2c476ad72a85adeae3b5ec34822037e5fadbe433e","observation_id":"2446a275-e63f-4c1e-a0a0-90e6b32ed609","resolution":{"observed_at":"2026-08-07T11:48:04.482921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.440254Z","title":null,"venue":null,"work_id":"0307d5c8-2780-448a-a0db-3bdc7288b885","year":2023},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.761020Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:bfba2f28b5378d3ec8dd60efd2f96ace49cb28c9033ad2beadefd9098738c6e5","observation_id":"8e05df81-66a4-4122-be45-da0781c574ff","resolution":{"observed_at":"2026-08-07T11:48:04.454199Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11651","last_updated":"2024-04-16T11:41:13Z","snapshot_observed_at":"2026-07-06T17:31:50.029722Z","submitted_at":"2024-02-18T17:10:07Z","title":"Learning From Failure: Integrating Negative Examples when Fine-tuning Large Language Models as Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11651","snapshot_observed_at":"2026-08-07T11:47:50.812929Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.812929Z"},"links":{"cited_paper":"/paper/2402.11651","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:03cce8253f679a68019b99d635bc06589b238172628e50fb5f57c76c02728547","observation_id":"c4321bbf-c7f3-42b4-90a5-8aca749254dc","resolution":{"observed_at":"2026-08-07T11:47:50.812929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:47:50.865043Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.865043Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:5c49b45effff6acfc0529973c24c24c20db6a605063fe57884637e838f5b0225","observation_id":"850942b7-7b5d-49c8-bca6-142653ce5f88","resolution":{"observed_at":"2026-08-07T11:47:50.865043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.403756Z","title":null,"venue":null,"work_id":"43db8328-6f1d-4b28-8553-9899e57e2f72","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.899805Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:dfcb03e873388530f95e61f2e350271136e47bd68a997448d275f1dc35d93762","observation_id":"427674e7-135b-4c20-add5-a291ce001290","resolution":{"observed_at":"2026-08-07T11:48:04.414023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.374376Z","title":null,"venue":null,"work_id":"d65fbc6b-9527-4f7e-a10c-bcbdf70e1a99","year":2022},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:50.938845Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:01b58e06d7850985c759e2b69ff46d7d46dad385ca576ed885e7121256e06b21","observation_id":"b920b238-47a8-41b8-a720-b299ae11feeb","resolution":{"observed_at":"2026-08-07T11:48:04.386404Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.348892Z","title":null,"venue":null,"work_id":"1d0e2dc7-c9bf-40da-8251-439dfe46d619","year":2025},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.013837Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:3afd6857f8bd6460d7ba8b021ce95db531a9d531b2a516fd7b02211cbd0f9371","observation_id":"d8b74d7d-38b9-4532-b0f1-3b92aad717fa","resolution":{"observed_at":"2026-08-07T11:48:04.359706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:47:51.088342Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.088342Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:ce7a0390f634ab8e0ca40c9610c572c56b99d2ccabed89e1f9b241c0b840061c","observation_id":"6144216c-00b3-4443-bd3b-686053f31473","resolution":{"observed_at":"2026-08-07T11:47:51.088342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04151","last_updated":"2024-06-06T15:15:41Z","snapshot_observed_at":"2026-08-06T10:07:32.780355Z","submitted_at":"2024-06-06T15:15:41Z","title":"AgentGym: Evolving Large Language Model-based Agents across Diverse Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04151","snapshot_observed_at":"2026-08-07T11:47:51.170109Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.170109Z"},"links":{"cited_paper":"/paper/2406.04151","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:e1af6347291189dcb937aca19ffb4bd2e1072c8f85817909659d70c6e9f64c73","observation_id":"a684049a-f95e-4239-8b00-b51f5d2c69a8","resolution":{"observed_at":"2026-08-07T11:47:51.170109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.322397Z","title":null,"venue":null,"work_id":"0aed5f1c-35d5-45b3-8021-612826af3280","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.261249Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:273b3675cc001fdbadb901c0741bc0ee551ffd0ade7a4e3343f3761727009fb2","observation_id":"22913d76-7fc6-4849-b3bc-136441fc9911","resolution":{"observed_at":"2026-08-07T11:48:04.327626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T11:47:51.387390Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.387390Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:98969130812f1b66f8a2e7a8e402529e5dcb341dabb0c51eead25d86ae386dc7","observation_id":"7596d7b1-f3ef-428c-a474-82d1cdf0b5c4","resolution":{"observed_at":"2026-08-07T11:47:51.387390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:48:04.298335Z","title":null,"venue":null,"work_id":"ed82d129-099a-433b-8bf4-fe4bebaeb2f7","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.487455Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:25d2f932e8014842c9bc0331cc5644790047d8c6fc444dd7999fb6208bb58ed0","observation_id":"825e833e-7986-4d95-8019-6472786c8528","resolution":{"observed_at":"2026-08-07T11:48:04.306526Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:47:51.572633Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.572633Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:31d53e0421fdb057282f1e7e4c672d12992b0901d8fe5b1e0e595389e481dbf2","observation_id":"9ceab20c-1743-4f48-b571-657861aa7ba1","resolution":{"observed_at":"2026-08-07T11:47:51.572633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:47:51.659712Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.659712Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:aec83e9cf23e4ea81c49f6f25754abe4a092c27127450a514c2d13d8b165d617","observation_id":"04f4195d-9466-4ca0-941e-56761dc095d6","resolution":{"observed_at":"2026-08-07T11:47:51.659712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:47:51.766466Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.766466Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:0fed6b98bc8151335fa89f7c4a179b477ceb5270c49d617b9329fbf791b548d5","observation_id":"69a5f091-aa01-45de-a69e-8fbe41d9fae7","resolution":{"observed_at":"2026-08-07T11:47:51.766466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:47:52.200998Z","title":null,"venue":null,"work_id":"2fa719f0-d6e0-42c2-9517-c16a33f67d9b","year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.798750Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:a211174b1bf5a52927d8da0b5d946f33fd958638a2f75ab6e887745b7f931267","observation_id":"370278cf-386c-497b-95ca-2d64b6804765","resolution":{"observed_at":"2026-08-07T11:47:52.230431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20560","last_updated":"2025-03-13T06:17:58Z","snapshot_observed_at":"2026-08-02T20:46:33.259801Z","submitted_at":"2024-09-30T17:58:18Z","title":"LaMMA-P: Generalizable Multi-Agent Long-Horizon Task Allocation and Planning with LM-Driven PDDL Planner","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20560","snapshot_observed_at":"2026-08-07T11:47:51.821700Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.821700Z"},"links":{"cited_paper":"/paper/2409.20560","citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:0ad8395373329bac6a07fcc4ad32b797b0d9d3d7c7fb867d7b7528c0ef822925","observation_id":"bf651055-7644-4e73-97af-9589fc132d70","resolution":{"observed_at":"2026-08-07T11:47:51.821700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:47:51.859589Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.859589Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:737d717d3fc2185db392d51c070ae6d956a5991f2d2ecb3da07af4a6b9ae28b3","observation_id":"97feef45-44db-42a5-9660-e46edeba4a60","resolution":{"observed_at":"2026-08-07T11:47:51.859589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:47:51.893563Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T11:47:51.893563Z"},"links":{"citing_paper":"/paper/2506.01475"},"observation_digest":"sha256:93f1f5efc40ef66e8e12417084d09b1c3a52584bae37fea4002cfcf2bd4d506b","observation_id":"deed7873-ab9b-466f-b0bf-db31a38ac115","resolution":{"observed_at":"2026-08-07T11:47:51.893563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.01475","last_updated":"2025-06-02T09:35:07Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T11:37:58.770951Z","submitted_at":"2025-06-02T09:35:07Z","title":"PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2506.01475."}