{"as_of":"2026-08-22T02:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cb0ce13ab063890ae142b37612c2269ee2899fa103d57db529a3e3aaed025e00","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T03:39:48.281017Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13818/citation-record","integrity":"/paper/2607.13818/integrity","json":"/paper/2607.13818/citation-record.json","paper":"/paper/2607.13818"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:45.022205Z","title":"Towards a unified understand- ing of robot manipulation: A comprehensive survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:45.022205Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:ff2eea537fe45c7af10b108ec873083966267676620c014fa390cca07b838cde","observation_id":"3767e646-beb9-4392-86ca-7e4c00f25072","resolution":{"observed_at":"2026-08-02T03:39:45.022205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:45.140452Z","title":"Embodied robot manipulation in the era of foundation models: Planning and learning perspectives,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:45.140452Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:716c7fb4383d0402a2977d7d9fc789c96745154703e575988e232a87040d1912","observation_id":"724d3ed3-be27-4083-bdd7-8a80f6fc4211","resolution":{"observed_at":"2026-08-02T03:39:45.140452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:45.209187Z","title":"Vision- language-action models for robotics: A review towards real-world applications,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:45.209187Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:381f59f7a72aba2264dc4bb76f7ff835389c55e987ff0a6212603fea33c2d1f5","observation_id":"abb27359-4595-4e50-b9f0-d42ae99c61bc","resolution":{"observed_at":"2026-08-02T03:39:45.209187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:45.338025Z","title":"Recoverychaining: Learning local recovery policies for robust ma- nipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:45.338025Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:e400fa8b60a98561f2b004d4d4db464822946783207b4b47d0ed5cb0ea035b49","observation_id":"94f27982-2224-43b3-a19f-c5fbbf03b9ba","resolution":{"observed_at":"2026-08-02T03:39:45.338025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:45.456256Z","title":"Robustvla: Robustness-aware reinforcement post-training for vision-language- action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:45.456256Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:5e881089fb95442a76ab149c99dcc64f66ea185d52f76ea0717fb55fcd747a2e","observation_id":"6f6da89a-4c5c-4ae3-b1af-f3cf3f45681c","resolution":{"observed_at":"2026-08-02T03:39:45.456256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-02T03:39:45.635158Z","title":"Open- vla: An open-source vision-language-action model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:45.635158Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:15211beb66351b19b0852c302d1aeb34dcdd76e77a37b8aded7296e45e39edbb","observation_id":"f2a13fa6-ab7f-443c-8d19-b8edf3376c6a","resolution":{"observed_at":"2026-08-02T03:39:45.635158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:45.784235Z","title":"π 0: A vision-language- action flow model for general robot control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:45.784235Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:5a40fcd0f1d210f7f13138aba0749c107b209e798a7284b2fd41b7a31904dae2","observation_id":"827dbc87-00a5-43a9-8e48-ebd1ea75e54f","resolution":{"observed_at":"2026-08-02T03:39:45.784235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:45.926695Z","title":"π 0.5: a vision-language-action model with open-world generalization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:45.926695Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:150313c9fd69c3cbad9db1730993bcde9085d8e026a4bb00c5717d836d012fe9","observation_id":"f7f19eb7-2bc4-4959-9c9d-d00e71392e63","resolution":{"observed_at":"2026-08-02T03:39:45.926695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23450","last_updated":"2025-06-11T03:16:06Z","snapshot_observed_at":"2026-08-07T12:43:12.816737Z","submitted_at":"2025-05-29T13:56:49Z","title":"Agentic Robot: A Brain-Inspired Framework for Vision-Language-Action Models in Embodied Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23450","snapshot_observed_at":"2026-08-02T03:39:46.108100Z","title":"Agentic robot: A brain-inspired framework for vision-language-action models in embodied agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:46.108100Z"},"links":{"cited_paper":"/paper/2505.23450","citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:9d1cbecd4408dd0bddadea9968e2eb9e42e78e188afdd152a7623324a357e75e","observation_id":"bc029bc7-ec60-4a7f-83a7-c706913c876e","resolution":{"observed_at":"2026-08-02T03:39:46.108100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:46.259196Z","title":"Aha: A vision- language-model for detecting and reasoning over failures in robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:46.259196Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:acea9a7a7f48e0c13453934112d69895f6bb273c0ac219d5d8fb05cba5c40475","observation_id":"76399542-9995-48d4-83e7-514aa6846e90","resolution":{"observed_at":"2026-08-02T03:39:46.259196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:46.418186Z","title":"On the vulnerability of llm/vlm- controlled robotics,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:46.418186Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:09d88f1b0058b81fde8575d6dd0a476076b7ce705838d7e8622d18138978fc8f","observation_id":"cac864c2-e9e8-45ec-918c-6602f4c98a1c","resolution":{"observed_at":"2026-08-02T03:39:46.418186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:46.540049Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:46.540049Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:4a934c29a8028fe93b3fe845a14e5de22724c4c7d1f3aa30db89acd617d70124","observation_id":"ba9781ac-0687-4206-87d6-275bdacbbc38","resolution":{"observed_at":"2026-08-02T03:39:46.540049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:46.693874Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learn- ing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:46.693874Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:bf4fecc0f369f99ab4ee01905692b0f561e6949acc14bf6d470c698bd83a52fb","observation_id":"d4e33be8-b91b-48c0-9485-22585f466522","resolution":{"observed_at":"2026-08-02T03:39:46.693874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:46.845189Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:46.845189Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:0135cb6b63e081ab3f24f36cca48975be4f5ca9873bac7f2ece69314a73ef8f4","observation_id":"0395d4c5-95f9-4c7c-8ab1-c21ee6043007","resolution":{"observed_at":"2026-08-02T03:39:46.845189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-08-20T22:25:56.255434Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-02T03:39:46.967755Z","title":"π ∗ 0.6: a vla that learns from experience,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:46.967755Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:b0e151545cc70d5f87ee9c0a637140dccde297da65418c20b7389ec8d69693c4","observation_id":"c22e6222-044c-4b94-a03a-9ab1c9600a30","resolution":{"observed_at":"2026-08-02T03:39:46.967755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:47.100767Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:47.100767Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:dea2a0aa78cd9c29013f4df2cbe550e4a767c62265e199e41dd5f8a3bd0d889e","observation_id":"d6a2a214-4a97-449d-9547-8a54d2e056fa","resolution":{"observed_at":"2026-08-02T03:39:47.100767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:47.255682Z","title":"Seqvla: Sequential task ex- ecution for long-horizon manipulation with completion-aware vision- language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:47.255682Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:a9b1f648841b68be66b04114565ccae3d1d1308261e50f5a62c0af4a07de1097","observation_id":"0f578976-bc87-4578-b95a-9e51d13bbbdd","resolution":{"observed_at":"2026-08-02T03:39:47.255682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:47.384220Z","title":"Vision language action models in robotic manipulation: A systematic review,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:47.384220Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:d8eccef8abbdac9ea55ed1296e3b43b89409fcbf1b776ae7e72de55a41a66bdb","observation_id":"937859fd-e499-4a74-96d0-e35baec4e70f","resolution":{"observed_at":"2026-08-02T03:39:47.384220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:47.486878Z","title":"Failure-aware rl: Reliable offline-to-online reinforcement learn- ing with self-recovery for real-world manipulation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:47.486878Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:62394af5468f66a7d1a3bebd2758cca04c2d942f9d48dcafea3f8fb086cfb45a","observation_id":"3e7af592-b887-4ab5-a299-f8dce903ae71","resolution":{"observed_at":"2026-08-02T03:39:47.486878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:47.609449Z","title":"Back to the manifold: Recovering from out-of-distribution states,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:47.609449Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:808ab8e968867d2d24f0b75628db91c40d9bdc7fe679eef870e0d1492fea1ebe","observation_id":"ab460b92-191c-40a7-81ad-80d34e53286b","resolution":{"observed_at":"2026-08-02T03:39:47.609449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:47.732767Z","title":"Unpacking failure modes of generative policies: Runtime monitoring of consistency and progress,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:47.732767Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:79a491dac83ab339bfdb4543fe2b5904fc190a38c59a3a9444036aa2d7a550cc","observation_id":"9c8bad8f-6a6a-4a2e-a2c6-d847614b1094","resolution":{"observed_at":"2026-08-02T03:39:47.732767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:47.856479Z","title":"Failure prediction at runtime for generative robot policies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:47.856479Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:5a80f8ba9ab776cac605aed89a35e7b4614352c4b01a0b4987cc4f994a9d56a1","observation_id":"ae609366-9dc7-4e28-bdcb-78b278ca8751","resolution":{"observed_at":"2026-08-02T03:39:47.856479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:48.039028Z","title":"Hierarchical reinforcement learning: A comprehensive survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:48.039028Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:7bc1d573c0debb224b2f6062e0f723b719fc0ce29b652a81718c1e9455654ac4","observation_id":"131f85f1-ba60-4746-84cb-a4fc781b3915","resolution":{"observed_at":"2026-08-02T03:39:48.039028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:39:48.162202Z","title":"Mujoco: A physics engine for model-based control,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:48.162202Z"},"links":{"citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:f4b175c4a2262a128d5f648dead0255c9fa28157c6a6615c779f6467fff79910","observation_id":"ed8a71b1-483b-4e37-a3ad-7df200d595b9","resolution":{"observed_at":"2026-08-02T03:39:48.162202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-02T03:39:48.281017Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T03:39:48.281017Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.13818"},"observation_digest":"sha256:442b0b94bee0ea776b9e8e241bc09723235fdba92b4b73afc5557453df5dba71","observation_id":"b76209a6-03de-4b3f-8a71-6e9915143b37","resolution":{"observed_at":"2026-08-02T03:39:48.281017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13818","last_updated":"2026-07-15T13:25:52Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-13T05:40:23.927550Z","submitted_at":"2026-07-15T13:25:52Z","title":"Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2607.13818."}