{"as_of":"2026-08-14T09:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8dcad2cde0b9773f0caf3957cd87b20ab4ecfadfe1123efb4e7f259c0d3e0c6c","coverage":[{"denominator":104,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T12:37:32.329030Z","state":"measured"},{"denominator":105,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":105,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T23:45:52.409766Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-08T02:44:27.670188Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"cited_work":{"arxiv_id":"2601.02295","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.02295","snapshot_observed_at":"2026-07-29T02:25:11.162934Z","title":"Cyclevla: Proactive self-correcting vision-language-action models via subtask backtracking and minimum bayes risk decoding.arXiv preprint arXiv:2601.02295, 2026","venue":null,"work_id":"8b49cf01-3abc-42c1-9664-3bf71b49f37d","year":2026},"citing_paper":{"arxiv_id":"2606.09740","last_updated":"2026-06-08T17:04:24Z","snapshot_observed_at":"2026-07-31T12:06:21.028418Z","submitted_at":"2026-06-08T17:04:24Z","title":"ProbeAct: Probe-Guided Training-Free Failure Recovery in Vision-Language-Action Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T16:33:12.726814Z"},"links":{"cited_paper":"/paper/2601.02295","citing_paper":"/paper/2606.09740"},"observation_digest":"sha256:5b0eed147677cc6e739db16c42f5d70436bd33c383ec7d79e431fab25a1765e2","observation_id":"2438ed09-6ee0-4afd-8803-180bbd334125","resolution":{"observed_at":"2026-07-29T02:25:11.162934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"cited_work":{"arxiv_id":"2601.02295","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.02295","snapshot_observed_at":"2026-07-29T02:25:11.162934Z","title":"Cyclevla: Proactive self-correcting vision-language-action models via subtask backtracking and minimum bayes risk decoding.arXiv preprint arXiv:2601.02295, 2026","venue":null,"work_id":"8b49cf01-3abc-42c1-9664-3bf71b49f37d","year":2026},"citing_paper":{"arxiv_id":"2606.21386","last_updated":"2026-06-19T12:51:21Z","snapshot_observed_at":"2026-08-01T15:33:46.435054Z","submitted_at":"2026-06-19T12:51:21Z","title":"VLA-FAIL: Efficient Task Failure Detection for Finetuned Vision-Language-Action Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T14:57:41.592627Z"},"links":{"cited_paper":"/paper/2601.02295","citing_paper":"/paper/2606.21386"},"observation_digest":"sha256:7c2c55dad67b8aa17a01edd541f4276f31d8128acd5737829f594d018d54f3f2","observation_id":"79e49fea-f65e-4e52-80f2-8b2a9735e27e","resolution":{"observed_at":"2026-07-29T02:25:11.162934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"cited_work":{"arxiv_id":"2601.02295","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.02295","snapshot_observed_at":"2026-07-29T02:25:11.162934Z","title":"Cyclevla: Proactive self-correcting vision-language-action models via subtask backtracking and minimum bayes risk decoding.arXiv preprint arXiv:2601.02295, 2026","venue":null,"work_id":"8b49cf01-3abc-42c1-9664-3bf71b49f37d","year":2026},"citing_paper":{"arxiv_id":"2607.01212","last_updated":"2026-07-01T17:51:21Z","snapshot_observed_at":"2026-08-12T16:28:18.548460Z","submitted_at":"2026-07-01T17:51:21Z","title":"FurnitureVLA: Learning Long-Horizon Bimanual Furniture Assembly with Vision-Language-Action Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-02T10:50:11.153980Z"},"links":{"cited_paper":"/paper/2601.02295","citing_paper":"/paper/2607.01212"},"observation_digest":"sha256:3e961f345ae69c5dc8db96aad83703b519f240246c0504c9c81a679bb24e642d","observation_id":"9e46eeef-0426-42a0-aac8-bb8ac2c9d781","resolution":{"observed_at":"2026-07-29T02:25:11.162934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"cited_work":{"arxiv_id":"2601.02295","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.02295","snapshot_observed_at":"2026-07-29T02:25:11.162934Z","title":"Cyclevla: Proactive self-correcting vision-language-action models via subtask backtracking and minimum bayes risk decoding.arXiv preprint arXiv:2601.02295, 2026","venue":null,"work_id":"8b49cf01-3abc-42c1-9664-3bf71b49f37d","year":2026},"citing_paper":{"arxiv_id":"2607.06534","last_updated":"2026-07-13T03:52:19Z","snapshot_observed_at":"2026-07-16T23:18:47.677814Z","submitted_at":"2026-07-07T17:39:41Z","title":"CAIRN: Cross-Room 3D Scene Understanding with Topology-Aware Large Multimodal Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-08T02:44:00.608590Z"},"links":{"cited_paper":"/paper/2601.02295","citing_paper":"/paper/2607.06534"},"observation_digest":"sha256:29a18f157681c5d45b515ca0178f73786cc6bea9f286cedf04a5fbeb93c943fa","observation_id":"df713324-803e-446c-ba33-7525b4e3fe36","resolution":{"observed_at":"2026-07-29T02:25:11.162934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.02295","snapshot_observed_at":"2026-07-31T23:45:52.409766Z","title":"Cyclevla: Proactive self-correcting vision-language-action models via subtask backtracking and minimum bayes risk decoding,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27881","last_updated":"2026-07-30T08:55:45Z","snapshot_observed_at":"2026-08-08T16:04:47.593576Z","submitted_at":"2026-07-30T08:55:45Z","title":"RoboBRIDGE: A Modular Framework for Bridging Policies to Robust Real-World Robotic Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T23:45:52.409766Z"},"links":{"cited_paper":"/paper/2601.02295","citing_paper":"/paper/2607.27881"},"observation_digest":"sha256:281091861a29abe3128080fdef53cd12a2f21a1661b59a2937b9b6ce61914190","observation_id":"58072049-ed52-4ebb-b37f-b7a51439cd98","resolution":{"observed_at":"2026-07-31T23:45:52.409766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2601.02295/citation-record","integrity":"/paper/2601.02295/integrity","json":"/paper/2601.02295/citation-record.json","paper":"/paper/2601.02295"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:22.864667Z","title":"When to ask for help: Proactive interventions in autonomous reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:22.864667Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:d32b4fa825b54ffaa60ae0627f9a52746a5bf27bf59548ab72f26db82d6529db","observation_id":"96f48573-c433-4c31-a281-849e42228fdb","resolution":{"observed_at":"2026-08-03T12:37:22.864667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:22.953709Z","title":"Failure prediction with statistical guarantees for vision-based robot control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:22.953709Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:82034ce052a3422a7791ee09f044d4243d7099922ec289240b5162e0ad44a742","observation_id":"ccda861d-95e4-49dc-8184-610fd8b1b4fd","resolution":{"observed_at":"2026-08-03T12:37:22.953709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:23.061244Z","title":"Vision-language models as success detectors,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:23.061244Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:5589671dc30f57155bcee62c97505cd7c6882d45f3ca238c0c75412d7d8cbe2e","observation_id":"1c435bde-f4fb-4b78-81c8-0ef6d09ae403","resolution":{"observed_at":"2026-08-03T12:37:23.061244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:23.185112Z","title":"Asking for help: Failure prediction in behavioral cloning through value approximation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:23.185112Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:b86d99642638ae75b0d1379384c19d7ee0cfe2ce04df3188cbf5767bc1ef5037","observation_id":"0a8f5214-31b0-48d5-b0b0-d28a85096fad","resolution":{"observed_at":"2026-08-03T12:37:23.185112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:23.317551Z","title":"Unpacking failure modes of generative policies: Runtime monitoring of consistency and progress,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:23.317551Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:b5bf2b998f9eaf99436cbd636591bbd0ab4d9b83afeaf8158a74abc24500081d","observation_id":"655e1a2d-096e-4771-8523-100e285e6c8d","resolution":{"observed_at":"2026-08-03T12:37:23.317551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:23.428232Z","title":"Grounding multimodal llms to embodied agents that ask for help with reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:23.428232Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:b08734e387c26254c7031f62ee9d8a9e539e3527b26619f565fad3bc943d2e55","observation_id":"79164fe1-2548-49ff-90d4-6c00422129ea","resolution":{"observed_at":"2026-08-03T12:37:23.428232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:23.569760Z","title":"Collabvla: Self-reflective vision-language-action model dreaming together with human,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:23.569760Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:e44dfb6d62431af0f5519753b267abd68e8007931b09344fcff324d7e4b856ed","observation_id":"ef762909-3c6c-4489-8971-46511cb49a76","resolution":{"observed_at":"2026-08-03T12:37:23.569760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:23.699365Z","title":"SAFE: multitask failure detection for vision-language- action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:23.699365Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:332d883c4c8427e399f31129dcbfcc027af2b5f9850b0eefa63fb881edb8d70b","observation_id":"82631a19-59a6-4170-8b0b-1a15e8616e2c","resolution":{"observed_at":"2026-08-03T12:37:23.699365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:23.760109Z","title":"REFLECT: summarizing robot experiences for failure explanation and correction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:23.760109Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:6267f73b433fe38dee429e2ba550e365fa5121f08177ae3df5becffb9004a93f","observation_id":"67001071-9029-4d53-9885-380c91798d56","resolution":{"observed_at":"2026-08-03T12:37:23.760109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:23.869501Z","title":"AHA: A vision- language-model for detecting and reasoning over failures in robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:23.869501Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:7a42f28a97bfe58cd31700ef39e736adb4e4d72019db81f57b15b1e8ffc68fe5","observation_id":"3c439392-90b9-4d5c-bdbe-9759227bb9e6","resolution":{"observed_at":"2026-08-03T12:37:23.869501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:23.971198Z","title":"KitchenVLA: Iterative vision-language corrections for robotic execution of human tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:23.971198Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:f3010e6459ee46edb470f38cce1110910519484a67d722e7da55aa9e2d7a58db","observation_id":"1cde713b-456c-4a88-a05a-c274a350b924","resolution":{"observed_at":"2026-08-03T12:37:23.971198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06060","last_updated":"2025-03-08T05:05:21Z","snapshot_observed_at":"2026-08-07T17:20:42.524747Z","submitted_at":"2025-03-08T05:05:21Z","title":"STAR: A Foundation Model-driven Framework for Robust Task Planning and Failure Recovery in Robotic Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06060","snapshot_observed_at":"2026-08-03T12:37:24.054453Z","title":"STAR: A foundation model-driven framework for robust task planning and failure recovery in robotic systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:24.054453Z"},"links":{"cited_paper":"/paper/2503.06060","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:629ddd9b15466c073fd12b868e27d0c4e7a096197e41de44e60a88dad4bff825","observation_id":"ed39aa5b-d2de-46cb-8ad7-7366ba905e32","resolution":{"observed_at":"2026-08-03T12:37:24.054453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:24.145374Z","title":"Openvla: An open-source vision-language-action model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:24.145374Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:e228fe9033b3ed46f9592024f8a685a034fca18b653c5a023eeeb3bb94a4bd77","observation_id":"4d06b377-2bd0-4655-b5ed-efa8e076c8fb","resolution":{"observed_at":"2026-08-03T12:37:24.145374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-03T12:37:24.298121Z","title":"π0: A vision-language-action flow model for general robot control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:24.298121Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:c30b28f786b70596667431b5c899114921c710088bef1010b60e1a820733a869","observation_id":"078e7b48-c4e7-4fdd-ab3b-7f8db8b30b2b","resolution":{"observed_at":"2026-08-03T12:37:24.298121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-03T12:37:24.371572Z","title":"GR00T N1: an open foundation model for generalist humanoid robots,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:24.371572Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:2e60c097b2759fa2024c372e8db82bf3de81130a9f46fb553849a48128f901ff","observation_id":"815aa5bd-c3f8-494e-a2fc-25a6ab02e8c5","resolution":{"observed_at":"2026-08-03T12:37:24.371572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:24.487678Z","title":"Policy adaptation via language optimization: Decomposing tasks for few-shot imitation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:24.487678Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:cd5d16bbc62f880db55b422098e0be9be44e65d0b1d0fc299f6c3fb92e8ea6cf","observation_id":"51d84c37-003a-417d-8320-3a1d8cb2da01","resolution":{"observed_at":"2026-08-03T12:37:24.487678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-03T12:37:24.605491Z","title":"π0.5: a vision-language-action model with open-world generalization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:24.605491Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:39bc425ce3de47370b207a69fc82d94e3185a780811e394dd5a4ba43afbc590e","observation_id":"5d3eeb53-4de4-49ff-9163-060000a59307","resolution":{"observed_at":"2026-08-03T12:37:24.605491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:24.725101Z","title":"Hi robot: Open-ended instruction following with hierarchical vision-language-action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:24.725101Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:41718952d74f6d381f035c667832293818c8a1a4500e57f30fee4aed9cec865f","observation_id":"99454dcb-ff29-4dda-a87e-4b7beabcaf7e","resolution":{"observed_at":"2026-08-03T12:37:24.725101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:24.810205Z","title":"Seqvla: Sequential task execution for long-horizon manipulation with completion-aware vision- language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:24.810205Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:9aefc04baa505608f4afcd8d5f721bb4e4e63773a8ecb9ba65b6ab48a72c5815","observation_id":"4d8e0e91-6c78-4c10-809b-a51bf2550e45","resolution":{"observed_at":"2026-08-03T12:37:24.810205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:24.887046Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:24.887046Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:56d3241ea1959dc553c397f1812029f3897fbc23c72cba490a9e53a824955055","observation_id":"2093ad69-9815-4508-9db8-7a151e05fa6e","resolution":{"observed_at":"2026-08-03T12:37:24.887046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:25.085810Z","title":"Tactical rewind: Self-correction via backtracking in vision-and-language navigation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:25.085810Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:c49b9dbc2637d5a3a3d79e16727c55d2d18c513c7b88376a59a1d53c3c9fbd8e","observation_id":"271fab47-90b6-4bd2-b194-61138e8992a7","resolution":{"observed_at":"2026-08-03T12:37:25.085810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:25.262173Z","title":"Smartway: Enhanced waypoint prediction and backtracking for zero- shot vision-and-language navigation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:25.262173Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:5b68b6604c0cc8b4758bd59d5b983a857db87141da7822be841d08eda73ed161","observation_id":"a3a5e0bd-a4b9-4f8f-b1ba-059d0c850fad","resolution":{"observed_at":"2026-08-03T12:37:25.262173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15917","last_updated":"2024-06-22T18:57:37Z","snapshot_observed_at":"2026-08-12T23:36:55.012185Z","submitted_at":"2024-06-22T18:57:37Z","title":"To Err is Robotic: Rapid Value-Based Trial-and-Error during Deployment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15917","snapshot_observed_at":"2026-08-03T12:37:25.424813Z","title":"To err is robotic: Rapid value-based trial-and-error during deployment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:25.424813Z"},"links":{"cited_paper":"/paper/2406.15917","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:27f4a2b327c9bc1bc94ca43ad0b1618751ad752cb7a8d0a2fa361db6a23e79a2","observation_id":"0a2c4195-af2c-42dd-b2a1-ddffdf74ec3f","resolution":{"observed_at":"2026-08-03T12:37:25.424813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-03T12:37:25.533473Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:25.533473Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:df6b51d982645bc2e3e62023892bb3a7a06f14119a564a1e2a5c24445d321e7d","observation_id":"c4a529fe-d812-40db-8539-4ed5cae8289b","resolution":{"observed_at":"2026-08-03T12:37:25.533473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:25.648613Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:25.648613Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:15574db1b4b081a9dc5096cdfc628b6a5fbda09482f933c2cb7a3b7392edae36","observation_id":"f88235a8-9b70-4c05-990f-17976cfa1d8a","resolution":{"observed_at":"2026-08-03T12:37:25.648613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:25.776044Z","title":"Spatialpin: Enhancing spatial reasoning capabilities of vision-language models through prompting and interacting 3d priors,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:25.776044Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:d69b43a2e8d26a588974580339fe9ac5c5bc36996931c572f48c1607f11672c4","observation_id":"fa042d40-abe6-4ac5-a668-85bc52545051","resolution":{"observed_at":"2026-08-03T12:37:25.776044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:25.913888Z","title":"Touch and go: Learning from human-collected vision and touch,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:25.913888Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:c6dd2595b09a8cef1fafa8b7340cf3b19bc460d9180d6ad80e44856e244cd4cc","observation_id":"d93636d1-09b8-4bd6-be76-d5f4553d09ec","resolution":{"observed_at":"2026-08-03T12:37:25.913888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:26.035947Z","title":"Improved baselines with visual instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:26.035947Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:bbe5e91ff0c3bd7567fb5b0e57f9a3f86570f84d9d16bf8f64456a3b21518309","observation_id":"9d52b9b1-a4ef-4eea-b52e-6443080e9c3b","resolution":{"observed_at":"2026-08-03T12:37:26.035947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:26.114491Z","title":"Minimum bayes-risk decoding for statistical machine translation,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:26.114491Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:d93870666d32f510c0bad63edbd51ee4f337d79f3f3865e9545ea1475fc329b0","observation_id":"ab1cd4d3-1510-49ae-b69a-21ef4dc34909","resolution":{"observed_at":"2026-08-03T12:37:26.114491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:26.201978Z","title":"Open x-embodiment: Robotic learning datasets and RT-X models : Open x-embodiment collaboration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:26.201978Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:4317a985947203e96411cef29c46744c299a1651547209293d11c17751254f4f","observation_id":"a1c5f06e-d6db-43d4-a858-1e28ddb12a16","resolution":{"observed_at":"2026-08-03T12:37:26.201978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:26.369692Z","title":"RDT-1B: a diffusion foundation model for bimanual manip- ulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:26.369692Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:81a74f69db7b14e17e01e4a7b3689be5f0200f979d313ef345e9f9171f907b74","observation_id":"16eea73a-f9e1-4201-98c3-2d480f7a9844","resolution":{"observed_at":"2026-08-03T12:37:26.369692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:26.520585Z","title":"Robomonkey: Scaling test-time sampling and veri- fication for vision-language-action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:26.520585Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:d46d8972fc057e13b95c9a1c415817b505f6678e8fe899d3c17948f318fdb47b","observation_id":"976c9c12-aeab-4702-ab6d-c72d38a3c96b","resolution":{"observed_at":"2026-08-03T12:37:26.520585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:26.646009Z","title":"Rover: Robot reward model as test-time verifier for vision- language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:26.646009Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:0113ed2f94601e3431ef4946c6da51ae07eae429220ff5427a13ed84f3fcdb94","observation_id":"ee316041-b288-4ee6-b8be-d3535732d5c9","resolution":{"observed_at":"2026-08-03T12:37:26.646009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:26.737561Z","title":"Sampling-based approximations to minimum bayes risk decoding for neural machine translation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:26.737561Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:8180b4c47244b0899c61c7c1bb580f388368140cf66c20cea20c37f78b750661","observation_id":"524dfbd5-fb45-429f-a8db-f3a49ba13001","resolution":{"observed_at":"2026-08-03T12:37:26.737561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:26.872170Z","title":"On extending direct preference optimization to accommodate ties,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:26.872170Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:38c247714b645237b40f763e9a66231e42712a8af80c96a41f6b9861f8325116","observation_id":"a92712b9-f722-4f6a-a88f-44a1cb779766","resolution":{"observed_at":"2026-08-03T12:37:26.872170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:26.987996Z","title":"Direct preference optimization for neural machine translation with minimum bayes risk decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:26.987996Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:7d12e0b7fdceff17837a50fcb6b9180955b98f2d1ef1557942a1b6c82d031823","observation_id":"0fb963ff-24c1-4edd-be22-d575d2551317","resolution":{"observed_at":"2026-08-03T12:37:26.987996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08558","last_updated":"2025-06-20T05:51:24Z","snapshot_observed_at":"2026-08-13T18:44:40.463152Z","submitted_at":"2025-03-11T15:47:12Z","title":"Can We Detect Failures Without Failure Data? Uncertainty-Aware Runtime Failure Detection for Imitation Learning Policies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08558","snapshot_observed_at":"2026-08-03T12:37:27.032739Z","title":"Can we detect failures without failure data? uncertainty-aware runtime failure detection for imitation learning policies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:27.032739Z"},"links":{"cited_paper":"/paper/2503.08558","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:1c1f2ce7483d19281bfcb76597109f5aa1e32742c7c8f542993e826521f68879","observation_id":"705bcd79-6b3b-4464-8987-ad77eba0a37a","resolution":{"observed_at":"2026-08-03T12:37:27.032739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:27.105629Z","title":"Sparse and complete latent organization for geospatial semantic segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:27.105629Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:1eb884c90f981ff32ef8e2cda956d4076600921611e9d5dc9b4f348dede2e4d6","observation_id":"98337625-6bd8-4b96-be8e-a0e5d2eb1a75","resolution":{"observed_at":"2026-08-03T12:37:27.105629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:27.157681Z","title":"Error-aware imitation learning from teleopera- tion data for mobile manipulation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:27.157681Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:2a159c58988c07bb451337b0e13d114e810890a97130903a8b7bc002c825925c","observation_id":"8ec3bd44-8ef5-4001-969d-ae72b918ffbd","resolution":{"observed_at":"2026-08-03T12:37:27.157681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:27.225844Z","title":"Model-based runtime monitoring with interactive imitation learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:27.225844Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:69750dee7f8371d51b50fd0c5d7901836f7139e8416162ce25c3397f41e05bf6","observation_id":"aa9cf348-b02b-4ed3-98bf-11b912367380","resolution":{"observed_at":"2026-08-03T12:37:27.225844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:27.333690Z","title":"Real-time anomaly detection and reactive planning with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:27.333690Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:42a83998cbf6f9b5491b83c4b8ade315eb72abdbc7c203ca62bde613a2bdc3eb","observation_id":"0e7b5b6a-ae50-4d31-b72f-192b3c3392df","resolution":{"observed_at":"2026-08-03T12:37:27.333690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:27.426730Z","title":"Doremi: Grounding language model by detecting and recovering from plan-execution misalignment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:27.426730Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:54ee1ba75716e4c2a847aac316cb01204f7ac5b29a150f0d488e5ff06e32415d","observation_id":"a21f5357-0cb7-4a1e-b18d-aae771efba03","resolution":{"observed_at":"2026-08-03T12:37:27.426730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17418","last_updated":"2025-03-19T03:55:48Z","snapshot_observed_at":"2026-08-12T23:56:51.467364Z","submitted_at":"2024-05-27T17:58:48Z","title":"A Self-Correcting Vision-Language-Action Model for Fast and Slow System Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17418","snapshot_observed_at":"2026-08-03T12:37:27.492757Z","title":"A self-correcting vision-language- action model for fast and slow system manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:27.492757Z"},"links":{"cited_paper":"/paper/2405.17418","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:dd06b11c3ea8e2446bcb3d614c8a2b5ba3f1489be9a3fc3afdb8a643280967d5","observation_id":"f6d0d885-b373-4912-8df6-9478e458394b","resolution":{"observed_at":"2026-08-03T12:37:27.492757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:27.596185Z","title":"Coopera: Continual open-ended human-robot assistance,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:27.596185Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:ee5c1fc4a4f38c29a0e28730018ee515344cafa0a8f1119a145d334b517346bf","observation_id":"e019a7b2-47ce-4726-9d2d-3aeecdf827df","resolution":{"observed_at":"2026-08-03T12:37:27.596185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:27.706608Z","title":"Multi-task interactive robot fleet learning with visual world models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:27.706608Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:211d363257bb9a15323e927b3ddc9797ec1fbf3c8dc86838d313691a0f28408a","observation_id":"9ce73146-8ceb-4c0e-9a88-df5f5ecf1c66","resolution":{"observed_at":"2026-08-03T12:37:27.706608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:27.779470Z","title":"Cot-vla: Visual chain-of-thought reasoning for vision-language-action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:27.779470Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:50d0f24c46309d2e4d83511ce89e644abe1a1a74c6ffa79381f98fad1c34c31e","observation_id":"a1e96a8a-6849-488d-8b6e-afb9db4c2b8b","resolution":{"observed_at":"2026-08-03T12:37:27.779470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16707","last_updated":"2025-02-23T20:42:15Z","snapshot_observed_at":"2026-08-11T01:14:45.608554Z","submitted_at":"2025-02-23T20:42:15Z","title":"Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16707","snapshot_observed_at":"2026-08-03T12:37:27.872949Z","title":"Reflective planning: Vision-language models for multi-stage long-horizon robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:27.872949Z"},"links":{"cited_paper":"/paper/2502.16707","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:e36278c98ed437e5b4d369a0c146fffacefdb2b5dc291ab450ab5f02acc616ff","observation_id":"da86f2f4-a9b6-4b5c-8c55-9474ab349eaf","resolution":{"observed_at":"2026-08-03T12:37:27.872949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-03T12:37:27.943411Z","title":"V-JEPA 2: Self-supervised video models enable understanding, prediction and planning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:27.943411Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:e4e78ad4dc09b8f9488fc6a1fcc4e82909a9e85c670fb990f8dcb9ef58525069","observation_id":"8bc65591-6b88-4c89-bb64-14a49b14b01e","resolution":{"observed_at":"2026-08-03T12:37:27.943411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:28.031346Z","title":"Dexvla: Vision- language model with plug-in diffusion expert for general robot control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.031346Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:10522c308c0423103d66a78dfd00858e876074aa60dc6beec3204097f501857f","observation_id":"c3bda5fc-c336-4bdd-9ab7-3ba3d20f00b8","resolution":{"observed_at":"2026-08-03T12:37:28.031346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:28.136773Z","title":"RDD: retrieval-based demon- stration decomposer for planner alignment in long-horizon tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.136773Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:f0134ed485635c6cc049a2afd352d6115b785712e53cc92f19b140f8d214e831","observation_id":"73daf7b2-729a-466c-8479-517b2077b1b2","resolution":{"observed_at":"2026-08-03T12:37:28.136773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:28.209976Z","title":"Robotic control via embodied chain-of-thought reasoning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.209976Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:3a654e9246b25f640c3741a20859d40c84035fba1f4f4177a03d942b6010b66e","observation_id":"9a1b8050-a274-4180-bfc6-f6028450e9bd","resolution":{"observed_at":"2026-08-03T12:37:28.209976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:28.283583Z","title":"Chatvla: Unified multimodal understanding and robot control with vision-language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.283583Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:da456df5879aafb54627cfb26f305a1d16dc7ec185cebbde3f5db029e7bf7af8","observation_id":"fc0c5f7c-7bd3-4a95-ba2c-42dae6313373","resolution":{"observed_at":"2026-08-03T12:37:28.283583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:28.345828Z","title":"Chatvla-2: Vision- language-action model with open-world embodied reasoning from pretrained knowledge,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.345828Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:40dd17cb637a2c441ade757a760dfa7c6b667b184f70890f9652ea6ab27a01ae","observation_id":"79570ca6-6242-4afd-b246-3b907d6d36e9","resolution":{"observed_at":"2026-08-03T12:37:28.345828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:28.427720Z","title":"Training strategies for efficient embodied reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.427720Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:7e636b69d9e787819e02462fe00e57e8b4b56c32c5305f520cf82f4ab6a9fda8","observation_id":"ea16e8f3-8e4b-49ae-b335-dc2b028b125a","resolution":{"observed_at":"2026-08-03T12:37:28.427720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00062","last_updated":"2026-02-24T21:52:50Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-10-28T22:44:13Z","title":"World Simulation with Video Foundation Models for Physical AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.00062","snapshot_observed_at":"2026-08-03T12:37:28.494262Z","title":"World simulation with video foundation models for physical ai,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.494262Z"},"links":{"cited_paper":"/paper/2511.00062","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:3fe24ec716df417b839f0630918027c964d4f5fb73d8a3ceaa7a652e6effbaf3","observation_id":"0110820c-4239-499e-a7bd-9fce4a723f27","resolution":{"observed_at":"2026-08-03T12:37:28.494262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:28.604796Z","title":"Run-time observation interventions make vision-language-action models more visually robust,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.604796Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:ba315c74d0d437c304a72c749c134218216d0ba02776f62284298ffca8441f8e","observation_id":"1eb593a2-43c0-4761-a5df-1ddf8e9c6f03","resolution":{"observed_at":"2026-08-03T12:37:28.604796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:28.658649Z","title":"IA-VLA: input augmentation for vision-language-action models in settings with semantically complex tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.658649Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:c0791da7608c779f457382b0ca5f3b41e26d7709070966dd813d1a31739831a7","observation_id":"41ca8958-0f7c-4feb-b1a0-d1f785f762f8","resolution":{"observed_at":"2026-08-03T12:37:28.658649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:28.735440Z","title":"Visual prompting via image inpainting,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.735440Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:0e85ffa89af34d22816d7dcb9b57377e3386d3836d4d71281097ce8ed590d885","observation_id":"784584c4-eb2f-4f1f-9d40-1459397462fc","resolution":{"observed_at":"2026-08-03T12:37:28.735440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:28.824172Z","title":"Scaling LLM test-time compute optimally can be more effective than scaling model parameters,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.824172Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:62c7c61752a43efc0b260112fd4b26a92d768c4bc4596908c2d094fed1c314c6","observation_id":"22945ce7-6fd1-4ad1-8d47-23e65e959c48","resolution":{"observed_at":"2026-08-03T12:37:28.824172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-03T12:37:28.878438Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.878438Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:4e961c1585b9e25559e7f3280b383a08a502d190ffda873fdb52c9821ec04536","observation_id":"e8d7d9e5-ee13-4185-ace0-9db6fc21e592","resolution":{"observed_at":"2026-08-03T12:37:28.878438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:28.971371Z","title":"Introducing openai o3 and o4-mini,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:28.971371Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:45d401e36fec8aa2be4b4b02954fafb364e696194e6b328bdf48ba7e6eaabd94","observation_id":"8919c781-7dd2-475d-abb2-17aaeda0d1af","resolution":{"observed_at":"2026-08-03T12:37:28.971371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:29.035874Z","title":"Steering your generalists: Improving robotic foundation models via value guidance,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:29.035874Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:89778123c1a9753fb60dcccafe224a3eb6f13c79acc8e65da57b7efd51f4dfad","observation_id":"2f4b63f3-7cf5-4162-bbab-9aa18fca234d","resolution":{"observed_at":"2026-08-03T12:37:29.035874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:29.131212Z","title":"Navid: Video-based VLM plans the next step for vision-and-language navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:29.131212Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:794c2a76c557d0310e16b959799a6bb6de2b7450a942388a78349bfa6808737e","observation_id":"c5f82710-3f22-4662-baea-5ecf408120c3","resolution":{"observed_at":"2026-08-03T12:37:29.131212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:29.205893Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:29.205893Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:e9e19e71696134ed292b6d29adce8751e2c00835c542f2649834e2fd3f4c75d3","observation_id":"d9a2b2f8-5784-477c-8ea3-819f69c592ea","resolution":{"observed_at":"2026-08-03T12:37:29.205893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:29.278433Z","title":"Introducing gpt-4.1 in the api,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:29.278433Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:3df3b4f32c11590bb3dff6aefd07c8093d6a259a8e6cacbc96654cb15908f698","observation_id":"0e5c60f0-8c0e-4b38-9e20-e1494264d24d","resolution":{"observed_at":"2026-08-03T12:37:29.278433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:29.348086Z","title":"Fine-tuning vision-language-action models: Optimizing speed and success,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:29.348086Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:e44c15b9667a639074485c7d722125bf1ff467b626abfe43221facc41f5fbfc9","observation_id":"fa34edf2-392f-4d1b-85f4-e60a579a3c5a","resolution":{"observed_at":"2026-08-03T12:37:29.348086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:29.452465Z","title":"Introducing gpt-5.2,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:29.452465Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:f7e738fe22c7390aa88a9e1315184c5a3c0ba27bc085cf8bd5858df8dc553f85","observation_id":"d3bee82f-4be7-426c-9702-cdd3972c046d","resolution":{"observed_at":"2026-08-03T12:37:29.452465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:29.530462Z","title":"LIBERO: benchmarking knowledge transfer for lifelong robot learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:29.530462Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:80d4799d584a9f1fac6afe63c0442f72636823e1f8903e26b8f048e40c361e49","observation_id":"3fd9eff5-7866-4cb7-b24f-231e4b7a66d0","resolution":{"observed_at":"2026-08-03T12:37:29.530462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:29.577126Z","title":"Tracevla: Visual trace prompting enhances spatial- temporal awareness for generalist robotic policies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:29.577126Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:c3ab454fe7c31e3ead45d3783a04badeaf72c25491658e9b78ea66354c9781b9","observation_id":"7bb66f5c-50b7-4dfe-9d75-ba55a97de23f","resolution":{"observed_at":"2026-08-03T12:37:29.577126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:29.673550Z","title":"Thinkact: Vision-language-action reasoning via reinforced visual latent planning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:29.673550Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:a734014ab9408fa7b447a54e6ee5d6350384cc5e4212a18f5769c0a0c1845f70","observation_id":"055c64ed-8d24-416a-931c-29fe51fed4a1","resolution":{"observed_at":"2026-08-03T12:37:29.673550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:29.729978Z","title":"FPC-VLA: A vision-language-action framework with a supervisor for failure prediction and correction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:29.729978Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:30d8782c09d53874f3ffd7820b9679f2040f5412496b7965ebf53d58ac6e5e43","observation_id":"3a33e743-9a3b-4e4c-ba36-40f2af890710","resolution":{"observed_at":"2026-08-03T12:37:29.729978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:29.848740Z","title":"Cogvla: Cognition- aligned vision-language-action model via instruction-driven routing & sparsification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:29.848740Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:3be2e7f323297c98f9dda349de73d69afac28a4bfb65ed47f16d849145b565a4","observation_id":"572daf2e-c3a1-4903-9f83-8fe46e8b0f9c","resolution":{"observed_at":"2026-08-03T12:37:29.848740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:29.944298Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:29.944298Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:0b40d1d0c9225402dfeaa5ff01072cdea3a8585406f682d522ff79ec9accc82a","observation_id":"f53e2420-78a8-4a23-bc9f-cb973236383f","resolution":{"observed_at":"2026-08-03T12:37:29.944298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:30.051375Z","title":"Octo: An open-source generalist robot policy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:30.051375Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:eba7d91e73b5249c059e5e1d8c7633dd6e685d01a5e09bf1583995a5a2bfc149","observation_id":"5454ef12-cc56-4385-836e-8577b5334fcd","resolution":{"observed_at":"2026-08-03T12:37:30.051375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-03T12:37:30.141155Z","title":"Spatialvla: Exploring spatial representations for visual-language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:30.141155Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:af9e1db5884058a4f0adb179c4c7357d7d3e6f064519dda83ac98ff1a2f40baf","observation_id":"28b38013-8abc-4b3f-ac25-e05d26b0bbb5","resolution":{"observed_at":"2026-08-03T12:37:30.141155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:30.219438Z","title":"Improving minimum bayes risk decoding with multi-prompt,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:30.219438Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:747a2f4de01ba5362304cfec11570cc8c3ea8bab965b957cf112b2238d94845a","observation_id":"44e5489d-70ec-486b-bd33-3ad2a84c938f","resolution":{"observed_at":"2026-08-03T12:37:30.219438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:30.316296Z","title":"Fast best-of-n decoding via speculative rejection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:30.316296Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:68e5321b3330793b156e0fb7aee54ff9aeae0e469cf2b122c80dd7b47923581f","observation_id":"b95f13bb-22ee-4505-8876-e0811f4b0a74","resolution":{"observed_at":"2026-08-03T12:37:30.316296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:30.405851Z","title":"Towards understanding sycophancy in language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:30.405851Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:a00d1d0382b6a295e096ef99ef068633fee807bf2993118891073766d239df0d","observation_id":"3f20722c-c7af-4680-b66b-0a9f92b36a15","resolution":{"observed_at":"2026-08-03T12:37:30.405851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:30.492554Z","title":"Efficient vertical federated learning with secure aggregation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:30.492554Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:977709d2681bd7e1ccb68b6aba84fecb78e1a72d304a4d620dbaf291f4b3e59a","observation_id":"7f956d87-2542-44b9-8373-ce1a52e94c01","resolution":{"observed_at":"2026-08-03T12:37:30.492554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16794","last_updated":"2024-02-17T19:56:06Z","snapshot_observed_at":"2026-08-13T11:32:36.917685Z","submitted_at":"2023-05-26T10:17:36Z","title":"Secure Vertical Federated Learning Under Unreliable Connectivity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16794","snapshot_observed_at":"2026-08-03T12:37:30.560341Z","title":"vfedsec: Efficient secure aggregation for vertical federated learning via secure layer,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:30.560341Z"},"links":{"cited_paper":"/paper/2305.16794","citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:822d96ec65630f1e06ccfbc1c48821fa98ded3c0e175a58f8306b4b34737645e","observation_id":"5a993248-9e0e-48b9-bd47-ee029d48d2a3","resolution":{"observed_at":"2026-08-03T12:37:30.560341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:30.660086Z","title":"Gradient-less federated gradient boosting tree with learnable learning rates,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:30.660086Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:7a84c5e240f51a7c4138e85aaa96171ab057634aa163f17c9448fdaf7c13ab3d","observation_id":"1b63b4a6-8f29-4aa8-bff7-aa81908a9277","resolution":{"observed_at":"2026-08-03T12:37:30.660086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:30.732695Z","title":"Your job is to decompose this task into a minimal set of formal subtasks that a robot must perform to complete the task","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:30.732695Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:d2744b93bf9f09d7cc2ced1b6b7aa5a9e5821ba49c8c7170c3d1e5d956bf2bb4","observation_id":"f8d29124-54ce-4de8-b058-04db42b27004","resolution":{"observed_at":"2026-08-03T12:37:30.732695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:30.819788Z","title":"- Do not over-decompose — prefer atomic but essential steps","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:30.819788Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:16b80fb12e5fa77da53dfca9fec40df236808433ebd08a1bdfb93f741ff5f37a","observation_id":"c8d82d51-2c49-4511-800f-4a9d02311da7","resolution":{"observed_at":"2026-08-03T12:37:30.819788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:30.917604Z","title":"- Mention relative spatial cues (e.g., above the drawer handle) if implied in the task","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:30.917604Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:1ef16bbe7f20a1cb25abee64c377b78aada063f9a8057f7efd1e46a385f28ac7","observation_id":"43217c1d-48ad-4339-9b7b-6c4ffc1b8ac4","resolution":{"observed_at":"2026-08-03T12:37:30.917604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:31.041180Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:31.041180Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:fef8ca784e027079fa8a2ec974e3272fff0280bfc3ec4f741211b078d3a9f3e5","observation_id":"a9b8fd7e-930b-40bc-8d85-52990a4912ae","resolution":{"observed_at":"2026-08-03T12:37:31.041180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:31.145739Z","title":"Move the gripper","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:31.145739Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:51b66e72dc5935184c333e45ebcf9f289f558446e029768443463d60dad26b2d","observation_id":"97f68db3-8caf-4a1f-9a96-e6a49e343b4d","resolution":{"observed_at":"2026-08-03T12:37:31.145739Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:31.272796Z","title":"Rotate the gripper","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:31.272796Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:d1b751cf1cd7a58d308688cf8ad52de52afba5b552f0c86b294f7f76386f78d4","observation_id":"43e02d42-1bb8-4695-b63c-41ff34ad04e1","resolution":{"observed_at":"2026-08-03T12:37:31.272796Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:31.388317Z","title":"Open the gripper","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:31.388317Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:e3acf02217bf8bc87d7e79b7f27134858e1370dd31e541891d8aeab8b04070f7","observation_id":"4ba08915-aab7-4458-b303-d47a51fb2d48","resolution":{"observed_at":"2026-08-03T12:37:31.388317Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:31.466096Z","title":"Close the gripper","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:31.466096Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:a29623bf8db28950a90b5226727f39ce880f21e1341e2aaa3fe29232d0b08fed","observation_id":"490e826d-9011-49b0-ad71-bf810ba0b656","resolution":{"observed_at":"2026-08-03T12:37:31.466096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:31.626639Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:31.626639Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:5b7b714086b8daa1786ffd674a604f7f7868573b143a389e195b6af9d5789be1","observation_id":"d837681f-1bed-410a-b039-0a9e7e22c822","resolution":{"observed_at":"2026-08-03T12:37:31.626639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:31.736829Z","title":"<subtask_1>","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:31.736829Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:933ae1facc789a4d6921a504b63fb17a9891be5d55d56dd7e3c07ea7371f680a","observation_id":"b0e78d67-27e4-4b8d-a1c9-ac84e1ca44fb","resolution":{"observed_at":"2026-08-03T12:37:31.736829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:31.810453Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:31.810453Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:fd99467189f75fc28b0d0fdc34289ded6cbd8f25f1a66fa7128a3b76e8a07c4b","observation_id":"9a3a0885-53b5-44fe-9cc0-f45f39d3680e","resolution":{"observed_at":"2026-08-03T12:37:31.810453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:31.866325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:31.866325Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:9aaf52f3a07f2e9096c1011b29977b8f82fc747e99e00107f0ce7ee561736c9b","observation_id":"36ae27db-7996-42b0-a268-8e616802f3dd","resolution":{"observed_at":"2026-08-03T12:37:31.866325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:31.952350Z","title":"<move_primitive>","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:31.952350Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:2257cc53d67b2ab58ca3928b066cb8d6b0e4d48ca9abcca3567fc5043555a37c","observation_id":"1a8eb945-c468-40d2-8caf-ed906ebb862c","resolution":{"observed_at":"2026-08-03T12:37:31.952350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:32.049612Z","title":"stop\" labels often appear even when the robot is still moving. - Treat","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:32.049612Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:248e339d610a8763898935757368d02be23ccee54481023c12e808fc03b185de","observation_id":"1fa496b7-1de5-4282-9556-a0f1da430c09","resolution":{"observed_at":"2026-08-03T12:37:32.049612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:32.102052Z","title":"- Cross-reference other movement labels to decide whether a short-duration label is meaningful or just noise","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:32.102052Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:a4635de6386c086324f97b7b6f5455ece885cca753519c74b9244a1c38b32be6","observation_id":"c296860a-c3b6-4b0b-bbad-b739248671ef","resolution":{"observed_at":"2026-08-03T12:37:32.102052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:32.153940Z","title":"subtask_1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:32.153940Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:693970fe2f40dc87220babaef328d33b9de0114f9ef0344a862c774f4d32e966","observation_id":"0968f3fc-d5e7-46f5-97f2-05fcdaf85c58","resolution":{"observed_at":"2026-08-03T12:37:32.153940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:32.214810Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:32.214810Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:3c8766359f0dd5a9220c550a0ee959c04a55ab3bcd31173a0b002186fdc53cfb","observation_id":"bd99d636-2adb-45fa-94c0-0d40399750c4","resolution":{"observed_at":"2026-08-03T12:37:32.214810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:32.272008Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:32.272008Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:9dd12a4d3ed23eb6042b4e5a7f3f2455e3795edbda8adc5e8035e5112251d658","observation_id":"1f2514c3-297e-490f-9044-a42030568759","resolution":{"observed_at":"2026-08-03T12:37:32.272008Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:37:32.329030Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-03T12:37:32.329030Z"},"links":{"citing_paper":"/paper/2601.02295"},"observation_digest":"sha256:b383f398c324f8f3a55ba6667fb70f541507a1cd39a65f8b7d1b679cff40557d","observation_id":"0f741211-7a2d-4cea-bdbf-2d1ab16e1e54","resolution":{"observed_at":"2026-08-03T12:37:32.329030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2601.02295","last_updated":"2026-07-28T17:46:45Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-14T04:22:46.402021Z","submitted_at":"2026-01-05T17:31:01Z","title":"CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":4,"unresolved":96,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":104},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 100 of 104 outbound references and 5 inbound Pith citation observations for arXiv:2601.02295."}