{"as_of":"2026-08-04T13:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:353b54e6993e346a37bfce24addbf70df2783582cd74a1deaa06f6393f91daab","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T16:42:30.970472Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.09630/citation-record","integrity":"/paper/2606.09630/integrity","json":"/paper/2606.09630/citation-record.json","paper":"/paper/2606.09630"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":"2410.24164","doi":"10.48550/arxiv.2410.24164","metadata_source":"pith","pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-07-11T00:07:42.817654Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","venue":"cs.LG","work_id":"f790abdc-a796-482f-a40d-f8ee035ecfc2","year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:64b3127186f0a2341eb103c2407ce66139d44c5e312c8039fe510ce9ae4fa21c","observation_id":"f8674ebb-49e3-45aa-9b34-250a55cd3d62","resolution":{"observed_at":"2026-07-03T01:17:30.794533Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":"2504.16054","doi":"10.1609/aaai.v40i28.39562","metadata_source":"pith","pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","venue":"cs.LG","work_id":"d1ad7304-d09a-49bc-809e-846439f6aff9","year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:59a20b7f08025a807d7e1b2bdf2e0087e6b3a92c5122359d97ef43875564e7e7","observation_id":"b2974f25-a728-4699-a18d-bcdcd71f0197","resolution":{"observed_at":"2026-07-03T01:17:30.792171Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:5391b7df2eb6c2307a91e2eff903222cf34c17812101e112b0778d681444ded1","observation_id":"09c885b2-af84-45d5-83ac-6a760f3443bf","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:4d89d94e608a05b0de953a9863c03f81f8fee4249af31ee2150ee72a983d8d29","observation_id":"0ef50088-7131-4d1b-ac0a-38e79ad38761","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:dc58ba87c6fbe11c3a5a28c889ffa9368cede0543ae9879237652bc69dabdcdc","observation_id":"81c00d77-9a92-4d02-87ec-bd752891e439","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:2ec0cc2d45867d2381870994ea152b1db2ba06f3bf14c06b06f528c0d15d118e","observation_id":"39151a1a-b871-4c46-893a-743abe4bedf2","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"Houlsby, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:268a9e6269d0e736b87e6d9525c998066065f084d21d047d01d9611918e47641","observation_id":"ef84353f-e25a-4805-8d85-6c92104dd171","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"Kirkpatrick, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:fc28cfe87fa185f9f1eaf32435827dfb95286b412df48196d35f712c8e30d964","observation_id":"fa082a50-4b2f-4cdf-bf81-e093b2cb14c8","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"Andrychowicz, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:fd82f9b4236171d78ee49167f964504d349ef99e4f55cce1b579c5836c394d10","observation_id":"92111344-2bf4-412d-b823-5d9c0e7558f5","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":"1606.06565","doi":"10.48550/arxiv.1606.06565","metadata_source":"pith","pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Concrete Problems in AI Safety","venue":"cs.AI","work_id":"c8d14fbe-6eab-464a-95b3-778aabd82fa3","year":2016},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:5c6bf42cc7db2e5e1e146cf13bdd4f422d699d680e3ca45dca29367bc9457533","observation_id":"5dfedae5-7e05-4c1d-9abb-1f2704a58124","resolution":{"observed_at":"2026-07-03T01:17:30.778107Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-13T23:49:52.215761+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T23:49:52.215761+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:bfff399fdf8ff852e36e1a36d2aaed076001ac2350360d24b92699e487429ec0","observation_id":"97e3fc0a-3dcf-4114-817e-ca22d92eacb0","resolution":{"observed_at":"2026-07-03T01:17:30.784645Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"Jiang, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:f5c5fab92d209b560173e65925ac7041a50c6665144bc7f742fbb0e379106d97","observation_id":"56b6b4d4-1dc6-427f-a806-c17fba4e9726","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":"2303.03378","doi":"10.48550/arxiv.2303.03378","metadata_source":"pith","pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-07-11T00:27:51.904332Z","title":"PaLM-E: An Embodied Multimodal Language Model","venue":"cs.LG","work_id":"5b99811a-1d93-47e2-9d59-f4045a0b74a2","year":2023},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:eee6cf9dd357cb288d8082c71360a7fff51d8e85c2fadfeb35c9b0c7b110564d","observation_id":"90f9c36c-7276-410a-a215-a89b943207a3","resolution":{"observed_at":"2026-07-03T01:17:30.803141Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-09T19:19:06.044727+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T19:19:06.044727+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":"2212.06817","doi":"10.48550/arxiv.2212.06817","metadata_source":"pith","pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-07-11T00:07:42.794081Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","venue":"cs.RO","work_id":"e11bda85-8531-46bc-a07f-d0ade3643ab1","year":2022},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:d6b96b0d32e5cffe1ec8cd328bfe8dcd5454e090e1326986afdcd05fb9cb233f","observation_id":"c5b1a07d-f0df-4670-b5ab-9d794719af75","resolution":{"observed_at":"2026-07-03T01:17:30.787185Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"Zitkovich, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:b36c65b3315635fdb105c5b2a129963044dcbd1262fe3b916a6038ae3c44a792","observation_id":"148666ef-e19f-413b-9180-0431e654d512","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11706","last_updated":"2023-12-22T13:55:42Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:35:20Z","title":"RoboCat: A Self-Improving Generalist Agent for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2306.11706","doi":"10.48550/arxiv.2306.11706","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11706","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Robocat: A self-improving foundation agent for robotic manipulation","venue":null,"work_id":"143e7731-0488-4088-8e23-63f9d4140118","year":2023},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2306.11706","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:98814781a0f525540c76a4604e6c1ed9364679403aa76f557e35f3123d7aa83c","observation_id":"9f54f3e9-dc63-42af-89d4-b760cc31ebbf","resolution":{"observed_at":"2026-07-03T01:17:30.824999Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"O’Neill, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:58dba2fab2a71a7f300468ea8de45a47c87a39181783cc589c7a1ed702eccaf1","observation_id":"f1010c3e-cb5c-4049-ad42-17faa38363bf","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:246c8cdb0850714cad14534ab4dc9b020000412b7788943ba67c9264257ba48e","observation_id":"dd815914-331c-4fc9-b3af-84e022741be0","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:4d3a80a32e68bc29b75967679e8960e4d1e70aeab26d33818e0a37e69408c833","observation_id":"3398b413-a376-4305-bee4-6f795df17115","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":"2405.12213","doi":"10.48550/arxiv.2405.12213","metadata_source":"pith","pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-07-10T10:07:00.871229Z","title":"Octo: An Open-Source Generalist Robot Policy","venue":"cs.RO","work_id":"f9ca0722-8855-48c3-a27a-0eefb7e19253","year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:87e29ebb4c599a08f68cb873ffdcc693ccbf8628a70cffa46e63d1160cd8ae45","observation_id":"ce85de60-5ad9-4b80-8758-e8d4c2df42a3","resolution":{"observed_at":"2026-07-03T01:17:30.789478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:f27bf767a524de53553e5ca20d1bbc217db1b19c5522934401c5b13aa10e5ce3","observation_id":"b146e127-03fd-48f9-9f51-d3ecb3b8a1af","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2411.19650","doi":"10.48550/arxiv.2411.19650","metadata_source":"pith","pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-07-10T23:07:48.078477Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","venue":"cs.RO","work_id":"4b158d3e-3dff-4412-85cd-baa879465a5e","year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:662546dc5e449ffad9585d7d99c24e94264e77ad6aa8c8f7172dab0b2ca4cb2e","observation_id":"88d38bfa-f01f-4078-8899-9ae78552dec7","resolution":{"observed_at":"2026-07-03T01:17:30.816541Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":"2501.15830","doi":"10.48550/arxiv.2501.15830","metadata_source":"pith","pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","venue":"cs.RO","work_id":"592041b3-3ca2-4836-8dd4-f8095d8a692b","year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:0ef82badfaa98498809049611e18f7bf0962f3332c3b7441f541b2e1d4afa8a9","observation_id":"c8a56627-9c3f-4419-a371-93627290f4b8","resolution":{"observed_at":"2026-07-03T01:17:30.819129Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:2d1c5a9d634cde57a0c3fe6c1a609024933908c8518d9522528ccf98122b192f","observation_id":"2b1cf5c7-5d17-4682-bd7e-4f69e74089e0","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:983610125abed211b53dccecf7b8f4853308430b89e6fb24c6431a065a1472f4","observation_id":"c414f2d1-3e0d-48f2-942f-571f0cebc8cd","resolution":{"observed_at":"2026-07-03T01:17:30.811287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"Johannink, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:bd141a669df8074079b914ccd24165ed4231c8cf7b3bebd495e1aa67e94abaed","observation_id":"4c231d3d-a5df-4802-b7f1-54b8019fbd26","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.06298","last_updated":"2019-01-03T18:11:15Z","snapshot_observed_at":"2026-07-06T07:21:24.277262Z","submitted_at":"2018-12-15T14:47:21Z","title":"Residual Policy Learning","version":2},"cited_work":{"arxiv_id":"1812.06298","doi":"10.48550/arxiv.1812.06298","metadata_source":"pith","pith_arxiv_id":"1812.06298","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Residual Policy Learning","venue":"cs.RO","work_id":"fbdcb791-93df-43ff-9c10-353c4bb178eb","year":2018},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/1812.06298","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:ff07f4e3254c9483bc42e2d81a40b055d0faa104e86614ebdaeb11148b93f574","observation_id":"dfb26fe6-d744-4ab4-b111-c8cb90475668","resolution":{"observed_at":"2026-07-03T01:17:30.800161Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23073","last_updated":"2026-04-30T20:04:38Z","snapshot_observed_at":"2026-07-31T07:02:53.376869Z","submitted_at":"2026-04-24T23:57:45Z","title":"RL Token: Bootstrapping Online RL with Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":"2604.23073","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.23073","snapshot_observed_at":"2026-07-04T17:40:00.291964Z","title":"RL Token: Bootstrapping Online RL with Vision-Language-Action Models","venue":"cs.LG","work_id":"56de03e2-21dd-46b8-97b4-aa0ba543b5a4","year":2026},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2604.23073","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:4e2a45ffb4963b8e733366e646e93ab0a145c326676c498b9f28a2767270b8a0","observation_id":"24212e24-816d-4746-a50d-ee276a2c2493","resolution":{"observed_at":"2026-07-03T01:17:30.805957Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"Ranjbar, N","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:0f96da121e5be5a23138da264cd30c514e58d7bed18a989312e4e8caee60694d","observation_id":"4b3924ab-15e5-45dd-8682-06300d97f6d7","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"Bharadhwaj, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:47e66245b121601977e6e0a848b3aef1c18bf2efb8d81b1f32274b7cb0bf3ec5","observation_id":"5efc1b1c-d0b9-4d51-aed7-0137ee3c8b44","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"Ankile, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:6e34a14564a1262c97af98c3d17e6c9e6679c096f45a02cd283ead6f4032956e","observation_id":"3c8efbd2-12af-4213-8887-07e5b5f65064","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"Pertsch, Y","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:327583c9ac4efd3d54ed893dc4a4028bbbe1ef9bfe31b50bdce60d7d2910659c","observation_id":"f028eda2-0168-47c3-ba61-631a73afc8e5","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:f5b71cb004c6e540eaec72ea48caf080cb3a4c8bf073af0d776af2e6525c3a3f","observation_id":"d24b488b-be61-4df7-82da-418e92baf11b","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:3db1f083c795cf481e09d9785257f3bef7a6f676dabefc3f9b625319b5c69fb5","observation_id":"21dd947d-a0bd-458f-8694-a3b9640601a3","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:e5da83ab679cba43118b9714b1cbd6ca62e92461a487fab9496694b571e394e6","observation_id":"9df07719-c5b2-4e1b-bead-f446b02474bc","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:5f2b70c758e726d651007d26557b530d5c7c4c1a0c80a5917dc81db2f487e1c3","observation_id":"f243620a-a3ab-40b8-a41a-21ae8e21920b","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:20b500366499e4e3238d5048759031a052d2d9c3d716d3a71ce6ab9c7d2d1cf6","observation_id":"bbb18b84-5fa0-4c96-9e36-1490d125fcee","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08376","last_updated":"2025-05-13T09:21:45Z","snapshot_observed_at":"2026-07-06T21:23:05.293197Z","submitted_at":"2025-05-13T09:21:45Z","title":"Adaptive Diffusion Policy Optimization for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2505.08376","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.08376","snapshot_observed_at":"2026-07-03T10:48:02.238598Z","title":"Jiang and Z","venue":null,"work_id":"260ff250-7ff9-4b3e-80f6-5b88290c30fc","year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2505.08376","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:1e40cbf282bbea3638b8d6ea00840b31abbde665e6f4bef8d0f09613ef3341eb","observation_id":"9e4c6a5b-3d4f-45f9-8c39-8f954773941f","resolution":{"observed_at":"2026-07-03T01:17:30.808895Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13630","last_updated":"2024-12-18T09:06:16Z","snapshot_observed_at":"2026-07-06T20:09:05.798010Z","submitted_at":"2024-12-18T09:06:16Z","title":"Policy Decorator: Model-Agnostic Online Refinement for Large Policy Model","version":1},"cited_work":{"arxiv_id":"2412.13630","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.13630","snapshot_observed_at":"2026-07-04T10:29:45.616079Z","title":"Policy decorator: Model- agnostic online refinement for large policy model","venue":null,"work_id":"6481a773-21bb-487b-bad8-5c6d5af9cd6c","year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2412.13630","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:2de097c4be20887e876812d9a171bb1a35f388d636df374e98090673df66d3ee","observation_id":"c2759d66-e6e2-41af-8b2a-4f227c3a8fd0","resolution":{"observed_at":"2026-07-03T01:17:30.813776Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:6cce63f3f14b1aa1e2b713a104da10cbea0fa9b0ad1722408910085ca63a60ba","observation_id":"9c6aa520-bd10-4924-954e-4225ccfa755f","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"Cully, J","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:cd0f5bdcd0cd7a777395f193136dc94d3c95be83b0f3bf4f7026ca5c6718f1b6","observation_id":"3c7ce300-29d7-4d0f-9d4d-0261c06d529b","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:42:30.970472Z","title":"Thananjeyan, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:a73f8f40e797410df086eec1d10f55fcd5e8ae764e0ba4a86ac0652ff1004a5b","observation_id":"4fa45116-d18d-47aa-a4e0-6c91bf8658e8","resolution":{"observed_at":"2026-06-27T16:42:30.970472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14674","last_updated":"2024-09-23T02:50:33Z","snapshot_observed_at":"2026-07-06T19:19:37.350445Z","submitted_at":"2024-09-23T02:50:33Z","title":"RACER: Rich Language-Guided Failure Recovery Policies for Imitation Learning","version":1},"cited_work":{"arxiv_id":"2409.14674","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.14674","snapshot_observed_at":"2026-07-03T01:17:30.820365Z","title":"Racer: Rich language-guided failure recovery policies for imitation learning","venue":null,"work_id":"48d53cee-481d-4db9-859b-6dee6dac2d8b","year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2409.14674","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:a486b098a33d5be2deed53d91911a18c23125970e458804dcf325036d89b5cf6","observation_id":"04eccd59-e304-4dd9-a2aa-b09772f37f97","resolution":{"observed_at":"2026-07-03T01:17:30.822102Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.01642","last_updated":"2026-07-07T04:25:23Z","snapshot_observed_at":"2026-08-04T12:54:45.972724Z","submitted_at":"2025-10-02T03:48:07Z","title":"FailSafe: Reasoning and Recovery from Failures in Vision-Language-Action Models","version":4},"cited_work":{"arxiv_id":"2510.01642","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.01642","snapshot_observed_at":"2026-07-04T06:39:37.225859Z","title":"Failsafe: Reasoning and recovery from failures in vision-language-action models","venue":"cs.RO","work_id":"82ed9e28-c3bd-4b0e-b198-0e11b3943060","year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2510.01642","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:8f456de45acdf619d05a5f81eb85a97b95a2bde8af1f74c925f36b5ec6d55994","observation_id":"715a948b-8d91-456d-9572-ae52d96dc911","resolution":{"observed_at":"2026-07-03T01:17:30.827737Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:9348a022ffc2ae38b1b1d775ce7c37da47bd078d254c9052853dbc4c47fd4b68","observation_id":"d1c95540-8297-4fc1-aeda-ed9fbbf93690","resolution":{"observed_at":"2026-07-03T01:17:30.830182Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.15965","doi":"10.48550/arxiv.2509.15965","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Rlinf: Flexible and efficient large-scale reinforcement learning via macro-to-micro flow transformation","venue":null,"work_id":"c1466d61-6368-4a11-8cee-110fa2f45f74","year":2025},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:2c6670359f3d5d0e65a9f0322a6afd049e85ed57936196c0bceaa28587d85165","observation_id":"3c3df214-fabc-4428-98c6-eca232e72c8d","resolution":{"observed_at":"2026-07-03T01:17:30.797551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09227","last_updated":"2024-03-14T09:48:36Z","snapshot_observed_at":"2026-08-01T18:11:37.998349Z","submitted_at":"2024-03-14T09:48:36Z","title":"BEHAVIOR-1K: A Human-Centered, Embodied AI Benchmark with 1,000 Everyday Activities and Realistic Simulation","version":1},"cited_work":{"arxiv_id":"2403.09227","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.09227","snapshot_observed_at":"2026-07-10T23:17:45.369340Z","title":"BEHAVIOR-1K: A Human-Centered, Embodied AI Benchmark with 1,000 Everyday Activities and Realistic Simulation","venue":"cs.RO","work_id":"6b62f6a4-fd69-4dd7-b480-b27f0bf09632","year":2024},"citing_paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T16:42:30.970472Z"},"links":{"cited_paper":"/paper/2403.09227","citing_paper":"/paper/2606.09630"},"observation_digest":"sha256:7bf9140f039d050f9ae4a84c71c29e0206113df5c65367b528e19e5decdd7565","observation_id":"b83cc8e3-3cdd-46e4-9fcf-f760aeb1cbb5","resolution":{"observed_at":"2026-07-03T01:17:30.781657Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.09630","last_updated":"2026-06-08T15:29:09Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:29:09Z","title":"ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":20,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2606.09630."}