{"as_of":"2026-08-06T19:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4329a8207f5ee15e1edc7045d3f4afa6550bc946d32a2ac23d1dece1276fa22e","coverage":[{"denominator":87,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":87,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T10:34:59.134604Z","state":"measured"},{"denominator":187,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":187,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":184,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T05:46:48.385585Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2405.14093","last_updated":"2026-05-01T01:50:44Z","snapshot_observed_at":"2026-08-04T06:47:25.827167Z","submitted_at":"2024-05-23T01:43:54Z","title":"A Survey on Vision-Language-Action Models for Embodied AI","version":8},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-24T01:25:10.150459Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2405.14093"},"observation_digest":"sha256:1de84c58d7b5516a1f52893b98e0f75206142be0ab497efeeb8a67c23156239d","observation_id":"d656d3fc-cfa3-458f-b907-a720ca3ae3ff","resolution":{"observed_at":"2026-05-24T01:25:54.273628Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2601.07060","last_updated":"2026-04-04T05:08:38Z","snapshot_observed_at":"2026-07-06T22:41:24.948774Z","submitted_at":"2026-01-11T21:00:58Z","title":"PALM: Progress-Aware Policy Learning via Affordance Reasoning for Long-Horizon Robotic Manipulation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T15:05:21.907878Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2601.07060"},"observation_digest":"sha256:a84e4cb5b79d3e4aa0270d21baa9c793b075557a6c6f881ced8f91bcfac99a89","observation_id":"b700710a-bf86-40f9-b41a-f96b56b5d410","resolution":{"observed_at":"2026-05-16T15:08:01.701442Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2601.20239","last_updated":"2026-05-13T12:53:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T04:22:47Z","title":"TouchGuide: Inference-Time Steering of Visuomotor Policies via Touch Guidance","version":6},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T11:06:23.555610Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2601.20239"},"observation_digest":"sha256:c87c151b1c8e3ea4bac90e7b23273b4b78ee7e51605152d57edfb790109f240b","observation_id":"069f214e-bc61-41d4-9ce6-5dce93bd9be7","resolution":{"observed_at":"2026-05-16T11:07:47.840570Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-03T05:17:28.099404Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02839","last_updated":"2026-05-22T21:05:10Z","snapshot_observed_at":"2026-08-03T05:17:24.883535Z","submitted_at":"2026-02-02T21:41:08Z","title":"Language Movement Primitives: Grounding Language Models in Robot Motion","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T05:17:28.099404Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.02839"},"observation_digest":"sha256:fca9d81e42d0bf764cdc232658c2fa2c25c16b8c16a21153e1e69e80f28948f3","observation_id":"492e2bcf-f89e-435b-ad68-3c7b5935f288","resolution":{"observed_at":"2026-08-03T05:17:28.099404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-03T03:56:47.154587Z","title":"π0.6: a vla that learns from experience.arXiv preprint arXiv:2511.14759,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.06508","last_updated":"2026-05-25T03:56:37Z","snapshot_observed_at":"2026-08-03T03:56:46.452714Z","submitted_at":"2026-02-06T08:57:55Z","title":"World-VLA-Loop: Closed-Loop Learning of Video World Model and VLA Policy","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T03:56:47.154587Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.06508"},"observation_digest":"sha256:1741863881e19832dc7897ab3cd2253118af2cd585fe7089c8bd1692f63661ad","observation_id":"456df98f-5d2b-4699-af17-2cc0c13daf57","resolution":{"observed_at":"2026-08-03T03:56:47.154587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2602.07322","last_updated":"2026-05-07T05:51:53Z","snapshot_observed_at":"2026-08-06T08:05:47.397083Z","submitted_at":"2026-02-07T02:39:49Z","title":"Action-to-Action Flow Matching","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T06:53:35.153155Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.07322"},"observation_digest":"sha256:03e305a4c1192cd2683b691d54b328292c9e565d92983ba3a95e0ab2d1762ef3","observation_id":"08c15000-9bea-496d-bf00-ab0ec2c4dfe4","resolution":{"observed_at":"2026-05-16T06:57:29.225522Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2602.08167","last_updated":"2026-05-16T05:42:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-09T00:10:17Z","title":"Self-Supervised Bootstrapping of Action-Predictive Embodied Reasoning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T14:03:48.795572Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.08167"},"observation_digest":"sha256:140991a76bd51bc8fe137471ea520db7095d0315436f4e700f35fecea213e391","observation_id":"bd027e24-351f-4214-a143-d25652b4c97a","resolution":{"observed_at":"2026-05-21T14:04:11.970546Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-03T03:18:42.039197Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08557","last_updated":"2026-06-30T09:31:26Z","snapshot_observed_at":"2026-08-04T13:53:54.524141Z","submitted_at":"2026-02-09T11:54:45Z","title":"Combined Constrained Sampling and Reinforcement Learning for Robotic Manipulation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T03:18:42.039197Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.08557"},"observation_digest":"sha256:ab52b1d5fb73b0367dc883f8808b87737201965487163cb39c99748416aab284","observation_id":"5399d154-392f-4eac-9870-fa665a2caff4","resolution":{"observed_at":"2026-08-03T03:18:42.039197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2602.09580","last_updated":"2026-06-05T16:14:20Z","snapshot_observed_at":"2026-08-03T02:53:08.103634Z","submitted_at":"2026-02-10T09:28:20Z","title":"SERNF: Sample-Efficient Real-World Dexterous Policy Fine-Tuning via Action-Chunked Critics and Normalizing Flows","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T03:36:09.272019Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.09580"},"observation_digest":"sha256:611a26f7fca637d36c3337f273814cef8c19d3dbab0db4863d7e255b61b281cd","observation_id":"14a13e2d-bc73-4c3e-9803-cb92aa2eaca7","resolution":{"observed_at":"2026-05-16T03:37:13.860172Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-03T02:53:16.108040Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.09580","last_updated":"2026-06-05T16:14:20Z","snapshot_observed_at":"2026-08-03T02:53:08.103634Z","submitted_at":"2026-02-10T09:28:20Z","title":"SERNF: Sample-Efficient Real-World Dexterous Policy Fine-Tuning via Action-Chunked Critics and Normalizing Flows","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T02:53:16.108040Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.09580"},"observation_digest":"sha256:aa07a1c189d0fa9e9d8a58be0e73caeb6501015bced2260997a8ec665318f544","observation_id":"30299ff5-a561-4b6e-865d-6883cb23ea8c","resolution":{"observed_at":"2026-08-03T02:53:16.108040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2602.11075","last_updated":"2026-04-28T08:51:16Z","snapshot_observed_at":"2026-08-03T04:09:34.408025Z","submitted_at":"2026-02-11T17:43:36Z","title":"RISE: Self-Improving Robot Policy with Compositional World Model","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T02:28:37.997148Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.11075"},"observation_digest":"sha256:518bfa99f35a5852764c7af2737b503533324779c0a64fc41efd7bcfbf453d6a","observation_id":"71bb122c-598e-466f-81fd-07ce3b3ed833","resolution":{"observed_at":"2026-05-16T02:30:32.143070Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-02T23:48:57.949446Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.12628","last_updated":"2026-06-04T11:43:40Z","snapshot_observed_at":"2026-08-02T23:48:53.948791Z","submitted_at":"2026-02-13T05:15:50Z","title":"Beyond Imitation: Reinforcement Learning-Based Sim-Real Co-Training for VLA Models","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T23:48:57.949446Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.12628"},"observation_digest":"sha256:3f2511c044a70fdb494c93af79e2f3c3c6e04d82a506f85adfa70548f946205c","observation_id":"65c3e564-9f56-4902-ac84-9ac87c0dd074","resolution":{"observed_at":"2026-08-02T23:48:57.949446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-02T23:47:55.179001Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.12691","last_updated":"2026-06-20T06:22:27Z","snapshot_observed_at":"2026-08-06T14:37:27.953191Z","submitted_at":"2026-02-13T07:46:37Z","title":"ALOE: Action-Level Off-Policy Evaluation for Vision-Language-Action Model Post-Training","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T23:47:55.179001Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.12691"},"observation_digest":"sha256:562ddd9ccd7fed58dfbb9fc9797b4fba5a92b57437b834b835cfca742794acd0","observation_id":"6ec06c83-7a1b-4938-b7b9-d086d9509fb2","resolution":{"observed_at":"2026-08-02T23:47:55.179001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2602.18532","last_updated":"2026-05-20T07:29:11Z","snapshot_observed_at":"2026-08-02T03:49:48.311375Z","submitted_at":"2026-02-20T09:26:17Z","title":"VLANeXt: Recipes for Building Strong VLA Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T12:58:30.777235Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.18532"},"observation_digest":"sha256:d19062e185126c568fcf88d312ed725bb8c695379055bd7f633f70c023a26095","observation_id":"fb9fa478-13d0-4ec9-b9ca-ca2f7c7e2e85","resolution":{"observed_at":"2026-05-21T13:00:09.863649Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-02T21:43:07.989656Z","title":"Kadavath, S., Conerly, T., Askell, A., Henighan, T., Drain, D., Perez, E., Schiefer, N., Hatfield-Dodds, Z., DasSarma, N., Tran-Johnson, E., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.19313","last_updated":"2026-07-22T22:14:13Z","snapshot_observed_at":"2026-08-02T21:43:05.758047Z","submitted_at":"2026-02-22T19:25:48Z","title":"TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T21:43:07.989656Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.19313"},"observation_digest":"sha256:02f6ddd3ff8970b7ca694d00832d1d4bf665ed6d58e7dfa884a4c9c336c5f5a1","observation_id":"0dc9129e-996e-4fcf-9081-d6df4b8aefca","resolution":{"observed_at":"2026-08-02T21:43:07.989656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2602.20323","last_updated":"2026-05-03T05:21:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-23T20:18:35Z","title":"PhysMem: Scaling Test-Time Memory for Embodied Physical Reasoning","version":6},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-15T20:05:30.324309Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2602.20323"},"observation_digest":"sha256:cc5ca0f73760bb60de2e98dd925a5400431456bfbd974baa9fae5cc7ac0915fc","observation_id":"fc8a87a6-2d43-4351-a88b-8e605df661b5","resolution":{"observed_at":"2026-05-15T20:06:33.769825Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-02T19:42:46.514018Z","title":"Z., Sharma, C., Shi, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.01229","last_updated":"2026-07-30T17:55:22Z","snapshot_observed_at":"2026-08-06T16:30:48.418848Z","submitted_at":"2026-03-01T18:59:59Z","title":"RMBench: Memory-Dependent Robotic Manipulation Benchmark with Insights into Policy Design","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T19:42:46.514018Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2603.01229"},"observation_digest":"sha256:485956dfb728dc835d2ab722f9ea287a532ca73dba39af8d8c5ea9dfcbede821","observation_id":"2e410113-341d-4f7c-84b7-7cda7ac62ed0","resolution":{"observed_at":"2026-08-02T19:42:46.514018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2603.02115","last_updated":"2026-05-13T21:07:49Z","snapshot_observed_at":"2026-08-01T20:59:07.888539Z","submitted_at":"2026-03-02T17:38:58Z","title":"Robometer: Scaling General-Purpose Robotic Reward Models via Trajectory Comparisons","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-15T17:59:52.365630Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2603.02115"},"observation_digest":"sha256:42b7005c3606b493a0b72db7bcc421b841923324064cf07293eebd66a6339b0c","observation_id":"cf568421-15ba-4304-824e-22bb63730f5c","resolution":{"observed_at":"2026-05-15T18:00:12.574856Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2603.02854","last_updated":"2026-04-29T04:47:16Z","snapshot_observed_at":"2026-07-06T22:47:41.997192Z","submitted_at":"2026-03-03T11:02:55Z","title":"CoFL: Continuous Flow Fields for Language-Conditioned Navigation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T17:18:38.294448Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2603.02854"},"observation_digest":"sha256:5e0b2ba3e8f049b9b2199c16059ba32d3ff6a30344f62cdbf0ef79a181432284","observation_id":"701392f9-6ab7-48d0-9f4f-c19492a94438","resolution":{"observed_at":"2026-05-15T17:20:10.476539Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-07-15T14:44:57.978537Z","title":"arXiv preprint arXiv:2511.14759 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.05190","last_updated":"2026-07-03T09:26:17Z","snapshot_observed_at":"2026-08-03T09:03:06.385713Z","submitted_at":"2026-03-05T14:03:09Z","title":"Optimization landscapes of variational quantum algorithms","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-15T14:44:57.978537Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2603.05190"},"observation_digest":"sha256:23e757c6a61a5b43e65c383e390c274dd83dc9f8eb7496fa0b174bc2c62fa1c9","observation_id":"3df4d643-291c-4e93-a3ba-19629da9680a","resolution":{"observed_at":"2026-07-15T14:44:57.978537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-02T18:44:43.510752Z","title":"Available: https://arxiv.org/abs/2511.14759","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.05754","last_updated":"2026-07-16T15:17:28Z","snapshot_observed_at":"2026-08-02T18:44:42.807291Z","submitted_at":"2026-03-05T23:26:44Z","title":"Safe-Night VLA: Seeing the Unseen via Thermal-Perceptive Vision-Language-Action Models for Safety-Critical Manipulation","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T18:44:43.510752Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2603.05754"},"observation_digest":"sha256:a34426af159a64a7336f03eb6b5faaee8550a299cf8d31e64deb057e004a5f59","observation_id":"bcb4c41c-a3cd-4f7d-9ba7-bd8c7bbb1db9","resolution":{"observed_at":"2026-08-02T18:44:43.510752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-07-14T23:47:45.866615Z","title":"� ∗ ���: a vla that learns from experience.arXiv preprint arXiv:2511.14759, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.10250","last_updated":"2026-05-24T03:43:13Z","snapshot_observed_at":"2026-08-06T17:26:04.405292Z","submitted_at":"2026-03-10T22:01:13Z","title":"GeMPO: Generalized Measure Matching for Online Diffusion Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T23:47:45.866615Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2603.10250"},"observation_digest":"sha256:647fb2558c8318e46fcc4daac4d80c9a3f199795547e4deb15529f6915c7063b","observation_id":"ac17d9de-4eea-4839-91d7-f606ebe49032","resolution":{"observed_at":"2026-07-14T23:47:45.866615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2603.15757","last_updated":"2026-06-19T13:49:25Z","snapshot_observed_at":"2026-08-01T17:19:13.726372Z","submitted_at":"2026-03-16T18:00:19Z","title":"You've Got a Golden Ticket: Improving Generative Robot Policies With A Single Noise Vector","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T09:53:45.151347Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2603.15757"},"observation_digest":"sha256:7d69c0b555da75227b34ce933de0416f6517905973d32f92308151058b925c5c","observation_id":"106e493e-314a-41a6-86f7-e14ec4c7fae0","resolution":{"observed_at":"2026-05-15T09:55:24.225788Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2603.15759","last_updated":"2026-05-12T15:04:33Z","snapshot_observed_at":"2026-07-06T22:49:19.323519Z","submitted_at":"2026-03-16T18:00:23Z","title":"Simulation Distillation: Pretraining World Models in Simulation for Rapid Real-World Adaptation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T09:49:03.333757Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2603.15759"},"observation_digest":"sha256:aebdb726987bf05a35ab1046ac066801efdbdd8b259eca80ffb9ebf3742db092","observation_id":"e425baf7-6393-4ef6-8402-519b01ff1be0","resolution":{"observed_at":"2026-05-15T09:49:54.496767Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-04T05:46:48.385585Z","title":"π ∗ 0.6: a vla that learns from experience,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.18494","last_updated":"2026-08-02T10:53:20Z","snapshot_observed_at":"2026-08-06T18:27:12.949114Z","submitted_at":"2026-03-19T05:02:43Z","title":"MemoAct: Atkinson-Shiffrin-Inspired Hierarchical Memory-Augmented Policy for Robotic Manipulation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T05:46:48.385585Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2603.18494"},"observation_digest":"sha256:72dbda5ffa8edbeaa8ae8f9f0d7e4bbce9f71c07da386dd056fc79791cf14ff3","observation_id":"beedb161-72f4-4344-9bc6-d192029c325e","resolution":{"observed_at":"2026-08-04T05:46:48.385585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2603.19199","last_updated":"2026-05-16T06:32:19Z","snapshot_observed_at":"2026-08-02T13:37:33.218495Z","submitted_at":"2026-03-19T17:51:37Z","title":"FASTER: Rethinking Real-Time Flow VLAs","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T08:02:13.188363Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2603.19199"},"observation_digest":"sha256:2bc4c4a61c72768a20df50f35c75129b3b9780db2681fc0451627c4e8d892b14","observation_id":"cdd44350-9566-4b35-944f-ee1a87cc6dd6","resolution":{"observed_at":"2026-05-15T08:05:15.387111Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2603.19199","last_updated":"2026-05-16T06:32:19Z","snapshot_observed_at":"2026-08-02T13:37:33.218495Z","submitted_at":"2026-03-19T17:51:37Z","title":"FASTER: Rethinking Real-Time Flow VLAs","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-21T10:48:56.280105Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2603.19199"},"observation_digest":"sha256:009aa445cb4478f9a1f3200c9d141adc79738c01a5eebbb546e103c6e72ba3d6","observation_id":"9254c69b-ab9d-40f5-b1eb-c3e4d4f0f9e3","resolution":{"observed_at":"2026-05-21T10:50:01.094248Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-07-13T16:10:12.689957Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.28730","last_updated":"2026-05-26T17:56:39Z","snapshot_observed_at":"2026-08-06T10:59:04.687049Z","submitted_at":"2026-03-30T17:46:31Z","title":"SOLE-R1: Video-Language Reasoning as the Sole Reward for On-Robot Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T16:10:12.689957Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2603.28730"},"observation_digest":"sha256:a010daf3888f554b7fae4d9c242876bc829f48948c6f75aac26ab521e28f6997","observation_id":"ba0b2f20-8946-4f9b-b859-3408db88f193","resolution":{"observed_at":"2026-07-13T16:10:12.689957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.02965","last_updated":"2026-04-03T10:55:51Z","snapshot_observed_at":"2026-08-03T01:48:29.110837Z","submitted_at":"2026-04-03T10:55:51Z","title":"Open-Loop Planning, Closed-Loop Verification: Speculative Verification for VLA","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T19:45:17.852646Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.02965"},"observation_digest":"sha256:bc13214cec74b995dff27b7fa7fdcd5338961f959607d9d18e49bbead2fe74a6","observation_id":"341318fb-f226-41d3-9cae-558f220d78dc","resolution":{"observed_at":"2026-05-13T19:48:11.455634Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.03037","last_updated":"2026-04-21T06:50:49Z","snapshot_observed_at":"2026-07-06T22:52:15.263364Z","submitted_at":"2026-04-03T13:45:59Z","title":"ARM: Advantage Reward Modeling for Long-Horizon Manipulation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T19:25:46.693189Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.03037"},"observation_digest":"sha256:a9b63098caa00015320099f218ca346dbb19ff418b0ddbf51640cd65404cd552","observation_id":"27d0a391-d7f8-447b-98d2-0124304f98fe","resolution":{"observed_at":"2026-05-13T19:28:09.926570Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.03066","last_updated":"2026-04-03T14:40:24Z","snapshot_observed_at":"2026-07-29T22:55:11.051349Z","submitted_at":"2026-04-03T14:40:24Z","title":"Redefining End-of-Life: Intelligent Automation for Electronics Remanufacturing Systems","version":1},"reference_index":134,"source":"pdf_text","source_observed_at":"2026-05-13T19:21:34.849729Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.03066"},"observation_digest":"sha256:b71a738b986c863b411095aeb0fb9c27cea31ecce101bbd499a4e4fd10f56578","observation_id":"099112c4-1561-49ef-aabf-015a9e4faecd","resolution":{"observed_at":"2026-05-13T19:23:09.520029Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.03181","last_updated":"2026-04-03T16:57:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T16:57:06Z","title":"Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T18:54:07.081457Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.03181"},"observation_digest":"sha256:65650ffd7c386f04ab3a90b909e4b64da214641400365bc432c53ba75701f7a0","observation_id":"1da0bcd2-2a79-413e-9c2c-9f66411ef23b","resolution":{"observed_at":"2026-05-13T18:58:08.855870Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.04834","last_updated":"2026-06-30T15:42:53Z","snapshot_observed_at":"2026-07-13T09:40:35.215938Z","submitted_at":"2026-04-06T16:35:57Z","title":"E-VLA: Event-Augmented Vision-Language-Action Model for Dark and Blurred Scenes","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T20:21:45.365156Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.04834"},"observation_digest":"sha256:f84756a8d0ddef3b0fd4d3f3d95aa5300673937ba6f8bf373df6fb340a60c9a3","observation_id":"d6d35575-9365-4cbc-bc1a-8c7c767b4f5a","resolution":{"observed_at":"2026-05-10T22:00:48.378858Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.05484","last_updated":"2026-04-07T06:24:41Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T06:24:41Z","title":"CoEnv: Driving Embodied Multi-Agent Collaboration via Compositional Environment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:12.286456Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.05484"},"observation_digest":"sha256:10316f89eb724e75bb560c11af16a3b0720bd74ff6f97982127e1e1ece0c5291","observation_id":"f2cb6e96-cc98-47ee-825b-4ea282c16191","resolution":{"observed_at":"2026-05-10T22:55:52.412697Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.06168","last_updated":"2026-04-15T01:21:52Z","snapshot_observed_at":"2026-07-06T22:54:44.656835Z","submitted_at":"2026-04-07T17:59:30Z","title":"Action Images: End-to-End Policy Learning via Multiview Video Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T18:51:05.206602Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.06168"},"observation_digest":"sha256:154e0b398509ad22033068d5ed456c0f4a8c5031d19d05cc2a1dbb3035c9a73a","observation_id":"96cc6f07-83ad-4ed4-912b-311ad1d1a9c0","resolution":{"observed_at":"2026-05-10T23:50:53.514156Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.08168","last_updated":"2026-04-09T12:28:14Z","snapshot_observed_at":"2026-07-06T22:57:18.202215Z","submitted_at":"2026-04-09T12:28:14Z","title":"ViVa: A Video-Generative Value Model for Robot Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T17:12:08.970164Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.08168"},"observation_digest":"sha256:d6b7e9c1ac04e4bc4e02838b5911200ce15e8566396164c5bae456c8c1175b5b","observation_id":"28bb7d2c-38e4-4ca0-8c27-16dead3fbd92","resolution":{"observed_at":"2026-05-11T07:25:59.082501Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-07-13T00:03:53.609175Z","title":"arXiv preprint arXiv:2511.14759, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.08169","last_updated":"2026-07-02T01:38:10Z","snapshot_observed_at":"2026-08-06T18:54:11.983131Z","submitted_at":"2026-04-09T12:28:22Z","title":"Activation Steering for Aligned Open-ended Generation without Sacrificing Coherence","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T00:03:53.609175Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.08169"},"observation_digest":"sha256:8736eb285450af30a13ba175bf2a6c80e362073e4efc398ed7197e63511ded53","observation_id":"aa38d91c-7794-46a2-a4ea-787c90f77b9c","resolution":{"observed_at":"2026-07-13T00:03:53.609175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.09330","last_updated":"2026-04-10T13:59:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-10T13:59:54Z","title":"VAG: Dual-Stream Video-Action Generation for Embodied Data Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T17:16:31.378588Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.09330"},"observation_digest":"sha256:b6c7997e1becf111b37e588310175d49e0fec5969b4fc227694aeb63443e1f6e","observation_id":"d040512f-ed95-4966-8cc8-6cd42c87e1fa","resolution":{"observed_at":"2026-05-11T07:11:01.142615Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.10962","last_updated":"2026-04-13T03:56:37Z","snapshot_observed_at":"2026-08-02T07:19:58.094243Z","submitted_at":"2026-04-13T03:56:37Z","title":"ScoRe-Flow: Complete Distributional Control via Score-Based Reinforcement Learning for Flow Matching","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T16:02:36.261596Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.10962"},"observation_digest":"sha256:01c1e386b7dbe22f184c3b5fa55b507237e75dea20dea7c948997e7a853fa91e","observation_id":"60535b7f-9c12-4054-9027-6c34510a347d","resolution":{"observed_at":"2026-05-11T09:26:00.670288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.15483","last_updated":"2026-04-24T23:18:28Z","snapshot_observed_at":"2026-08-05T18:18:04.172934Z","submitted_at":"2026-04-16T19:18:07Z","title":"${\\pi}_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T11:42:34.409651Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.15483"},"observation_digest":"sha256:ef252dbb9bc2b3f7588684f4692fa1da3d29d42b11a27082f79f4f8afe699fbb","observation_id":"849a9f66-883f-42de-b293-8ff9b5fac114","resolution":{"observed_at":"2026-05-10T11:45:21.702816Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.17706","last_updated":"2026-04-24T09:42:43Z","snapshot_observed_at":"2026-08-02T09:07:48.624756Z","submitted_at":"2026-04-20T01:36:58Z","title":"OmniVLA-RL: A Vision-Language-Action Model with Spatial Understanding and Online RL","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-10T05:16:57.241755Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.17706"},"observation_digest":"sha256:e62f222b6440e908ad506455e256da330a319245a5db791a1e41cf5401328289","observation_id":"11bbe7f9-32f6-437f-ba42-ed36faef8f79","resolution":{"observed_at":"2026-05-10T09:28:39.271234Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:f7a5b94d926da0f065dee13b75809b204478ef9303d393f8b31dd955c3229143","observation_id":"d2ef1d48-631d-4ff8-8db6-427455325208","resolution":{"observed_at":"2026-05-11T12:56:10.899312Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.19728","last_updated":"2026-04-21T17:51:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-21T17:51:51Z","title":"VLA Foundry: A Unified Framework for Training Vision-Language-Action Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T02:10:04.003151Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.19728"},"observation_digest":"sha256:584f6e6f54722551f8b5f24d2d947b1ffa324e0f1e8d50514b8b7343f6256f88","observation_id":"79dc5373-be84-473e-ba4a-68b154ed655c","resolution":{"observed_at":"2026-05-11T13:16:04.018345Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.19730","last_updated":"2026-04-21T17:52:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-21T17:52:17Z","title":"FASTER: Value-Guided Sampling for Fast RL","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T02:47:36.475845Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.19730"},"observation_digest":"sha256:cb9d152041714a497513e3c70dd0bcee1eeb894521e32974ecb54920e7f23928","observation_id":"b5e9749d-9299-4baf-9de1-9b59876d33bd","resolution":{"observed_at":"2026-05-10T02:48:27.263461Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.23073","last_updated":"2026-04-30T20:04:38Z","snapshot_observed_at":"2026-07-31T07:02:53.376869Z","submitted_at":"2026-04-24T23:57:45Z","title":"RL Token: Bootstrapping Online RL with Vision-Language-Action Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T11:56:34.978806Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.23073"},"observation_digest":"sha256:992f946391cb7da1ff464b1f7451e6373384403f43e67ff8b0bbc1834899fff3","observation_id":"1aa59379-c0d1-4e27-bee2-2f0ee93b78ee","resolution":{"observed_at":"2026-05-11T19:26:09.184643Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.23863","last_updated":"2026-04-26T20:10:03Z","snapshot_observed_at":"2026-07-06T23:10:02.659384Z","submitted_at":"2026-04-26T20:10:03Z","title":"Cooptimizing Safety and Performance Using Safety Value-Constrained Model Predictive Control","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T05:52:11.090003Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.23863"},"observation_digest":"sha256:b81a4fcf3b93251b8452d2b2b7d05c66960c25dc9f1df0873223e233de91e803","observation_id":"d75b9113-b2cd-43fa-b10f-fbe96e1cfa2e","resolution":{"observed_at":"2026-05-11T21:21:11.452892Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.25050","last_updated":"2026-06-03T06:10:32Z","snapshot_observed_at":"2026-07-06T23:10:57.164248Z","submitted_at":"2026-04-27T23:04:03Z","title":"DiscreteRTC: Discrete Diffusion Policies are Natural Asynchronous Executors","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T02:30:30.319810Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.25050"},"observation_digest":"sha256:28602314f40326d47e6b24e46914a8da33e287a287353405525ff88a789ead38","observation_id":"11f572ef-8fe3-4103-837a-9962c0a0b575","resolution":{"observed_at":"2026-05-11T22:46:11.935381Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.25050","last_updated":"2026-06-03T06:10:32Z","snapshot_observed_at":"2026-07-06T23:10:57.164248Z","submitted_at":"2026-04-27T23:04:03Z","title":"DiscreteRTC: Discrete Diffusion Policies are Natural Asynchronous Executors","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-01T08:32:26.160039Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.25050"},"observation_digest":"sha256:7759891f61604918bd1021fea3087195cfa9591343734b57acf33f3d5043c919","observation_id":"52f3a094-dec9-40ca-a545-fc9f7b17afdd","resolution":{"observed_at":"2026-07-01T08:35:33.445649Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.27472","last_updated":"2026-04-30T06:14:02Z","snapshot_observed_at":"2026-07-06T23:12:57.730833Z","submitted_at":"2026-04-30T06:14:02Z","title":"PRTS: A Primitive Reasoning and Tasking System via Contrastive Representations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-07T08:56:32.164424Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.27472"},"observation_digest":"sha256:1f38db62a7a98e688aeb82b562a58f3e4ad4c7f732a0ea70740d27efb8b0a431","observation_id":"7db32639-0052-4126-a62f-dc40a36e8002","resolution":{"observed_at":"2026-05-12T09:51:29.124042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.28192","last_updated":"2026-05-07T14:00:44Z","snapshot_observed_at":"2026-08-02T05:19:22.679378Z","submitted_at":"2026-04-30T17:59:52Z","title":"LaST-R1: Reinforcing Robotic Manipulation via Adaptive Physical Latent Reasoning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-07T05:47:17.494531Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.28192"},"observation_digest":"sha256:d359e2f57615253d9bbaf58b751e103d461b22c4b0dbf5dbdecde98732e2afe7","observation_id":"f33c21b4-a7c7-4353-875f-222d94b944c1","resolution":{"observed_at":"2026-05-12T10:31:30.071764Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.28192","last_updated":"2026-05-07T14:00:44Z","snapshot_observed_at":"2026-08-02T05:19:22.679378Z","submitted_at":"2026-04-30T17:59:52Z","title":"LaST-R1: Reinforcing Robotic Manipulation via Adaptive Physical Latent Reasoning","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T03:00:26.352130Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.28192"},"observation_digest":"sha256:2cb2546a626fc5b88d02ff02b5214e273ebbf51427dacfe8d18bfa71b242792c","observation_id":"7bd5b30e-bf2e-4c10-b421-b84ef469c9f8","resolution":{"observed_at":"2026-05-11T22:17:04.478386Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.00416","last_updated":"2026-06-03T08:01:40Z","snapshot_observed_at":"2026-07-06T23:13:52.304925Z","submitted_at":"2026-05-01T05:20:26Z","title":"Learning While Deploying: Fleet-Scale Reinforcement Learning for Generalist Robot Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T19:31:38.069592Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.00416"},"observation_digest":"sha256:b05b89bf335e387eb32f9e1c316dbe880fa5bfa41603e20c6008c1543096d41b","observation_id":"821bdf88-6d1b-478d-8eab-c3df931350d6","resolution":{"observed_at":"2026-05-11T15:36:10.922526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.00416","last_updated":"2026-06-03T08:01:40Z","snapshot_observed_at":"2026-07-06T23:13:52.304925Z","submitted_at":"2026-05-01T05:20:26Z","title":"Learning While Deploying: Fleet-Scale Reinforcement Learning for Generalist Robot Policies","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-01T08:05:47.128354Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.00416"},"observation_digest":"sha256:1f236ede1707a6ac217281971016eafe6ec5cd05e6f71fd5ff45091abc60d8fc","observation_id":"31042599-b993-42b1-9b4f-31a07958c008","resolution":{"observed_at":"2026-07-01T08:15:32.263986Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.02757","last_updated":"2026-05-04T15:57:07Z","snapshot_observed_at":"2026-07-06T23:15:46.390406Z","submitted_at":"2026-05-04T15:57:07Z","title":"Seeing Realism from Simulation: Efficient Video Transfer for Vision-Language-Action Data Augmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T18:21:00.089755Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.02757"},"observation_digest":"sha256:534c8a05eee0771ee80fb3d4eb0344b84a5d5ca307e928476ef88a150ad470f1","observation_id":"0cd918c7-08e8-44e9-a758-020f720c804a","resolution":{"observed_at":"2026-05-09T06:35:38.643323Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-07T16:06:10.595164Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:3d9f3da7767190d308a29558525bf2dc6025984c75f8b672d137e59e082d682d","observation_id":"366acde0-6660-495b-91cb-b42c6ed4a338","resolution":{"observed_at":"2026-05-12T10:51:30.983227Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:f8eb46a36ab7ca49b1fc390f3da1f8846bf71ba40ac7a96753694a66f158521d","observation_id":"fa180a3b-b5db-44ba-8a1c-f25384a8d997","resolution":{"observed_at":"2026-05-09T06:05:35.153838Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.05812","last_updated":"2026-05-11T14:20:38Z","snapshot_observed_at":"2026-07-06T23:18:22.301347Z","submitted_at":"2026-05-07T07:47:55Z","title":"Long-Horizon Q-Learning: Accurate Value Learning via n-Step Inequalities","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-08T11:20:19.749415Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.05812"},"observation_digest":"sha256:398431024733edd5d67551f6e04006e492603a727ce6b643afe28c4dd6587f80","observation_id":"e24d812c-f698-4b26-8779-0c2e81e705f0","resolution":{"observed_at":"2026-05-11T19:41:08.137796Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.05812","last_updated":"2026-05-11T14:20:38Z","snapshot_observed_at":"2026-07-06T23:18:22.301347Z","submitted_at":"2026-05-07T07:47:55Z","title":"Long-Horizon Q-Learning: Accurate Value Learning via n-Step Inequalities","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-12T05:05:29.984355Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.05812"},"observation_digest":"sha256:82ebbe293633910e433688421577c8ae92853367b8d0a46554889e3a21db1335","observation_id":"e1727c4a-b0e3-47a2-b37f-63bcd996ca70","resolution":{"observed_at":"2026-05-12T05:41:24.464065Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.07514","last_updated":"2026-05-08T09:44:43Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:44:43Z","title":"Is the Future Compatible? Diagnosing Dynamic Consistency in World Action Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-11T02:31:30.530595Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.07514"},"observation_digest":"sha256:92f7bdd045ae77a5071eb05228420c58f3ce74572eb520f677f0f094d2ffa3ee","observation_id":"9de942b0-daca-4732-a02a-971cd3a69ced","resolution":{"observed_at":"2026-05-11T03:15:57.016888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.07560","last_updated":"2026-05-20T15:28:41Z","snapshot_observed_at":"2026-08-01T23:52:19.420653Z","submitted_at":"2026-05-08T10:34:11Z","title":"How to Utilize Failure Demo Data?: Effective Data Selection for Imitation Learning Using Distribution Differences in Attention Mechanism","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T02:08:26.682345Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.07560"},"observation_digest":"sha256:97a839ce270702a06eea1bb0468c99902851da3e83a2a54b9e672d10ab311dd8","observation_id":"653d5306-3366-43d4-8e0e-62ea18775bfb","resolution":{"observed_at":"2026-05-11T03:55:55.326380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.07560","last_updated":"2026-05-20T15:28:41Z","snapshot_observed_at":"2026-08-01T23:52:19.420653Z","submitted_at":"2026-05-08T10:34:11Z","title":"How to Utilize Failure Demo Data?: Effective Data Selection for Imitation Learning Using Distribution Differences in Attention Mechanism","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T08:19:30.310013Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.07560"},"observation_digest":"sha256:4bf874889b7ed4d481a71e788de9b0888e4f4e6d030e269941a70b438927a58d","observation_id":"d404f7cb-cff8-4653-b92d-35a61034809b","resolution":{"observed_at":"2026-05-21T08:19:52.285237Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.08774","last_updated":"2026-05-09T08:00:59Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:00:59Z","title":"ProcVLM: Learning Procedure-Grounded Progress Rewards for Robotic Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T01:40:22.192349Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.08774"},"observation_digest":"sha256:d71759f30b1fe09a96d7ed161da9f9c638c0e35e2df7f66f1fcaa7b0405e6a83","observation_id":"cea9e3d8-b191-4f83-ac5b-e72cab9015ed","resolution":{"observed_at":"2026-05-12T01:41:20.081536Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.09410","last_updated":"2026-05-10T08:24:05Z","snapshot_observed_at":"2026-08-02T13:43:45.064816Z","submitted_at":"2026-05-10T08:24:05Z","title":"RePO-VLA: Recovery-Driven Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T04:39:32.715650Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.09410"},"observation_digest":"sha256:e60159f2704940158e2843f2f650302095f182311645d76592c7449d60ce39d8","observation_id":"642b95dc-67fa-4f8e-8b92-201795b07d38","resolution":{"observed_at":"2026-05-12T06:01:25.887746Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.10821","last_updated":"2026-07-16T12:45:34Z","snapshot_observed_at":"2026-08-02T14:25:58.642997Z","submitted_at":"2026-05-11T16:37:34Z","title":"UniSteer: Unified Noise Steering for Efficient Human-Guided VLA Adaptation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T04:08:43.222818Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.10821"},"observation_digest":"sha256:44137680c7304d5fcee94f3b6a54491777fabaeff1ca22e341aa5f672b5aba40","observation_id":"cee6d915-3da8-49d6-96cb-a32a0428e05d","resolution":{"observed_at":"2026-05-12T06:36:25.616019Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-02T14:26:01.108089Z","title":"π∗ 0.6: A VLA That Learns From Experience.arXiv preprint arXiv:2511.14759, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.10821","last_updated":"2026-07-16T12:45:34Z","snapshot_observed_at":"2026-08-02T14:25:58.642997Z","submitted_at":"2026-05-11T16:37:34Z","title":"UniSteer: Unified Noise Steering for Efficient Human-Guided VLA Adaptation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T14:26:01.108089Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.10821"},"observation_digest":"sha256:ec83e341f6f50f56bf90df1a48a5a1febba1c6dced59efea1bea114bf1ffca71","observation_id":"3ee5fb14-c9e3-499d-8773-69be5697373f","resolution":{"observed_at":"2026-08-02T14:26:01.108089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.11479","last_updated":"2026-05-12T03:54:30Z","snapshot_observed_at":"2026-07-31T21:57:54.016992Z","submitted_at":"2026-05-12T03:54:30Z","title":"Offline Policy Evaluation for Manipulation Policies via Discounted Liveness Formulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T02:14:57.505609Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.11479"},"observation_digest":"sha256:6ffb601e8a27c5f78c331bc5f6b96edfa706010a675140dda357fa46abfb9833","observation_id":"243ca8ad-4a03-4ec7-b345-de498c102a9b","resolution":{"observed_at":"2026-05-13T02:17:06.392865Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.12236","last_updated":"2026-05-12T15:07:04Z","snapshot_observed_at":"2026-08-03T01:51:28.024049Z","submitted_at":"2026-05-12T15:07:04Z","title":"TMRL: Diffusion Timestep-Modulated Pretraining Enables Exploration for Efficient Policy Finetuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T04:22:07.953637Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.12236"},"observation_digest":"sha256:94474de9c48cdb42a1a7a8e4e2e01a89972722136870a10d5a0880f14a721220","observation_id":"e4264a32-1d3d-49d1-9a89-c8c7440005cb","resolution":{"observed_at":"2026-05-13T04:22:14.539966Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.12334","last_updated":"2026-05-20T07:28:11Z","snapshot_observed_at":"2026-07-06T23:24:03.984179Z","submitted_at":"2026-05-12T16:16:15Z","title":"Reinforcing VLAs in Task-Agnostic World Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T04:17:51.349213Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.12334"},"observation_digest":"sha256:1b17755e4974f10b6525d32236594b6db98358c4271f898ec8b6c780b341a5b9","observation_id":"477f222f-4cf3-4775-8aec-db52d2a03170","resolution":{"observed_at":"2026-05-13T04:22:14.806687Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.12334","last_updated":"2026-05-20T07:28:11Z","snapshot_observed_at":"2026-07-06T23:24:03.984179Z","submitted_at":"2026-05-12T16:16:15Z","title":"Reinforcing VLAs in Task-Agnostic World Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T08:13:40.975340Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.12334"},"observation_digest":"sha256:d764f6901968b277cad25158e4d68a68db5c8309ef48dbccedea756266495e0b","observation_id":"d6057664-e984-408a-8b65-ccf9339154e9","resolution":{"observed_at":"2026-05-21T08:14:03.120777Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.12651","last_updated":"2026-05-14T01:44:18Z","snapshot_observed_at":"2026-07-06T23:24:18.302402Z","submitted_at":"2026-05-12T18:57:25Z","title":"Runtime Monitoring of Perception-Based Autonomous Systems via Embedding Temporal Logic","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-14T21:33:43.740593Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.12651"},"observation_digest":"sha256:5fc02ec5af4798226eee9a7bfbafcec8744a77833096126b47c6c184689440a2","observation_id":"0d479dcf-08d8-4105-a675-33e93d0b1b76","resolution":{"observed_at":"2026-05-14T21:38:01.112967Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.12651","last_updated":"2026-05-14T01:44:18Z","snapshot_observed_at":"2026-07-06T23:24:18.302402Z","submitted_at":"2026-05-12T18:57:25Z","title":"Runtime Monitoring of Perception-Based Autonomous Systems via Embedding Temporal Logic","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-15T05:03:14.358407Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.12651"},"observation_digest":"sha256:a393be34ca0192f4f64d680ee28d3274a26422186c80dc9204eafd18cbd09cbb","observation_id":"708bd060-aef4-4677-b570-80664becf849","resolution":{"observed_at":"2026-05-15T05:05:01.918390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.13403","last_updated":"2026-05-13T11:58:02Z","snapshot_observed_at":"2026-07-06T23:24:57.051440Z","submitted_at":"2026-05-13T11:58:02Z","title":"RotVLA: Rotational Latent Action for Vision-Language-Action Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-14T17:48:06.734816Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.13403"},"observation_digest":"sha256:fbd48efa51cd42bb3fffd692036ac1cb319d2be2abc61af6982d5a48c114e57c","observation_id":"0528ad19-a077-4bd0-8fb8-1e9a2e37f3c6","resolution":{"observed_at":"2026-05-14T17:49:23.121112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.14950","last_updated":"2026-05-14T15:21:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-14T15:21:36Z","title":"Evo-Depth: A Lightweight Depth-Enhanced Vision-Language-Action Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T21:39:15.662180Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.14950"},"observation_digest":"sha256:d103e36e70763b8d20bd5c1dd7a3829ad090377aa19497a4bdd76298ecdab4d6","observation_id":"af909c11-c285-409d-b62a-a28fbf9940b2","resolution":{"observed_at":"2026-07-01T14:25:46.144820Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.15157","last_updated":"2026-05-20T14:31:09Z","snapshot_observed_at":"2026-08-06T16:24:53.794812Z","submitted_at":"2026-05-14T17:51:40Z","title":"Hand-in-the-Loop: Improving VLA Policies for Dexterous Manipulation via Seamless Hand-Arm Intervention","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T03:09:26.858170Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.15157"},"observation_digest":"sha256:0a63d94d38cdde87aa83ce2eb72b4062b1045cafba9dd6e9edc82e962b617544","observation_id":"11c89708-b46b-4666-8511-5819eda6a17f","resolution":{"observed_at":"2026-05-15T03:09:42.194160Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.15157","last_updated":"2026-05-20T14:31:09Z","snapshot_observed_at":"2026-08-06T16:24:53.794812Z","submitted_at":"2026-05-14T17:51:40Z","title":"Hand-in-the-Loop: Improving VLA Policies for Dexterous Manipulation via Seamless Hand-Arm Intervention","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T08:31:57.077346Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.15157"},"observation_digest":"sha256:1fbe235e4c75ce2cd96a6ddd2497308b178bbae33f7c998cf592b8d48dc0c356","observation_id":"547d1aa1-9442-4d13-adb5-101ebdf8b4ec","resolution":{"observed_at":"2026-05-21T08:34:05.577883Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.17517","last_updated":"2026-05-17T16:02:05Z","snapshot_observed_at":"2026-07-06T23:28:30.942078Z","submitted_at":"2026-05-17T16:02:05Z","title":"AffordVLA: Injecting Affordance Representations into Vision-Language-Action Models via Implicit Feature Alignment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T12:49:02.418663Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.17517"},"observation_digest":"sha256:4e4bb44cd0278e0fb302b1891f0b3713fc4ad378ad098dd5f88d2cb22f5edafc","observation_id":"bbf4e9fb-371b-497c-bc86-212e66694060","resolution":{"observed_at":"2026-05-20T12:53:17.733969Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.18617","last_updated":"2026-05-18T16:26:22Z","snapshot_observed_at":"2026-08-02T22:44:13.274745Z","submitted_at":"2026-05-18T16:26:22Z","title":"ManiSoft: Towards Vision-Language Manipulation for Soft Continuum Robotics","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T09:55:17.865828Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.18617"},"observation_digest":"sha256:7e302b36a318518d43eef2456095214b299107b46bc67aea3d77b0b35f238ea7","observation_id":"a8ad6fdb-2863-43b8-8ae3-94d9e214331b","resolution":{"observed_at":"2026-05-20T09:58:11.298331Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.19678","last_updated":"2026-05-19T11:10:20Z","snapshot_observed_at":"2026-08-02T07:06:49.830838Z","submitted_at":"2026-05-19T11:10:20Z","title":"RoVLA: Multi-Consistency Constraints for Robust Vision-Language-Action Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T04:48:39.069675Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.19678"},"observation_digest":"sha256:0eb558506cd9713378417750c1f03319f9081b63a3d9f012e08bdedaefb0671e","observation_id":"1bbed8e8-9328-4cbb-9cdf-cc0c8222db22","resolution":{"observed_at":"2026-05-20T04:53:04.916497Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.19919","last_updated":"2026-05-19T14:43:26Z","snapshot_observed_at":"2026-07-06T23:30:35.042915Z","submitted_at":"2026-05-19T14:43:26Z","title":"Beyond Action Residuals: Real-World Robot Policy Steering via Bottleneck Latent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:45.553510Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.19919"},"observation_digest":"sha256:dd348583022adb7f6971ac8cfe351f284cab85fbe1b0a73c3af1585b12f53216","observation_id":"403221ff-756d-48c9-a339-941450a8772b","resolution":{"observed_at":"2026-05-20T05:13:03.351681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.20774","last_updated":"2026-05-20T06:15:30Z","snapshot_observed_at":"2026-07-06T23:31:18.520630Z","submitted_at":"2026-05-20T06:15:30Z","title":"VLA-REPLICA: A Low-Cost, Reproducible Benchmark for Real-World Evaluation of Vision-Language-Action Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T04:58:35.695638Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.20774"},"observation_digest":"sha256:a204c1660819e4db17508ea3a86435959ac7a26c6874d328393a9c729df7138a","observation_id":"91aab0bf-fc79-4861-be4e-4ae4888e955c","resolution":{"observed_at":"2026-05-21T04:59:36.440417Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.22570","last_updated":"2026-05-21T14:48:35Z","snapshot_observed_at":"2026-08-02T20:47:32.000183Z","submitted_at":"2026-05-21T14:48:35Z","title":"VGenST-Bench: A Benchmark for Spatio-Temporal Reasoning via Active Video Synthesis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:02.612292Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.22570"},"observation_digest":"sha256:0dae4e252af9167cb520041dcdd9d10232d362d8ecdb826b986f7bb342ccfb78","observation_id":"4dbb3016-900d-4394-90f8-4d375e570ff3","resolution":{"observed_at":"2026-05-22T07:14:42.831553Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.25029","last_updated":"2026-05-26T07:39:20Z","snapshot_observed_at":"2026-08-02T03:12:06.012812Z","submitted_at":"2026-05-24T12:09:53Z","title":"ParkingWorld: End-to-End Autonomous Parking Reinforcement Learning from Corrective Experience in 3DGS Simulation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T00:26:22.777878Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.25029"},"observation_digest":"sha256:7955579a65aeed15568e1e3d719bfaaa9b2528eca978013c882e5eee280c4a65","observation_id":"74fd6aeb-5451-4804-992f-b9c84461e9ca","resolution":{"observed_at":"2026-07-01T16:35:50.720005Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.25477","last_updated":"2026-05-25T06:31:03Z","snapshot_observed_at":"2026-08-06T17:11:50.083428Z","submitted_at":"2026-05-25T06:31:03Z","title":"EXPO-FT: Sample-Efficient Reinforcement Learning Finetuning for Vision-Language-Action Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T22:10:08.682307Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.25477"},"observation_digest":"sha256:79761d8d74c24c6f258dd2c3386d8b7549b3d25d4343731471ec4a1bfaf59c3b","observation_id":"29701e97-9c2c-43b4-9f76-3528a17411ff","resolution":{"observed_at":"2026-06-29T22:13:59.942734Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.25547","last_updated":"2026-05-25T08:03:31Z","snapshot_observed_at":"2026-08-03T06:30:00.604600Z","submitted_at":"2026-05-25T08:03:31Z","title":"TapSampling: Inference-Time Sampling with a Task-Progress-Understanding Verifier for Robotic Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T21:55:45.761276Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.25547"},"observation_digest":"sha256:1389c642717ac61b80450afd972a70fb675b12fa408c2c0ff70b8dd5e2dca7bb","observation_id":"36e776f9-fe90-4494-9c13-671cb8343c63","resolution":{"observed_at":"2026-06-29T22:04:00.522441Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.27079","last_updated":"2026-05-26T14:28:43Z","snapshot_observed_at":"2026-08-06T11:52:18.846480Z","submitted_at":"2026-05-26T14:28:43Z","title":"Trust Region Q Adjoint Matching","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T19:04:04.109255Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.27079"},"observation_digest":"sha256:b256d18db01ec6281efceb70785dab304a5de7b5934fa51b476a11c22c3b63c1","observation_id":"7d89163c-bb81-4dd7-b6c4-3e9bb2facfbe","resolution":{"observed_at":"2026-06-29T19:13:52.794109Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.29710","last_updated":"2026-05-28T10:10:19Z","snapshot_observed_at":"2026-07-06T23:39:05.858969Z","submitted_at":"2026-05-28T10:10:19Z","title":"PhAIL: A Real-Robot VLA Benchmark and Distributional Methodology","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T06:45:09.301480Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.29710"},"observation_digest":"sha256:5204695dbe5e7ea36fcc92ed44f027562d5c0cd5121e99a85f7a3a6dd36a3925","observation_id":"0e1d34ea-87b6-4f86-b9e3-ff665c722e1f","resolution":{"observed_at":"2026-06-29T14:13:31.047658Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.29766","last_updated":"2026-05-28T11:12:30Z","snapshot_observed_at":"2026-08-06T14:22:48.888510Z","submitted_at":"2026-05-28T11:12:30Z","title":"MARS Policy: Multimodality Only When It Matters","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T06:42:33.949547Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.29766"},"observation_digest":"sha256:6a2f83df5915866a517fca8a01039c6155238e7c5601a3a8a8acf304d7d183a0","observation_id":"12a7c66d-2bfb-47dd-b1a9-86fc9af5fb00","resolution":{"observed_at":"2026-06-29T06:43:10.272087Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.30226","last_updated":"2026-06-06T09:12:27Z","snapshot_observed_at":"2026-08-01T05:57:18.931232Z","submitted_at":"2026-05-28T16:57:47Z","title":"BORA: Bridging Offline Reinforcement Learning and Online Residual Adaptation for Real-World Dexterous VLA Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T07:18:59.266263Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.30226"},"observation_digest":"sha256:99143f73d83050efa68efb51a8d6bd330e911a29a09516ce6b62bcd228ceabae","observation_id":"e894690e-f8fd-47ba-8873-8d707a76205a","resolution":{"observed_at":"2026-06-29T07:23:12.765963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.30795","last_updated":"2026-05-29T03:36:33Z","snapshot_observed_at":"2026-08-06T07:43:56.405148Z","submitted_at":"2026-05-29T03:36:33Z","title":"Feat2Go: Visual Feature-Grounded Value Estimation for Embodied Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T22:41:42.394450Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.30795"},"observation_digest":"sha256:0646ce8b0f0fdefc9f90407f260e6bb3515eabbffa727435c6b048403763f9e9","observation_id":"14378c67-19f3-4148-9481-a6f631bf846f","resolution":{"observed_at":"2026-06-28T22:42:46.165638Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.30834","last_updated":"2026-05-29T04:40:12Z","snapshot_observed_at":"2026-08-05T19:24:52.553229Z","submitted_at":"2026-05-29T04:40:12Z","title":"Hide-and-Seek in Trajectories: Discovering Failure Signals for VLA Runtime Monitoring","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T22:39:15.211339Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.30834"},"observation_digest":"sha256:6f6cbd1a73c21a0b59ef6a5a9fdd3881a59adf957c24394e024499e596569a4a","observation_id":"c7c2f300-52f1-4ac5-99ad-46e28abb972f","resolution":{"observed_at":"2026-06-28T22:42:46.564956Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.31286","last_updated":"2026-06-16T07:14:11Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T13:20:08Z","title":"DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T21:58:48.611343Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.31286"},"observation_digest":"sha256:262a8afef0492fcba80702fa3728024c2f007e01d9d573d3b3723601744cc207","observation_id":"f25ab638-847b-491d-a10f-6304913606e0","resolution":{"observed_at":"2026-07-01T19:56:10.403716Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2606.01865","last_updated":"2026-06-01T08:14:38Z","snapshot_observed_at":"2026-08-02T00:20:06.187145Z","submitted_at":"2026-06-01T08:14:38Z","title":"Set-Supervised Diffusion Policy: Learning Action-Chunking Diffusion through Corrections","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T14:25:37.987916Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2606.01865"},"observation_digest":"sha256:27e6bd86da3dcc867644e40e881a2b439c928592eee42734a058373cdbe838f5","observation_id":"e04488e6-68e4-4b8f-bb07-81620419a62e","resolution":{"observed_at":"2026-07-01T23:26:21.980669Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2606.03385","last_updated":"2026-06-02T09:29:03Z","snapshot_observed_at":"2026-07-06T23:43:40.769504Z","submitted_at":"2026-06-02T09:29:03Z","title":"Grasp-Then-Plan with Failure Attribution: A Closed Two-Stage Framework for Precise and Generalizable Robotic Manipulation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-28T09:37:58.434897Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2606.03385"},"observation_digest":"sha256:535299649d768f31e0f1aee4a45517acabc310af50d63eb87dc792aa72b66b68","observation_id":"b8fd35c3-3510-4838-bb18-a42bc7998cad","resolution":{"observed_at":"2026-07-02T03:56:34.450797Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2606.05468","last_updated":"2026-06-03T21:47:43Z","snapshot_observed_at":"2026-07-06T23:45:28.379468Z","submitted_at":"2026-06-03T21:47:43Z","title":"FlowPRO: Reward-Free Reinforced Fine-Tuning of Flow-Matching VLAs via Proximalized Preference Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T05:38:11.089753Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2606.05468"},"observation_digest":"sha256:fd573a5ebf67cb8f3bc40693f06bace60918997ee82890e5689e20bd1ebe6024","observation_id":"1b030e9c-c707-4ca2-9d50-7611f9179f14","resolution":{"observed_at":"2026-07-02T09:06:49.372377Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2606.06627","last_updated":"2026-06-04T18:24:23Z","snapshot_observed_at":"2026-08-02T21:21:58.611249Z","submitted_at":"2026-06-04T18:24:23Z","title":"What Matters When Cotraining Robot Manipulation Policies on Everyday Human Videos?","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T01:04:26.608953Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2606.06627"},"observation_digest":"sha256:55996da4c0e790a3293de9cbeece855c5cb860901a94faf1eaac1d6207b5bc4b","observation_id":"d554ed0a-01b6-471c-93d0-a43f932aa4e7","resolution":{"observed_at":"2026-07-02T13:46:58.988013Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2606.07723","last_updated":"2026-06-05T16:21:27Z","snapshot_observed_at":"2026-08-02T03:37:35.733251Z","submitted_at":"2026-06-05T16:21:27Z","title":"VoLo: A Physical Orchestrator for Open-Vocabulary Long-Horizon Manipulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T21:40:00.330510Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2606.07723"},"observation_digest":"sha256:c65dc6ca11e1cb094ad53ca300c31374279728ec9236edf060cc3db8a91d2219","observation_id":"651a7c5f-a301-4467-86d2-997c9a4ff715","resolution":{"observed_at":"2026-07-02T19:07:18.115064Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2606.08414","last_updated":"2026-06-07T02:27:53Z","snapshot_observed_at":"2026-08-02T16:28:12.615829Z","submitted_at":"2026-06-07T02:27:53Z","title":"PACT: Self-Evolving Physical Safety Alignment for Diffusion Policies in Embodied Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2606.08414"},"observation_digest":"sha256:8bbd9d650b5ca0bd1c7c4ecb42188933f114aaac551af5752e54865bbc8bdc7a","observation_id":"3486b7c9-061a-4cc8-b3b9-e2968784ef6a","resolution":{"observed_at":"2026-06-27T18:51:07.725191Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2606.09009","last_updated":"2026-06-08T04:13:38Z","snapshot_observed_at":"2026-08-05T08:14:57.435064Z","submitted_at":"2026-06-08T04:13:38Z","title":"Scaling by Diversified Experience for Vision-Language-Action Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T17:12:50.216492Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2606.09009"},"observation_digest":"sha256:13ea7de5598a43882222815d772df62c5f16bd5d6dd608ee210a7ca956f075c0","observation_id":"7febade0-ee7d-4ffe-89c9-bbe104161c40","resolution":{"observed_at":"2026-07-03T00:27:29.754454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2606.09337","last_updated":"2026-06-16T02:41:26Z","snapshot_observed_at":"2026-08-01T15:23:43.890468Z","submitted_at":"2026-06-08T11:05:05Z","title":"TORL-VLA: Tactile Guided Online Reinforcement Learning for Contact-Rich Manipulation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T16:30:35.385161Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2606.09337"},"observation_digest":"sha256:d581a5729af75eafbea96984db843876d649261d49ec6a966b8ec99110003670","observation_id":"dd797f3e-e316-42e9-84b0-789fbdbef3d1","resolution":{"observed_at":"2026-07-03T01:27:31.335128Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2606.09615","last_updated":"2026-06-08T15:21:45Z","snapshot_observed_at":"2026-08-03T16:03:00.502890Z","submitted_at":"2026-06-08T15:21:45Z","title":"DexPIE: Stable Dexterous Policy Improvement from Real-World Experience","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T16:47:22.504175Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2606.09615"},"observation_digest":"sha256:c8de45fc3d6d2bdea3a4109b6a32a4ea20af0427b3450b766d4bdbcade631ab1","observation_id":"db3cb8b3-808f-41af-bd49-de6b64e2e1f9","resolution":{"observed_at":"2026-07-03T01:07:30.747483Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2511.14759/citation-record","integrity":"/paper/2511.14759/integrity","json":"/paper/2511.14759/citation-record.json","paper":"/paper/2511.14759"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MIT press","venue":null,"work_id":"1518ae97-29c3-4c37-bb5d-b99b528538da","year":2018},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:d5e161c9d5691cfa05e260f2a71919b1459fc03a2ef6b69b93de72fb1823a1d6","observation_id":"5dcd0a3f-fb95-4417-97d6-22b819deb5dc","resolution":{"observed_at":"2026-05-12T10:34:59.628520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-642-27645-3","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Riedmiller","venue":"Adaptation, learning, and optimization","work_id":"8037bc39-a67b-4d8f-8170-086a860b550d","year":2012},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:0de6b387a3fc5b98699f89b155b12c23b6b9bbc1594bab9d0aaac086ef2e7778","observation_id":"f2239f95-3fb5-48ad-8321-dbd2b30598d7","resolution":{"observed_at":"2026-05-12T10:34:59.202868Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":"2005.01643","doi":"10.1613/jair.1.17526","metadata_source":"pith","pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","venue":"cs.LG","work_id":"597b6f46-d60f-451f-8f34-7d32876a9014","year":2020},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:1e8ff48db3ee1debe3a678b5b7a17aa878bc960dbae80dee6ab0daf43bfa714f","observation_id":"a8beca63-e9f0-4739-8ca2-675a1853e085","resolution":{"observed_at":"2026-05-12T10:34:59.242880Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23458","last_updated":"2025-05-29T14:06:50Z","snapshot_observed_at":"2026-07-06T21:32:57.510891Z","submitted_at":"2025-05-29T14:06:50Z","title":"Diffusion Guidance Is a Controllable Policy Improvement Operator","version":1},"cited_work":{"arxiv_id":"2505.23458","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23458","snapshot_observed_at":"2026-07-04T16:39:58.122193Z","title":"Diffusion guidance is a controllable policy im- provement operator.arXiv preprint arXiv:2505.23458","venue":null,"work_id":"85c1b3dc-42d2-4b34-9b85-9da92334b592","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2505.23458","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:03a0e7dd421a34627df0c5cdabf3966bd87c31510f8ad2f77490d824e186e946","observation_id":"c674f213-37de-4d0d-bacb-bec5bad07779","resolution":{"observed_at":"2026-05-12T10:34:59.250729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In9th Annual Conference on Robot Learning","venue":null,"work_id":"e143aaff-d66d-4b8e-b2d2-3cb3b520c62c","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:221b2fa5bc43dec2944400edab8deb7f229f80e01ad45975dc92e7b370ce1dcc","observation_id":"e437fd5b-1f71-4cab-9bd9-9a33ad1c500c","resolution":{"observed_at":"2026-05-12T10:34:59.640156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"94a0faef-63d0-44fd-9e25-d73f63d8061c","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:2d8360d7a2905d1d07108e65140cf9d572e54260c391dbd68265a3f8dcfdeb69","observation_id":"fa478c9a-afc6-40cc-bcc5-c80fd89d0599","resolution":{"observed_at":"2026-05-12T10:34:59.529595Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning","venue":null,"work_id":"60e04942-0d1e-4f64-9eea-d6509a5fab31","year":null},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:eb450a0f27f9c78fa487927db5d78bc68aeedc65600f881eaca65124a939a015","observation_id":"12c10b72-88f9-4ac2-8cc5-ff4de9f5fbd4","resolution":{"observed_at":"2026-05-12T10:34:59.525394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shiv: Reducing supervisor burden in dagger using support vectors for efficient learning from demonstrations in high dimensional state spaces","venue":null,"work_id":"c2103144-6fed-4a8b-b4c1-82e4b7edd9dd","year":2016},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:e9076011bd167a4f3f626da2303e0ecde0903ec8bd1a5cfc03f048b6acc5066b","observation_id":"63c05c4a-f4c5-4ae9-9545-65a8bf51f63f","resolution":{"observed_at":"2026-05-12T10:34:59.620826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.748717","doi":"10.1109/icra.2016.7487170","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: 2016 IEEE International Conference on Robotics and Automation, pp","venue":null,"work_id":"1b194b2f-e005-4795-af97-74aead57e773","year":2016},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:ea2b40de93c138d20fc9723bd4ddc958be3912be33b99bd8159418c711ebe05c","observation_id":"33adf923-a9f3-4145-8b09-b9e428f2244d","resolution":{"observed_at":"2026-05-12T10:34:59.184958Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dra- gan, and Ken Goldberg","venue":null,"work_id":"4606772b-f7c4-4ae0-a23e-4fdad4799263","year":1989},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:824819cd47fb7ab3b26b82ae13d00cedc2fe453e1a68a9d9d76e748fe097a405","observation_id":"f7eb68c1-41c6-44a2-aec1-1b761dbb3a5f","resolution":{"observed_at":"2026-05-12T10:34:59.616102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bc-z: Zero-shot task generalization with robotic imitation learning","venue":null,"work_id":"d9e476af-81b6-4ff6-8b2d-af0218626881","year":2022},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:3a31a124a7db65f584f8ecf0b5ef669cf204424ce507b2063a8ac14156f41f08","observation_id":"10f7c1e5-0b4e-4858-a56c-9f0e7db0931d","resolution":{"observed_at":"2026-05-12T10:34:59.563569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07953","last_updated":"2025-09-09T17:41:29Z","snapshot_observed_at":"2026-08-04T21:32:53.985511Z","submitted_at":"2025-09-09T17:41:29Z","title":"RaC: Robot Learning for Long-Horizon Tasks by Scaling Recovery and Correction","version":1},"cited_work":{"arxiv_id":"2509.07953","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.07953","snapshot_observed_at":"2026-07-03T12:28:07.233597Z","title":"Rac: Robot learning for long-horizon tasks by scaling recovery and correction","venue":null,"work_id":"0d6ddd41-d7e6-4fb7-aa20-a1a734ca73cb","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2509.07953","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:aee4f04159aeda41b4194a14db0f34168916f651c7038c0019c5e728ee49f302","observation_id":"a06ac923-93be-4b52-bcbf-00d503e5f779","resolution":{"observed_at":"2026-05-12T10:34:59.258097Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hg-dagger: Inter- active imitation learning with human experts","venue":null,"work_id":"81ebf88f-6aa9-42e1-a2d1-6ac033962db3","year":null},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:3f641d3db17ff163812e013da399738f1c391ad631723000f5759c3068361054","observation_id":"30bf1ff6-c63f-49b3-9388-2e56e7ccbbee","resolution":{"observed_at":"2026-05-12T10:34:59.539271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"End-to-end training of deep visuomotor policies","venue":null,"work_id":"3f0911ac-497d-463d-b31d-e178030b79e2","year":2016},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:38b2edfe34670f48738430b8f9225f41c70ef50edab97c5951f912238c7c80c3","observation_id":"d8e94625-a3ca-4068-9548-1bd8780f0867","resolution":{"observed_at":"2026-05-12T10:34:59.544242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.10293","last_updated":"2018-11-28T02:40:54Z","snapshot_observed_at":"2026-08-02T20:30:39.614115Z","submitted_at":"2018-06-27T04:34:30Z","title":"QT-Opt: Scalable Deep Reinforcement Learning for Vision-Based Robotic Manipulation","version":3},"cited_work":{"arxiv_id":"1806.10293","doi":"10.48550/arxiv.1806.10293","metadata_source":"pith","pith_arxiv_id":"1806.10293","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"QT-Opt: Scalable Deep Reinforcement Learning for Vision-Based Robotic Manipulation","venue":"cs.LG","work_id":"9a64fd9b-aa3d-48af-ac99-b368b857a6e0","year":2018},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/1806.10293","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:594f3858cb332ccca1aa8de6519ff976a14139a85e0e6106f80ebe7af5bec9d7","observation_id":"0a795517-5ea7-4ca0-922b-cf519cd4f3a5","resolution":{"observed_at":"2026-05-12T10:34:59.265492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Iris: Implicit reinforcement without interaction at scale for learning control from offline robot manipulation data.ICRA","venue":null,"work_id":"a53dc556-30be-4789-a156-07b9faa089fa","year":2020},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:60e4f0b22cb523f58b7e92d6d0e31125d91af7c64593a0d0ea6f1cf0d13295a0","observation_id":"245d0e33-8e3a-4f39-83f8-c0095b40de9c","resolution":{"observed_at":"2026-05-12T10:34:59.553493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ahmed Ahmed Rehaan Ahmad, and Chelsea Finn","venue":null,"work_id":"08fa7d69-b3f3-4c85-918e-d920dd9dc92e","year":2023},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:7a8e7bfe86d64e0ab20b41fcb752d88a755087fab2138b7c66ba76766d1c6c0b","observation_id":"a4612fd2-75cd-4478-a963-e12d53ba35aa","resolution":{"observed_at":"2026-05-12T10:34:59.558379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8891.2023","doi":"10.1109/icra48891.2023","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ImmFusion: Robust mmWave-RGB Fusion for 3D Human Body Reconstruction in All Weather Conditions","venue":null,"work_id":"fafcadb0-b1fa-4b90-99aa-b36501c38439","year":2023},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:f2f8243e679aa6eef8e1049ecde5b12a7747fbd231339f8fbb09dff347722a08","observation_id":"0b5ab1bd-e684-4e94-a076-009a709ce7c0","resolution":{"observed_at":"2026-05-12T10:34:59.197814Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T16:19:16.40985+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T16:19:16.40985+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continuously improving mobile manipulation with autonomous real- world rl","venue":null,"work_id":"bdec5419-3bcc-4ee8-8447-22ed8f15275e","year":2024},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:0e661716e6edf5949d867490645740a32e5982ad8e1d6c2230fd06f3d65fa4f6","observation_id":"feb8868e-dfd1-4400-be0a-29b092bf2ad3","resolution":{"observed_at":"2026-05-12T10:34:59.568147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Serl: A software suite for sample-efficient robotic reinforcement learning","venue":null,"work_id":"15d81870-15a0-426b-8339-2ac024988f3b","year":2024},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:3f423722fa4d79e9e8b2576e6f14d8676571af5fd351a943ba2a13964065f146","observation_id":"6ce860c6-f134-4433-9a46-83bc854ad6ae","resolution":{"observed_at":"2026-05-12T10:34:59.573045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.19301","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T11:44:51.158325Z","title":"Residual off-policy rl for finetuning behavior cloning policies","venue":null,"work_id":"a144d66c-793a-49ae-b1e2-c599b4575cdc","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:b1e39499c9d16a597e0729e2e0ba19b261d80a00e38b1bcf8bccab26ad08cfbd","observation_id":"9aa860a1-91ee-41a7-947e-78bd7d88c623","resolution":{"observed_at":"2026-05-12T10:34:59.277473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7147.2024","doi":"10.1109/icra57147.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"10610948","venue":null,"work_id":"be79e919-e91f-4ecb-8b06-6b3091bc58b1","year":2024},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:19efee08bceb874c7b63c54b0005caf9d7e07229617330a2bbba6cbd09e04dbc","observation_id":"08871e90-a466-4c7c-a63d-0d90562e2a38","resolution":{"observed_at":"2026-05-12T10:34:59.285013Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-16T19:20:42.872084+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-16T19:20:42.872084+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08078","last_updated":"2025-05-12T21:24:22Z","snapshot_observed_at":"2026-07-06T21:22:55.485833Z","submitted_at":"2025-05-12T21:24:22Z","title":"What Matters for Batch Online Reinforcement Learning in Robotics?","version":1},"cited_work":{"arxiv_id":"2505.08078","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.08078","snapshot_observed_at":"2026-07-04T09:59:44.530943Z","title":"What matters for batch online re- inforcement learning in robotics?arXiv preprint","venue":null,"work_id":"6b041202-d302-4823-8aa9-467962bc63df","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2505.08078","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:ac031e31bcc70427610199dd608b2f4b2421a2fbec951479dfb5734148ab0fe9","observation_id":"7915e3fe-a197-4270-b62c-5412084809c3","resolution":{"observed_at":"2026-05-12T10:34:59.291343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ren, Justin Lidard, Lars Lien Ankile, Anthony Simeonov, Pulkit Agrawal, Anirudha Majumdar, Ben- jamin Burchfiel, Hongkai Dai, and Max Simchowitz","venue":null,"work_id":"ff360df5-247b-47dd-ac2d-e17ef4ec8772","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:55bd40822c48ad4df69be91a237e1baa29528916a49aa07a3623f646b221c5e1","observation_id":"8abd7861-ce6c-4201-870a-edd8d0987e0d","resolution":{"observed_at":"2026-05-12T10:34:59.591296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.14830","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.069069Z","title":"Rl-100: Performant robotic manipulation with real-world reinforcement learning","venue":null,"work_id":"a238fe03-5281-4ba1-9da7-5b7129dad2c6","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:6227957d5b8064c2b3bf86d3eafa280a38af330cd8bee6dd9cead86c969095fd","observation_id":"c7f91144-73d1-4c16-b0c5-a6bb0338e430","resolution":{"observed_at":"2026-05-12T10:34:59.298836Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mt-opt: Continuous multi- task robotic reinforcement learning at scale.arXiv","venue":null,"work_id":"c307f2cf-a960-4c10-b8d8-1fe532744b69","year":2021},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:b80ebddacdf8dd6d84afdf4ac1e2b5415fd10e59bef7e3e6a445787d6a257da7","observation_id":"78e5e364-1465-43f5-ab5e-307a1dc66238","resolution":{"observed_at":"2026-05-12T10:34:59.602663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhao, Vikash Kumar, Aaron Rovinsky, Kelvin Xu, Thomas Devlin, and Sergey Levine","venue":null,"work_id":"b06b6ecf-6364-429a-9079-f798ec7989cc","year":2021},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:086f85218efd439cd55c4b40de4f08a13eba3c5cfdbdc5f6e2a3a473e2f14c08","observation_id":"1c0dd07e-16d1-4e17-bc8e-5406a3eb8608","resolution":{"observed_at":"2026-05-12T10:34:59.606908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11706","last_updated":"2023-12-22T13:55:42Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:35:20Z","title":"RoboCat: A Self-Improving Generalist Agent for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2306.11706","doi":"10.48550/arxiv.2306.11706","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11706","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robocat: A self-improving foundation agent for robotic manipulation","venue":"arXiv (Cornell University)","work_id":"143e7731-0488-4088-8e23-63f9d4140118","year":2023},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2306.11706","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:6f21e43a09e2dfa91ed165e15cafb2e89aebb08be76bf440945050683f92ef9d","observation_id":"52fe8996-0e6c-4e63-9037-c81cb7567ed4","resolution":{"observed_at":"2026-05-12T10:34:59.306163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.15607/rss.2023.xix.019","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pre-training for robots: Offline reinforcement learning enables learning new tasks from a handful of trials","venue":null,"work_id":"b5e1ca19-4ad5-4d9e-878a-9fa74554ca54","year":2023},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:5b7288889a75ef1c0f76bfdf65a8733a2b1ab86415793b4f27ff55763a278341","observation_id":"9d63d13e-2499-46c3-8d43-496b22386510","resolution":{"observed_at":"2026-05-12T10:34:59.190623Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7147.2024","doi":"10.1109/icra57147.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"10610948","venue":null,"work_id":"be79e919-e91f-4ecb-8b06-6b3091bc58b1","year":2024},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:a7198cb6ea1e12c30cd2ecf0ea3785043df341e4f6a2ee8aa12a820eb016820a","observation_id":"33e7d781-4892-4a66-b4e3-24285b00a19c","resolution":{"observed_at":"2026-05-12T10:34:59.228044Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-16T19:20:42.872084+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-16T19:20:42.872084+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17016","last_updated":"2025-05-22T17:59:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-22T17:59:45Z","title":"Interactive Post-Training for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":"2505.17016","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17016","snapshot_observed_at":"2026-07-04T20:50:12.325218Z","title":"Interactive Post-Training for Vision-Language-Action Models","venue":"cs.LG","work_id":"1ad0b2af-71bb-415b-b955-e3350f1a1ae8","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2505.17016","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:6c5722b6da6b69232804c48250223176fd9f9591528805ff9a7f0df3586fba9d","observation_id":"5f6ecec2-6ead-4619-853d-ba97fdcad20f","resolution":{"observed_at":"2026-05-21T14:25:47.344448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18719","last_updated":"2025-05-24T14:42:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-24T14:42:51Z","title":"VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.18719","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18719","snapshot_observed_at":"2026-07-10T23:07:47.932038Z","title":"VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning","venue":"cs.RO","work_id":"7bc1dc16-0cc4-4159-8dd5-180b59579c5e","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2505.18719","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:5a7f5322c0e5050c84b55db8872f27de4c47c28763f0afb76d6d0a6ee6474277","observation_id":"18c063c8-8a2b-4822-85b1-e981fe93cbcf","resolution":{"observed_at":"2026-05-16T12:55:40.591564Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.19789","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:50:12.348883Z","title":"What can rl bring to vla generalization? an empirical study.arXiv preprint arXiv:2505.19789","venue":null,"work_id":"c43a0a70-9b6b-42e1-9712-b9b19f7c90a7","year":2026},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:3c1a07ce18bd0bbd22d056c8204b5f87732a44d839c0667b2c7d326d9bf3181b","observation_id":"a31667a7-a6a9-471c-a68e-17e40c2c4aee","resolution":{"observed_at":"2026-05-12T10:34:59.325937Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.25889","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T09:09:43.358512Z","title":"pi rl: Online rl fine-tuning for flow-based vision-language-action mod- els.arXiv preprint arXiv:2510.25889","venue":null,"work_id":"30b95f4d-fe3e-40ff-9843-d80d1c9ed4ad","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:8141f71cc29a4c44adf76e6c1ab9feeba20175ba0931bb0d9833a5fef0e0f67b","observation_id":"c86132ea-c38b-4ca5-9eb4-75fb2e0eb079","resolution":{"observed_at":"2026-05-12T10:34:59.334967Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09674","last_updated":"2025-09-11T17:59:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-11T17:59:17Z","title":"SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2509.09674","doi":"10.48550/arxiv.2509.09674","metadata_source":"pith","pith_arxiv_id":"2509.09674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning","venue":"cs.RO","work_id":"56dc8355-0011-4fd6-8f89-a6ef5cb6933f","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2509.09674","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:c9ec2842db48487770ed8a1183fbdd4b2587d2c6100eca9c5ea5eef844f70dca","observation_id":"df616bc2-710d-412b-99d3-f631e51d532e","resolution":{"observed_at":"2026-05-15T08:02:11.500343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-07-06T20:27:09.296190Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:667e967a1d31cd9819c5f47a1001dd8500c07187757dc3fb2ba99e28b1f72655","observation_id":"96f1fb71-e18f-481e-972d-a1fafab88cf6","resolution":{"observed_at":"2026-05-12T10:34:59.347237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self- improving vision-language-action models with data gen- eration via residual rl","venue":null,"work_id":"c1dc7ac4-4ec2-4a95-8f37-76e89ce29b88","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:02dbbe3e7ff0e1097058238b9ebf3efe54e0d6139c14fd19b51f7f9b3277680c","observation_id":"2c61e69c-06d0-4bc3-a4a7-24f95a767725","resolution":{"observed_at":"2026-05-12T10:34:59.647039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05450","last_updated":"2025-04-14T04:53:32Z","snapshot_observed_at":"2026-08-01T15:07:04.704348Z","submitted_at":"2025-02-08T05:01:17Z","title":"ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy","version":2},"cited_work":{"arxiv_id":"2502.05450","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.05450","snapshot_observed_at":"2026-07-10T23:07:47.914406Z","title":"Conrft: A reinforced fine-tuning method for vla models via con- sistency policy.arXiv preprint arXiv:2502.05450","venue":"cs.RO","work_id":"12e4ef8e-5311-42c5-86de-e8a0c0a4c1c1","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2502.05450","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:381f927dd8f23ec74fe45e366a4d0d7be34b1c7878b8150dbb16c808d3998395","observation_id":"9cd1f206-e1e4-4e35-9094-886b02fa9b09","resolution":{"observed_at":"2026-05-12T10:34:59.353437Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06685","last_updated":"2024-12-09T17:28:03Z","snapshot_observed_at":"2026-07-06T20:04:01.034597Z","submitted_at":"2024-12-09T17:28:03Z","title":"Policy Agnostic RL: Offline RL and Online RL Fine-Tuning of Any Class and Backbone","version":1},"cited_work":{"arxiv_id":"2412.06685","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.06685","snapshot_observed_at":"2026-07-04T09:59:44.649113Z","title":"Policy agnos- tic rl: Offline rl and online rl fine-tuning of any class and backbone.arXiv preprint arXiv:2412.06685","venue":null,"work_id":"2a03f472-6dc4-47bc-b5f8-af24611f1bb0","year":2024},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2412.06685","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:206d2effe1ae3a3d818e78d9b3ef5c4935cdf34d8ea10c0b7a463a8f46468990","observation_id":"609b4a33-52c6-4b10-aecf-d739fcbb9438","resolution":{"observed_at":"2026-05-12T10:34:59.359504Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Steering your generalists: Improving robotic foundation models via value guidance","venue":null,"work_id":"f83dbcc0-3342-440d-a1dd-9de61de63b55","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:a571a314410319ac7b44934166fda1b18d8adf28057396cea9a04bf016c290c5","observation_id":"b240e196-727f-4d3d-a44f-6d163d7e5038","resolution":{"observed_at":"2026-05-12T10:34:59.664038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02055","last_updated":"2025-09-05T06:24:50Z","snapshot_observed_at":"2026-08-05T12:02:25.039196Z","submitted_at":"2025-09-02T07:51:59Z","title":"Align-Then-stEer: Adapting the Vision-Language Action Models through Unified Latent Guidance","version":2},"cited_work":{"arxiv_id":"2509.02055","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.02055","snapshot_observed_at":"2026-07-10T23:07:48.256339Z","title":"Align-then-steer: Adapting the vision-language action models through unified latent guidance","venue":"cs.RO","work_id":"7d3fd217-eb36-49a5-bfb0-4b27186ddad9","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2509.02055","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:d8b6838bbb4be87e6b690baadfb9b992e7fe7c238655fe6ad19891f150da57a5","observation_id":"2b94fcba-d01d-45a2-92f5-c1861269572d","resolution":{"observed_at":"2026-05-12T10:34:59.368442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Steering your diffusion policy with latent space reinforcement learning","venue":null,"work_id":"27424de3-9021-493f-bb26-bc7c6e8a1ebf","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:69905266b978f743efe5cd63b14cd2059d57c127c41fb23dd7a5e40948f637a8","observation_id":"87644b33-10a7-4362-a00a-c8c7bc9e6212","resolution":{"observed_at":"2026-05-12T10:34:59.459439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:2cf31e8728c3dff2f787d70abf52aa67fb061aae7c8bf7d0916d546bf48d3082","observation_id":"298d2bfe-c995-4e35-9711-a71c32863790","resolution":{"observed_at":"2026-05-12T10:34:59.374709Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02219","last_updated":"2025-08-04T09:11:48Z","snapshot_observed_at":"2026-08-06T05:08:48.697177Z","submitted_at":"2025-08-04T09:11:48Z","title":"CO-RFT: Efficient Fine-Tuning of Vision-Language-Action Models through Chunked Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2508.02219","doi":"10.48550/arxiv.2508.02219","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02219","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Co- rft: Efficient fine-tuning of vision-language-action mod- els through chunked offline reinforcement learning.arXiv preprint arXiv:2508.02219","venue":"ArXiv.org","work_id":"c3b588aa-69f3-4d05-96ad-d943ef851832","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2508.02219","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:79628ad8d4fab33dad2fbe4fad017a488dfcd7f488697d6c6ab8ea7bda6183b0","observation_id":"f3d6fb73-8d81-4939-ade9-134f28c319f0","resolution":{"observed_at":"2026-05-12T10:34:59.381175Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19309","last_updated":"2025-02-04T08:49:11Z","snapshot_observed_at":"2026-07-31T23:24:14.896271Z","submitted_at":"2024-11-28T18:30:10Z","title":"GRAPE: Generalizing Robot Policy via Preference Alignment","version":2},"cited_work":{"arxiv_id":"2411.19309","doi":"10.48550/arxiv.2411.19309","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.19309","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Grape: Generalizing robot policy via preference alignment","venue":"arXiv (Cornell University)","work_id":"5bd96935-22ff-44dd-b907-e5d9bba0d61f","year":2024},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2411.19309","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:c60a1bf41bff8c0799742b292c86661897386e49f3342110c268de18606cc187","observation_id":"1dd654af-0a47-4061-a394-7a1a3f3bf613","resolution":{"observed_at":"2026-05-12T10:34:59.387695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.15937","doi":"10.48550/arxiv.2509.15937","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A vision- language-action-critic model for robotic real-world rein- forcement learning.arXiv preprint arXiv:2509.15937","venue":"ArXiv.org","work_id":"c5793b2d-dc4a-475e-bda6-146050b50e48","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:9b4b91b991dcf04d6933e3d78bbf8acca55f726709440e5b34525fb7913844a3","observation_id":"6a4a20d1-9c89-4675-9771-3952f454a83e","resolution":{"observed_at":"2026-05-12T10:34:59.393800Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.15155","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:07:47.968597Z","title":"Self-improving embodied foundation models","venue":null,"work_id":"61a25964-2fc5-4af8-a22a-3231106fe45d","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:c0698df91010454f96b8bb1aa356f28f621660f0d6abf6c5e3aaec3b4cfbd945","observation_id":"788af721-76c2-4e37-aba2-3075430651d8","resolution":{"observed_at":"2026-05-12T10:34:59.399105Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02875","last_updated":"2020-06-23T15:55:05Z","snapshot_observed_at":"2026-08-06T05:45:23.347318Z","submitted_at":"2019-12-05T21:10:08Z","title":"Reinforcement Learning Upside Down: Don't Predict Rewards -- Just Map Them to Actions","version":2},"cited_work":{"arxiv_id":"1912.02875","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1912.02875","snapshot_observed_at":"2026-07-04T16:39:58.082706Z","title":"Reinforcement learning upside down: Don’t predict rewards – just map them to actions","venue":null,"work_id":"2a4563d4-65f2-4dd4-9a9e-e018c6b9f397","year":1912},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/1912.02875","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:8292e25f595ebf6df55edefdd6f49cc68e50794d085c6ee3bdcab5823dc667b4","observation_id":"7542ae43-ba7b-45cf-b733-1f13a4991a15","resolution":{"observed_at":"2026-05-12T10:34:59.408653Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.13465","last_updated":"2019-12-31T18:07:43Z","snapshot_observed_at":"2026-07-06T08:47:53.346676Z","submitted_at":"2019-12-31T18:07:43Z","title":"Reward-Conditioned Policies","version":1},"cited_work":{"arxiv_id":"1912.13465","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1912.13465","snapshot_observed_at":"2026-07-04T16:39:58.107559Z","title":"Reward-conditioned policies","venue":null,"work_id":"0aac6f0f-ba1d-4790-b2df-aaeb733a3f80","year":1912},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/1912.13465","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:84da72eaa88548c79d0b8a06f3e64ef0543f2a2981da2e5606da980e1a1895f0","observation_id":"334c2d12-73fa-4d3b-9df4-d5254ff8fd4c","resolution":{"observed_at":"2026-05-12T10:34:59.416893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decision transformer: Rein- forcement learning via sequence modeling","venue":null,"work_id":"c7bd7e5c-66d6-42d7-8985-3cb0e84dd532","year":2021},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:4bf33e79e9723d97dc16f2d80bae8548a5e9e5375096eb17218a29b9bba1e9a5","observation_id":"60020006-bd82-428d-b465-b0999b87336a","resolution":{"observed_at":"2026-05-12T10:34:59.492892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When does return- conditioned supervised learning work for offline rein- forcement learning? InAdvances in Neural Information Processing Systems (NeurIPS) 35","venue":null,"work_id":"b07d0bb1-4818-4eb5-ab0b-4f9aad4c4573","year":2022},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:4b4535b33bbc5dc9a64dfe9849c2c77ae3991dc90d36d637fe99c4e07836f75e","observation_id":"74147d76-9be9-4914-bc10-e079fcedf03c","resolution":{"observed_at":"2026-05-12T10:34:59.497502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rvs: What is essential for offline rl via supervised learning? InProceedings of the 10th International Conference on Learning Representations (ICLR)","venue":null,"work_id":"c01e5e8f-97a7-4a7b-abc4-e09dcccfb50b","year":2022},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:6f363f07284578da46d5f6ba4b6b6c54ca128294b64d4a88fdfca214b3444a17","observation_id":"31d3abc4-1555-4f36-87cd-2aec7df1529b","resolution":{"observed_at":"2026-05-12T10:34:59.501395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generalized decision transformer for offline hindsight information matching","venue":null,"work_id":"12d88548-1337-4e6c-9ccf-9387a366cb3e","year":2022},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:47ca72c71b0b58c35cebfd0daefa4c0082d12c0ebd4cf88441bfbe792e526708","observation_id":"1636963a-4305-42b9-a179-d85bb12eae5f","resolution":{"observed_at":"2026-05-12T10:34:59.505991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Q-learning decision transformer: Leveraging dynamic programming for conditional sequence mod- elling in offline rl","venue":null,"work_id":"50d4a32e-ab6a-490b-b232-5b98a002a61e","year":2023},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:42ccf878ed50a4f2e2ae5c3bca03f52b9e893411c67ab1db220d3654956d3d9b","observation_id":"8160b27b-73b1-420d-a612-54682522becb","resolution":{"observed_at":"2026-05-12T10:34:59.511141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Online decision transformer","venue":null,"work_id":"729987f8-9d80-45a3-a9ea-e0052e2a43f9","year":2022},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:daa8e64e1d088ee2b7a9d06bd3a7fb56a6caa13c30f548961bb865a4d7ba3dd3","observation_id":"9cd398b2-c4fa-4d0a-83f3-29bbc23202e7","resolution":{"observed_at":"2026-05-12T10:34:59.515926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advantage-conditioned diffusion: Offline rl via general- ization","venue":null,"work_id":"ad487e57-0b10-401b-8e77-4c8bb4398626","year":2023},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:0ddc888b707f97c60755bf5376d6c9cf59b6c9d05f3b519d3734c34b7126f332","observation_id":"73edf8f2-ab91-4ee6-8d2e-1b58ed15f4a4","resolution":{"observed_at":"2026-05-12T10:34:59.520844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6122.366693","doi":"10.5555/3666122.3666936","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Elastic decision transformer","venue":null,"work_id":"475de554-8c74-4f12-9e83-3b48652b8d55","year":2023},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:55235137d7d0e8c1dbda86b5b476ea7b96d876dd33095dc872ec7e5b10f974eb","observation_id":"dc7a5f55-249a-4ef7-8a6e-7287f9caab4b","resolution":{"observed_at":"2026-05-12T10:34:59.218576Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.15607/rss.2020.xvi.082","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Concept2robot: Learning manipu- lation concepts from instructions and human demonstra- tions","venue":null,"work_id":"44559c27-f624-4c68-b963-24bde553e850","year":2020},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:76f7890ae78f1020e7484b79b0ff42fe5b83993924ab94433301cf8b6c66dcb0","observation_id":"1b47a4de-1ed4-47f8-88e5-30d2dfcae865","resolution":{"observed_at":"2026-05-12T10:34:59.211955Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"in-the- wild","venue":null,"work_id":"c807ad5f-5f1a-472f-8e17-b20e6e32f76f","year":2021},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:a06f172b74fe421eb600e2c0bea0c18bb659aab4059a6082c6cc54943cb1b80b","observation_id":"97208df7-d5c7-4075-b661-9248a6a0936d","resolution":{"observed_at":"2026-05-12T10:34:59.534382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning language- conditioned robot behavior from offline data and crowd- sourced annotation","venue":null,"work_id":"26ba9050-3787-4b4f-bac7-7ba5bf2dc1c2","year":2022},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:7df6b36be9e7f939cf08be9748fed80d63d060f922138271e0b1f2ff4f4a75ec","observation_id":"5868eb68-fd47-4081-96e7-3733a3261135","resolution":{"observed_at":"2026-05-12T10:34:59.548981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sontakke, Jesse Zhang, S ´ebastien M.R","venue":null,"work_id":"fad6a6bd-43b5-4a0e-98a0-9b7d0f99e130","year":2023},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:8c3e2fc0ef387e52222092a2a77a8827d4975fadb15119062cad1d4e3692d404","observation_id":"28565aa5-5f5d-4ca8-9c11-5a0c5e38f1fd","resolution":{"observed_at":"2026-05-12T10:34:59.577261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language to rewards for robotic skill synthesis","venue":null,"work_id":"7d5b1b3b-fc9e-472c-8f05-5213cbb56d51","year":null},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:afac36179db4c04178f595133426efc855be591567737ca2e0c8566ffbfc3ca4","observation_id":"1079ff25-f206-45dc-998e-a346556f0e0e","resolution":{"observed_at":"2026-05-12T10:34:59.581726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lim, Jesse Thomason, Erdem Bıyık, and Jesse Zhang","venue":null,"work_id":"242ed887-0b69-46d9-9cea-292b9d21b599","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:99bfc1b9edd1ec73e863575293ebe2e4ec716dd78b329cd4edc32bfb2fb65938","observation_id":"b25b6e64-0c71-4a0d-8e6e-9ce9d0041fa7","resolution":{"observed_at":"2026-05-12T10:34:59.586493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video-language critic: Transferable reward functions for language-conditioned robotics.Transac- tions on Machine Learning Research, 2025:1–22","venue":null,"work_id":"b6efe38a-8722-42d3-a383-f634e9055e5c","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:6a037d3b6d45cd97c0f7a154384cf4621593d3a867b68caa56dfa7d0306e1177","observation_id":"1bf69143-533a-4a3e-8e5a-dc40e515d2e8","resolution":{"observed_at":"2026-05-12T10:34:59.598140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Liv: Language-image representations and rewards for robotic control","venue":null,"work_id":"ee8fc43d-d15e-47f2-b02c-b07903c19a4f","year":2023},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:6a29074f2a22eeb2bfba8b8122e9ce189985143231c65cc45f49c72fbe92d377","observation_id":"eb9a043b-8d9c-4cd4-9765-f92ee79e5b02","resolution":{"observed_at":"2026-05-12T10:34:59.611605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision language models are in-context value learners","venue":null,"work_id":"5cbd53cc-bc62-41ad-b905-daed3320711a","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:873a21f0447db45aaf9b6f99eb913be315131bbf9fbbf0dd1a95d6d9e52d0a16","observation_id":"96b606e6-3bd1-4ba6-81f1-6a49dc31a0c9","resolution":{"observed_at":"2026-05-12T10:34:59.624912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:836be858de09b5c3540620c1d1ca596c9d4674d184db8c1a154459fb014b1074","observation_id":"b251e6ef-ce49-4f58-8b11-b29d2320ae6d","resolution":{"observed_at":"2026-05-12T10:34:59.235701Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Maximum a posteriori policy optimisation","venue":null,"work_id":"97cbaad4-4131-49b3-9a73-7e9c9a83711e","year":null},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:aeff6eba12b4133a9e096a90e6701f83f13ddab4d329b0ca4681f7ca1abda209","observation_id":"212203cb-f019-4248-b4e0-ccf0eb861e57","resolution":{"observed_at":"2026-05-12T10:34:59.632562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1910.00177","doi":"10.48550/arxiv.1910.00177","metadata_source":"pith","pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","venue":"cs.LG","work_id":"ab561983-ab59-4f04-a11e-a467ddde4848","year":2019},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:bef12948b309230b9e0f260d0106a025e9002e996c428d2b743fe7a1026b3a24","observation_id":"5e2c454d-e7f1-4db5-8325-b01196157eed","resolution":{"observed_at":"2026-05-12T10:34:59.422852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1162/neco.1997.9","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"354e7fab-bffa-4c18-8b58-7bfe1670b051","year":1997},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:3c34ff2bec49a873895e552ea4e89d4b65b8065716cbe89940c3ada39eac4d80","observation_id":"3fffcf59-8ba6-471a-a24b-116aa2c13322","resolution":{"observed_at":"2026-05-12T10:34:59.207330Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rel- ative entropy policy search","venue":null,"work_id":"431eee03-f245-4d95-9e20-d17df8286200","year":2010},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:70e44b8dd070d7d0d3027dea9b70114af5f12bfb139ea33df8edf11366fd59bb","observation_id":"69649c11-9323-49c3-abe7-5afef49fd71a","resolution":{"observed_at":"2026-05-12T10:34:59.643617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exponentially weighted imitation learning for batched historical data","venue":null,"work_id":"5735f693-b25a-4435-9f82-6e7ebafb57bf","year":2018},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:a40e4395ea58f3feb4eac2feb33ac1321697160e7aac2c4d0991473396fda716","observation_id":"da2778fd-a054-454f-bc79-3c004ceba287","resolution":{"observed_at":"2026-05-12T10:34:59.650399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A distributional perspective on reinforcement learning","venue":null,"work_id":"817ceffb-4943-4371-9d0f-05238fd1a87f","year":2017},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:8441d051cefd2258407011fdf62f4dfe5c8384df95232be8828b2fc8cae2f4e1","observation_id":"de86c718-e261-440f-9ccd-ce84835fc8eb","resolution":{"observed_at":"2026-05-12T10:34:59.659808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Knowledge insulating vision-language-action models: Train fast, run fast, generalize better","venue":null,"work_id":"59ba500d-aca0-4afc-83b4-933038aa337f","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:a54c8abc13e591db829badced2208e97da00066092cfec291f06bcb262ea1066","observation_id":"5e52e2cc-5f9f-4b73-b839-ec2dd811298e","resolution":{"observed_at":"2026-05-12T10:34:59.455997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor.ICML","venue":null,"work_id":"85b649ee-6c9d-4bae-813f-36791a464452","year":2018},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:e0979aea1c07c2ca1457fdf0857982dd7681bad29a2a15583fc2aa075cf618fe","observation_id":"30a3883e-2db7-46e1-b7a4-8605c3f7c401","resolution":{"observed_at":"2026-05-12T10:34:59.463116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Critic regularized regression","venue":null,"work_id":"1120b6ce-104f-4c07-983e-e42a2b066cb0","year":2020},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:e45882d1061e7beab63f4d82c0266d2b7f5fd7f4baba5b09fa7546c23affe0c7","observation_id":"c3734c80-8077-4bff-9667-e848fd0f809c","resolution":{"observed_at":"2026-05-12T10:34:59.466649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Offline reinforcement learning with implicit q-learning","venue":null,"work_id":"f2b68e68-7c41-4256-adc3-e073da9eb287","year":2022},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:48ec5fc6c2aa974af59a36fc2125b910e66e8f46cc11015359e8ea1313fa02c9","observation_id":"a32ca1de-c36c-459f-a4a8-276481a9e877","resolution":{"observed_at":"2026-05-12T10:34:59.470485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FAST: Efficient action tok- enization for vision-language-action models.Robotics: Science and Systems","venue":null,"work_id":"c821a3d1-02f2-4c7c-8c3e-faf620d5a3c1","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:fea97d1cf207a9b35edc3dc40a203fa406ac036b459dde53de13b3f4f39c1ef3","observation_id":"ccbfcb12-752d-4658-8525-31dfdc40743c","resolution":{"observed_at":"2026-05-12T10:34:59.474216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"adc7b449-6925-4d05-880c-349181f35e63","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:24fa8153273d6bbc3b10730c3e64c4ad11aa64276031a0d2f99ea5a1407a2d58","observation_id":"ab3e6269-6ed5-4742-a243-a1e7972cffed","resolution":{"observed_at":"2026-05-12T10:34:59.478607Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:1fe2df6c40a8e56bc51528202db72f4b373af95d3530aa178afeda3f92ef141d","observation_id":"5dbc5840-8bd8-4a10-a4a5-cfd8ed472dab","resolution":{"observed_at":"2026-05-12T10:34:59.428506Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Understanding diffu- sion objectives as the elbo with simple data augmenta- tion","venue":null,"work_id":"032adfd9-7739-422f-93f1-e01ce16d359d","year":2023},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:3c60079617db7badde49550d1389fcc4391d3223132f76563dc52a1658b04996","observation_id":"3010726f-688c-4e34-91de-673ea3383a76","resolution":{"observed_at":"2026-05-12T10:34:59.488745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":"2410.24164","doi":"10.48550/arxiv.2410.24164","metadata_source":"pith","pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","venue":"cs.LG","work_id":"f790abdc-a796-482f-a40d-f8ee035ecfc2","year":2024},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:d8c2bdcfe66525784e850443463ed5c77838b11a7c947f5eb6423ba6161c9cdb","observation_id":"01ef8a05-630b-4073-bc33-f59c021e03cc","resolution":{"observed_at":"2026-05-12T10:34:59.433800Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flow matching policy gradients","venue":null,"work_id":"f743216d-84fd-41eb-b435-14fd19d1c82a","year":null},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:06a245195ea72f20dbd4d0d64319988b4a7d7bfeb8ba3a47026bfb1539df5eba","observation_id":"44e99cfc-de44-4698-b672-c8c86153c0ec","resolution":{"observed_at":"2026-05-12T10:34:59.483666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simple policy optimization","venue":null,"work_id":"8f869684-8d5d-474a-8ddb-4fd3ed0f77b0","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:41d18d3896516567b43c2c38d7769e3ebe42b17c57c516f0e69df8c6ba133dab","observation_id":"f3196016-432c-4f6f-bf90-8630c3dea41b","resolution":{"observed_at":"2026-05-12T10:34:59.636641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.12570","last_updated":"2020-04-27T03:36:10Z","snapshot_observed_at":"2026-07-06T09:15:23.933787Z","submitted_at":"2020-04-27T03:36:10Z","title":"The Ingredients of Real-World Robotic Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2004.12570","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.12570","snapshot_observed_at":"2026-07-04T09:59:44.626163Z","title":"arXiv preprint arXiv:2004.12570 (2020) 2","venue":null,"work_id":"58233088-569f-42a2-bad2-8195f07616cc","year":2004},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2004.12570","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:0d6f429c4e8e924250a721802b18eb3915762e3bacb2b77327299bf3e1911122","observation_id":"adb13b4b-71bd-4495-b751-9bdfe8dba9c1","resolution":{"observed_at":"2026-05-12T10:34:59.439726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09605","last_updated":"2022-08-08T00:26:16Z","snapshot_observed_at":"2026-07-06T12:20:02.114865Z","submitted_at":"2021-12-17T16:28:06Z","title":"Autonomous Reinforcement Learning: Formalism and Benchmarking","version":2},"cited_work":{"arxiv_id":"2112.09605","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2112.09605","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Autonomous reinforcement learning: Formalism and benchmarking.arXiv preprint arXiv:2112.09605","venue":null,"work_id":"9f697714-342b-45d7-8b7d-a516c0528f9a","year":null},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2112.09605","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:ef1f6f7f501af24333e4592b2dbe8f1181c6b949cafa9b0ca141ec83844d4b0d","observation_id":"43626bdb-b668-4803-872b-89dfce2c51de","resolution":{"observed_at":"2026-05-12T10:34:59.446657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19417","last_updated":"2025-07-15T17:44:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T18:58:41Z","title":"Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":"2502.19417","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.19417","snapshot_observed_at":"2026-07-10T04:16:48.655148Z","title":"Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models","venue":"cs.RO","work_id":"5fa4c212-9ac8-4c92-95ee-879621fbcb2e","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2502.19417","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:9f1b6c6400ed091f91dd9f65d024b74bfdf7d1bcad9733f5137e3ffa6de0afe6","observation_id":"3c453cca-20f2-4bff-873f-c86d8923f044","resolution":{"observed_at":"2026-05-15T22:53:37.470313Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience"},"reference_resolution":{"displayed":87,"state_counts":{"malformed_identifier":1,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":2,"verified_exact":35,"verified_fuzzy":45},"total_outbound_references":87},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 87 of 87 outbound references and 100 inbound Pith citation observations for arXiv:2511.14759."}