{"as_of":"2026-08-07T06:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:840d9f3d9e106405c5f8658b9855dc9dba189ca47cda48b317cbad6370a84a40","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":30,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:40:21.447558Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T09:59:44.548397Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2412.14803","last_updated":"2025-05-04T04:28:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T12:48:40Z","title":"Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations","version":2},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-05-12T18:38:11.110166Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2412.14803"},"observation_digest":"sha256:2cccbc4c298f4ff72262871e025e6bf8ef05762c0af693f98315924d43e8cfb1","observation_id":"a4dcedf2-a314-48ff-a734-3fb524645888","resolution":{"observed_at":"2026-05-12T18:38:11.188770Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2502.05855","last_updated":"2025-08-09T10:58:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-09T11:25:56Z","title":"DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot Control","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-14T19:48:48.725800Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2502.05855"},"observation_digest":"sha256:03bf95239a366bdbc906c1137ce2cd8043e7cd278f6e498663c78ee40fcf9063","observation_id":"b0f97b08-27e5-4fcf-a420-409b0c1ef202","resolution":{"observed_at":"2026-05-14T19:48:48.815167Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2505.18719","last_updated":"2025-05-24T14:42:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-24T14:42:51Z","title":"VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T12:55:40.245908Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2505.18719"},"observation_digest":"sha256:f9593df1bdbeb70cd02af93d531a13d911d2ab0e683a23b6425421a32980c0bd","observation_id":"7108ed8c-d69a-4c54-b1fd-20506952726b","resolution":{"observed_at":"2026-05-16T12:55:40.499761Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-07T00:40:21.447558Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13045","last_updated":"2025-08-24T10:01:04Z","snapshot_observed_at":"2026-08-07T00:34:58.147767Z","submitted_at":"2025-06-16T02:27:25Z","title":"Continual Learning for Generative AI: From LLMs to MLLMs and Beyond","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:21.447558Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2506.13045"},"observation_digest":"sha256:452e1aaa3bc66cb56174df4e3265b62151ad8fa62c7dcad591dc70da116c6f1d","observation_id":"7c594d43-1aa7-4147-8322-d05287c928d0","resolution":{"observed_at":"2026-08-07T00:40:21.447558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-06T23:36:12.864759Z","title":"Improving vision-language-action model with online reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17639","last_updated":"2026-06-16T03:02:33Z","snapshot_observed_at":"2026-08-06T23:28:08.521690Z","submitted_at":"2025-06-21T08:45:32Z","title":"RLRC: Reinforcement Learning-based Recovery for Compressed Vision-Language-Action Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:36:12.864759Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2506.17639"},"observation_digest":"sha256:6bf9e649958e0f14b290894deec9e3e37b8cc1363f3c4896718e672007fca90f","observation_id":"65301ea4-71ca-451a-a691-056ceb3600ae","resolution":{"observed_at":"2026-08-06T23:36:12.864759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-06T19:53:06.290688Z","title":"Improving vision-language-action model with online reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04452","last_updated":"2025-07-06T16:18:40Z","snapshot_observed_at":"2026-08-06T21:06:22.043754Z","submitted_at":"2025-07-06T16:18:40Z","title":"SimLauncher: Launching Sample-Efficient Real-world Robotic Reinforcement Learning via Simulation Pre-training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:06.290688Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2507.04452"},"observation_digest":"sha256:423d04f0b4d126120a4b326ead31a8589db04a0e3b1b89de0cc398176abbbe00","observation_id":"689c3033-cf16-4782-a3a7-eb31f2b0ae21","resolution":{"observed_at":"2026-08-06T19:53:06.290688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-05T20:35:43.638797Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10257","last_updated":"2025-08-14T00:51:36Z","snapshot_observed_at":"2026-08-05T20:35:42.234950Z","submitted_at":"2025-08-14T00:51:36Z","title":"Source Component Shift Adaptation via Offline Decomposition and Online Mixing Approach","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T20:35:43.638797Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2508.10257"},"observation_digest":"sha256:a8c4d48ca2da152947b76cfe4452ebc39029b766c197205b49d835e9b0db81d2","observation_id":"2634ff7d-e50f-4d87-b330-b96d3689fa0c","resolution":{"observed_at":"2026-08-05T20:35:43.638797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-05T20:38:40.022379Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10259","last_updated":"2025-08-14T00:57:58Z","snapshot_observed_at":"2026-08-05T20:38:36.897476Z","submitted_at":"2025-08-14T00:57:58Z","title":"Leveraging OS-Level Primitives for Robotic Action Management","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T20:38:40.022379Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2508.10259"},"observation_digest":"sha256:9581ee2a7eba79d9309322767bb193482101b8795c41da1b971d876e803c94ec","observation_id":"cd37d08d-cc3e-430e-9226-c59979728f02","resolution":{"observed_at":"2026-08-05T20:38:40.022379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-05T10:30:23.538701Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04063","last_updated":"2025-09-04T09:48:43Z","snapshot_observed_at":"2026-08-06T19:50:15.003871Z","submitted_at":"2025-09-04T09:48:43Z","title":"Balancing Signal and Variance: Adaptive Offline RL Post-Training for VLA Flow Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T10:30:23.538701Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2509.04063"},"observation_digest":"sha256:344d679afb9aa320f7ee601b9c87468a858bae2bb9cfdcf59a01270ddb8a9c7e","observation_id":"35ba3196-ca77-4c1e-8e83-1549cb75e2ac","resolution":{"observed_at":"2026-08-05T10:30:23.538701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-04T23:11:31.875241Z","title":"Improving vision-language-action model with online reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06759","last_updated":"2025-09-08T14:47:57Z","snapshot_observed_at":"2026-08-04T23:11:29.398258Z","submitted_at":"2025-09-08T14:47:57Z","title":"Aligning Large Vision-Language Models by Deep Reinforcement Learning and Direct Preference Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T23:11:31.875241Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2509.06759"},"observation_digest":"sha256:0424ce5f5310047865e603949a8b992f19bd03f9b741e52783edb5941812db7e","observation_id":"2725aca8-5c7c-48f3-8fbf-57cd903c3e8f","resolution":{"observed_at":"2026-08-04T23:11:31.875241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2509.09674","last_updated":"2025-09-11T17:59:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-11T17:59:17Z","title":"SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T08:02:11.189795Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2509.09674"},"observation_digest":"sha256:636942e46c7f03f25f9293ebd85996e412173da56c563bdca471dd0f10fa7142","observation_id":"0bfe0573-d8ee-4686-9445-2942dda656c4","resolution":{"observed_at":"2026-05-15T08:02:11.482284Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-04T10:24:56.027069Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.09976","last_updated":"2026-06-25T14:25:12Z","snapshot_observed_at":"2026-08-04T10:24:54.103532Z","submitted_at":"2025-10-11T03:11:18Z","title":"Reinforcement Fine-Tuning of Flow-Matching Policies for Vision-Language-Action Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T10:24:56.027069Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2510.09976"},"observation_digest":"sha256:228cf14d418ac0bbe8f51b7c7b1e6b3e5c5e17aea52918c405bf22462f7f4fbf","observation_id":"1ab1b8f3-bc2c-4628-bbb2-d0007fb19793","resolution":{"observed_at":"2026-08-04T10:24:56.027069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2510.10125","last_updated":"2026-03-01T08:24:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-11T09:13:10Z","title":"Ctrl-World: A Controllable Generative World Model for Robot Manipulation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T01:14:10.174044Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2510.10125"},"observation_digest":"sha256:50b82ad706c441e7b5ac3b5bac628e03391079361a503bc61dabc9029373280b","observation_id":"98b2c27e-2eaa-4d5d-bc6d-f8c540b37840","resolution":{"observed_at":"2026-05-16T01:14:10.368029Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2510.12710","last_updated":"2026-04-09T08:55:45Z","snapshot_observed_at":"2026-07-06T22:32:37.311210Z","submitted_at":"2025-10-14T16:44:39Z","title":"Reflection-Based Task Adaptation for Self-Improving VLA","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T07:28:11.187479Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2510.12710"},"observation_digest":"sha256:5e767fc53fd4fbcd36d05f5792d05fd902b7adb5dbd8801da086df03080cdf3e","observation_id":"90b52234-e401-4d30-be29-95df048fed96","resolution":{"observed_at":"2026-05-18T07:31:02.913540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:bfde62e354c2ca59e0f7ff852111cb237e8b8742396549d6db806223e4992128","observation_id":"96f1fb71-e18f-481e-972d-a1fafab88cf6","resolution":{"observed_at":"2026-05-12T10:34:59.347237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-03T13:53:24.794126Z","title":"Improving vision- language-action model with online reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.22539","last_updated":"2026-07-02T08:55:28Z","snapshot_observed_at":"2026-08-06T03:03:38.906157Z","submitted_at":"2025-12-27T09:40:54Z","title":"VLA-Arena: An Open-Source Framework for Benchmarking Vision-Language-Action Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T13:53:24.794126Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2512.22539"},"observation_digest":"sha256:5a8f1f7decbf224e7e79aad3096f068e97667881f0b44336acd7c007e2e295ff","observation_id":"1ab87388-22a1-49df-b0e9-e41fa555e3f4","resolution":{"observed_at":"2026-08-03T13:53:24.794126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-03T12:30:33.790260Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.03309","last_updated":"2026-05-30T09:29:28Z","snapshot_observed_at":"2026-08-03T12:30:32.952137Z","submitted_at":"2026-01-06T09:58:24Z","title":"VLM4VLA: Revisiting Vision-Language-Models in Vision-Language-Action Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T12:30:33.790260Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2601.03309"},"observation_digest":"sha256:faf1d4392eea97ffa13828f4b70f687a274314a6375ac927ebefb793c380696a","observation_id":"50f1e294-9b47-479e-a108-da46695ada15","resolution":{"observed_at":"2026-08-03T12:30:33.790260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2602.07399","last_updated":"2026-05-22T10:22:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-07T06:31:53Z","title":"VGAS: Value-Guided Action-Chunk Selection for Few-Shot Vision-Language-Action Adaptation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-25T07:00:01.741166Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2602.07399"},"observation_digest":"sha256:9efb880eaaf8c2f8e8f30dac77564f42aabcb91415ac6a66fbfaeb2a6d6a4e61","observation_id":"58ea4866-2491-401c-8be1-2517f1eb356e","resolution":{"observed_at":"2026-05-25T07:00:25.994640Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2602.09023","last_updated":"2026-05-19T02:18:04Z","snapshot_observed_at":"2026-08-02T13:36:40.045905Z","submitted_at":"2026-02-09T18:59:52Z","title":"TwinRL: Digital Twin-Driven Reinforcement Learning for Real-World Robotic Manipulation","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T13:13:53.818915Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2602.09023"},"observation_digest":"sha256:e5727e2d8a2a74b9af77a3ba75a4e5965b62c734984806526beee56e8598d3eb","observation_id":"a8596dfc-c014-4905-aa7b-adc13a2adb55","resolution":{"observed_at":"2026-05-21T13:14:10.897478Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2602.10503","last_updated":"2026-05-16T03:35:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-11T04:05:03Z","title":"Towards Long-Lived Robots: Continual Learning VLA Models via Reinforcement Fine-Tuning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T14:07:10.387869Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2602.10503"},"observation_digest":"sha256:d5272e5adf2d34b3716f4e833d2bfa970edd39148d9a2ab3a598a77583c0a966","observation_id":"0d17fbb1-bf9e-414c-b44b-a41290644b48","resolution":{"observed_at":"2026-05-21T14:10:13.288701Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2603.22844","last_updated":"2026-05-05T16:08:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-24T06:32:12Z","title":"PhySe-RPO: Physics and Semantics Guided Relative Policy Optimization for Diffusion-Based Surgical Smoke Removal","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T01:22:42.691009Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2603.22844"},"observation_digest":"sha256:26fb33f97eb13a7a9e0b139c8a0fc223e466ef1736fbefe01ba5fa08d006d692","observation_id":"694260c5-fe28-4f0e-baf9-87fcd39c434c","resolution":{"observed_at":"2026-05-15T01:23:26.867422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2604.04502","last_updated":"2026-04-06T07:57:52Z","snapshot_observed_at":"2026-07-06T22:53:29.118925Z","submitted_at":"2026-04-06T07:57:52Z","title":"Veo-Act: How Far Can Frontier Video Models Advance Generalizable Robot Manipulation?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:54.362107Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2604.04502"},"observation_digest":"sha256:84f5ddbb8c589354e068b7f4174a3a41019ad1b822bc8c29bb632598e74fd91e","observation_id":"bbc803a6-8cfe-467b-9d40-981a1f8da0fa","resolution":{"observed_at":"2026-05-10T22:10:49.569291Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2604.04834","last_updated":"2026-06-30T15:42:53Z","snapshot_observed_at":"2026-07-13T09:40:35.215938Z","submitted_at":"2026-04-06T16:35:57Z","title":"E-VLA: Event-Augmented Vision-Language-Action Model for Dark and Blurred Scenes","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T20:21:45.365156Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2604.04834"},"observation_digest":"sha256:7f98dd6cbba5488a2767a2fdc9aa5dcd30a798f462820205f61302bdba3872f7","observation_id":"f1ace14f-8eea-428c-b697-830e5a049e2a","resolution":{"observed_at":"2026-05-10T22:00:48.347579Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2605.16154","last_updated":"2026-05-15T16:33:59Z","snapshot_observed_at":"2026-07-06T23:27:20.429737Z","submitted_at":"2026-05-15T16:33:59Z","title":"Learn Where Outcomes Diverge: Efficient VLA RL via Probabilistic Chunk Masking","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T21:05:45.024226Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2605.16154"},"observation_digest":"sha256:3be95ed383c307b945de5f4fbf89afd20af1ff1369cf144f3ce4019fcb2c3fdc","observation_id":"44d8d85a-3225-42b0-bb30-1eb410e04121","resolution":{"observed_at":"2026-05-20T21:09:02.659480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2605.17486","last_updated":"2026-05-17T14:55:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-17T14:55:32Z","title":"DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization","version":1},"reference_index":133,"source":"arxiv_source","source_observed_at":"2026-05-20T12:39:50.004269Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2605.17486"},"observation_digest":"sha256:2a45de1e3c071f14c901ea226c83e2137415462caba9921d040fde442e0d62a4","observation_id":"56c18ea0-13ad-4965-98ff-870fb0e1512d","resolution":{"observed_at":"2026-05-20T12:43:17.257279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2605.22896","last_updated":"2026-05-21T15:24:21Z","snapshot_observed_at":"2026-08-04T02:50:49.588493Z","submitted_at":"2026-05-21T15:24:21Z","title":"Agentic-VLA: Efficient Online Adaptation for Vision-Language-Action Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-25T05:49:15.137844Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2605.22896"},"observation_digest":"sha256:7ce09550cabe6115d2808d9490584c486e6802d12baad8abd460d4a5dea3afcc","observation_id":"510528f5-e4b1-4196-8011-37b2e07639e6","resolution":{"observed_at":"2026-05-25T05:50:23.617278Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2606.10927","last_updated":"2026-06-09T14:35:53Z","snapshot_observed_at":"2026-08-01T15:29:53.973770Z","submitted_at":"2026-06-09T14:35:53Z","title":"AllDayNav: Lifelong Navigation via Real-World Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T13:25:59.194721Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2606.10927"},"observation_digest":"sha256:51c86a40918f299606c7e279ab33b127c7dfeeb250cbc5721827460cc954978a","observation_id":"bbde08bf-32e7-433b-9ce7-afe9dc3ef770","resolution":{"observed_at":"2026-07-03T05:07:39.001497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2606.23640","last_updated":"2026-06-22T17:30:24Z","snapshot_observed_at":"2026-08-02T09:22:48.099895Z","submitted_at":"2026-06-22T17:30:24Z","title":"Learning Process Rewards via Success Visitation Matching for Efficient RL","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T09:20:35.062060Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2606.23640"},"observation_digest":"sha256:981c02f2bdec68b0536278c7424ce4c00e91ceb581f7f373c3919a3d856140fd","observation_id":"69d21ad9-a07a-4301-af0e-5d08773fa56a","resolution":{"observed_at":"2026-07-04T09:59:44.550081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.16664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-07-04T09:59:44.548397Z","title":"Improving vision-language-action model with online reinforcement learning.arXiv preprint arXiv:2501.16664","venue":null,"work_id":"f3f8e284-c68f-4d3f-aea0-68de9a3f8655","year":2025},"citing_paper":{"arxiv_id":"2606.31958","last_updated":"2026-06-30T17:00:33Z","snapshot_observed_at":"2026-07-07T00:05:37.068846Z","submitted_at":"2026-06-30T17:00:33Z","title":"Adapting Generalist Robot Policies with Semantic Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-01T05:09:29.625066Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2606.31958"},"observation_digest":"sha256:10041b5fb79229760317f577f0807e72f0b3e26090ac4b385e9100da792be554","observation_id":"5a0155eb-bdf8-4494-bf6d-5b47aabf7ef9","resolution":{"observed_at":"2026-07-01T10:45:42.654679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16664","snapshot_observed_at":"2026-08-06T00:37:40.214321Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01013","last_updated":"2026-08-02T05:33:36Z","snapshot_observed_at":"2026-08-06T23:25:18.326261Z","submitted_at":"2026-08-02T05:33:36Z","title":"RL Bootstrapping of OpenVLA-OFT for a Novel Robot Embodiment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:37:40.214321Z"},"links":{"cited_paper":"/paper/2501.16664","citing_paper":"/paper/2608.01013"},"observation_digest":"sha256:9194a68770b85dbcc4030a6d4a50950cbe66b4155eedffb7cb4706fcad5d8030","observation_id":"844fe8d3-167e-4ef6-a8df-f31242600c73","resolution":{"observed_at":"2026-08-06T00:37:40.214321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.16664/citation-record","integrity":"/paper/2501.16664/integrity","json":"/paper/2501.16664/citation-record.json","paper":"/paper/2501.16664"},"outbound":[],"paper":{"arxiv_id":"2501.16664","last_updated":"2025-01-28T02:53:48Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T21:08:23.353594Z","submitted_at":"2025-01-28T02:53:48Z","title":"Improving Vision-Language-Action Model with Online Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 30 inbound Pith citation observations for arXiv:2501.16664."}