{"as_of":"2026-08-07T15:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fea053bd209f9654f269834eac8aa673963ec1a30104c145bffa2141f7f898ca","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T05:12:26.907425Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.19580/citation-record","integrity":"/paper/2605.19580/integrity","json":"/paper/2605.19580/citation-record.json","paper":"/paper/2605.19580"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rocoda: Counterfac- tual data augmentation for data-efficient robot learning from demonstrations","venue":null,"work_id":"fa8bfca2-bb3e-4c50-abce-6c9ae640ff9d","year":2025},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:bdf168186d619b58d337f59ebc15efd2f6bd9ec51c54036ce0584eb53545a6a0","observation_id":"6a15a2e8-280d-4bc7-a3e6-f97f1f1326a1","resolution":{"observed_at":"2026-05-20T05:13:03.883252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":"2410.24164","doi":"10.48550/arxiv.2410.24164","metadata_source":"pith","pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","venue":"cs.LG","work_id":"f790abdc-a796-482f-a40d-f8ee035ecfc2","year":2024},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:83dc5cdf714187ebc11f3bbcc90f82cce1685171495f43bb6fb5abd853b7be4e","observation_id":"907cf6f6-0940-4151-ae49-76d097e2d087","resolution":{"observed_at":"2026-05-20T05:13:03.451504Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":"2212.06817","doi":"10.48550/arxiv.2212.06817","metadata_source":"pith","pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","venue":"cs.RO","work_id":"e11bda85-8531-46bc-a07f-d0ade3643ab1","year":2022},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:1c241791919c8996a3131c5a9759cfb5a485354badf79b8e6bff9104716f0ac3","observation_id":"e92e7d3d-767a-4701-a6d9-9462978d55d1","resolution":{"observed_at":"2026-05-20T05:13:03.437165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18088","last_updated":"2025-08-27T17:52:42Z","snapshot_observed_at":"2026-08-01T01:17:47.017808Z","submitted_at":"2025-06-22T16:26:53Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2506.18088","doi":"10.48550/arxiv.2506.18088","metadata_source":"pith","pith_arxiv_id":"2506.18088","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","venue":"cs.RO","work_id":"9b985126-4a2f-4bdf-b014-2a7524ec634e","year":2025},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2506.18088","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:71cac752833896a824c188eae2920eadeb74f275cdde741c0771aed59d10e274","observation_id":"4f596632-c7d6-4dd2-98c4-0b4d22bdeedb","resolution":{"observed_at":"2026-05-20T05:13:03.443203Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.08440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T23:36:24.004772Z","title":"arXiv preprint arXiv:2506.08440 , year=","venue":null,"work_id":"4d5bf60f-37d6-49f4-b277-81ca7233cb16","year":2025},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:dfc6f4ae77e5476bdc334b3d9d9aa960a3eda30277fbb7530671ca4018ed82b5","observation_id":"859018d6-9768-49d0-87e1-a6ffb7f4b937","resolution":{"observed_at":"2026-05-20T05:13:03.386327Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:90b77db5529079995fd2736d4a91d5b4adc9fc0df1d3be447c89a7221d1e0c9f","observation_id":"37b41cc2-99c5-4199-b11c-164fb1114566","resolution":{"observed_at":"2026-05-20T05:13:03.440173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19854","last_updated":"2025-04-28T14:47:34Z","snapshot_observed_at":"2026-08-04T19:02:40.317582Z","submitted_at":"2025-04-28T14:47:34Z","title":"NORA: A Small Open-Sourced Generalist Vision Language Action Model for Embodied Tasks","version":1},"cited_work":{"arxiv_id":"2504.19854","doi":"10.48550/arxiv.2504.19854","metadata_source":"pith","pith_arxiv_id":"2504.19854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NORA: A Small Open-Sourced Generalist Vision Language Action Model for Embodied Tasks","venue":"cs.RO","work_id":"1e89a464-b414-4d5c-a974-b2cb8be33053","year":2025},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2504.19854","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:1a71810db378eb575b33c6d37b0f39d93271e1562435bb7358b19c27f17b1e8d","observation_id":"955d337f-7140-468f-8b19-d4ea56e6e0a6","resolution":{"observed_at":"2026-05-20T05:13:03.434504Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15483","last_updated":"2026-04-24T23:18:28Z","snapshot_observed_at":"2026-08-05T18:18:04.172934Z","submitted_at":"2026-04-16T19:18:07Z","title":"${\\pi}_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities","version":2},"cited_work":{"arxiv_id":"2604.15483","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.15483","snapshot_observed_at":"2026-07-10T19:47:32.631418Z","title":"${\\pi}_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities","venue":"cs.LG","work_id":"7391297f-4dff-465c-9790-cb760a2c0542","year":2026},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2604.15483","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:2e6b791b8c0eaee1eac608e71533f0e41a616aa55cf00bb423e7353fe22adc69","observation_id":"62a0f0a6-08b6-4aaf-91d4-fa43621fe939","resolution":{"observed_at":"2026-05-20T05:13:03.409152Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:9a898c7580b8684062b8b2b3def37ae940ede5c403479c2846e07a70879314b8","observation_id":"461bbf10-66f4-40ff-a32c-14c49f510542","resolution":{"observed_at":"2026-05-20T05:13:03.406369Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robot learning from demonstration by constructing skill trees.The International Journal of Robotics Research, 31 (3):360–375","venue":null,"work_id":"19566c6a-20e3-41df-b4e6-0635599dac84","year":2012},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:fcde08aafe70b70ad2cbeacc4ac71668b9f99e9ac5c2f94d435c9bae1677e30c","observation_id":"ae030df2-8cef-4cc7-bde1-839a22b480d3","resolution":{"observed_at":"2026-05-20T05:13:03.877341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A review of robot learning for manipula- tion: Challenges, representations, and algorithms.Journal of machine learning research, 22 (30):1–82","venue":null,"work_id":"f4841991-c52b-4346-8d62-8a2bc6f44d47","year":2021},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:87d1b5957545d0d36370720340227df107e07931990393e51a8375778b18de2d","observation_id":"408e7708-862b-4a59-ab0d-83e47431974a","resolution":{"observed_at":"2026-05-20T05:13:03.879341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.05580","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T18:57:17.170007Z","title":"Metavla: Unified meta co-training for efficient embodied adaption","venue":null,"work_id":"4a22849b-e4e4-4517-b708-8f52ab4e6fda","year":2026},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:61eff048bb9eca1fea14198d7a0596b3aa3f6b6d457fec668144c13234c92f59","observation_id":"61e53c96-3266-4ea8-82ce-0d55f903fafc","resolution":{"observed_at":"2026-05-20T05:13:03.426228Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09674","last_updated":"2025-09-11T17:59:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-11T17:59:17Z","title":"SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2509.09674","doi":"10.48550/arxiv.2509.09674","metadata_source":"pith","pith_arxiv_id":"2509.09674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning","venue":"cs.RO","work_id":"56dc8355-0011-4fd6-8f89-a6ef5cb6933f","year":2025},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2509.09674","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:2164d6a35633bf8a52ec5d65784f09266dc0fe0d58ecdb206206cfd539ea57ac","observation_id":"7814cd4d-4eee-4283-9b18-b15fca6cd3f4","resolution":{"observed_at":"2026-05-20T05:13:03.431346Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T07:16:04.692988Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning.Advances in Neural Information Processing Systems, 36:44776–44791","venue":null,"work_id":"82433860-48a4-470f-a777-2da161172669","year":2023},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:1d2483101da00720105d6a278f59a37815d3184232281caa00fa8b1b75eedc8b","observation_id":"adfdcaa4-87a0-4b95-b52a-1dde5fb0009f","resolution":{"observed_at":"2026-05-20T05:13:03.881365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":"2410.07864","doi":"10.48550/arxiv.2410.07864","metadata_source":"pith","pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","venue":"cs.RO","work_id":"12319725-bc7d-4c32-a229-ad270a7460bc","year":2024},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:24d86be44a85fb3fc1ffa8477b0ca8d58e579010fc5170da0e4ea5f64e35c17f","observation_id":"3c8287f2-a5c7-4c8b-b631-2e551d003948","resolution":{"observed_at":"2026-05-20T05:13:03.445887Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Packnet: Adding multiple tasks to a single network by iterative pruning","venue":null,"work_id":"eb196c2c-2a4d-4899-a141-94d2edd98c88","year":2018},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:e63f1f6b8f7a053568620c148562e736b906731707f3a937f5072004c1753220","observation_id":"2324a225-7992-43c6-96d5-88b7481d4e89","resolution":{"observed_at":"2026-05-20T05:13:03.875306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning grounded finite-state representations from unstructured demonstrations","venue":null,"work_id":"8ccc56cc-0f1b-4fb7-8496-4c18060f5c2f","year":2015},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:323e476e5e6211ca86f58f2af90bd692cac923e420d0a7bf4cb16407a2f9b095","observation_id":"29fac124-cd2c-4a68-a200-e2e851c3de08","resolution":{"observed_at":"2026-05-20T05:13:03.866691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T15:47:23.602412Z","title":"Cambridge university press","venue":null,"work_id":"1e4dd1c5-2683-4e02-8324-f7fe359cdc17","year":2009},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:60a44a789038ecb7fd11aa535d9d94ad5a8fdca354c3b2d42dc339ba90322e18","observation_id":"03762c01-6c4a-4e85-b4a8-a11caa18b0a7","resolution":{"observed_at":"2026-05-20T05:13:03.862467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":"2501.09747","doi":"10.48550/arxiv.2501.09747","metadata_source":"pith","pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","venue":"cs.RO","work_id":"83a8f966-6cfa-4f21-81f3-87440aae238f","year":2025},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:1d8ceb296e2436d17609a61046f383dbab168825c71c9c8187899c76c8cbc0fe","observation_id":"1821ff51-bf81-4324-be96-f95f508ea2ff","resolution":{"observed_at":"2026-05-20T05:13:03.397838Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient reductions for imitation learning","venue":null,"work_id":"e62c9fd7-a55b-4c9f-b694-137e1ebf3765","year":2010},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:f5f00e06a331fe7eec3f0d9ddf9357abff5184c2ea62401808aa808ae0b868dd","observation_id":"b45c2dd4-27c0-40f2-9cbb-726268f0df20","resolution":{"observed_at":"2026-05-20T05:13:03.864644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:27:52.855881Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning","venue":null,"work_id":"f8f38e33-0265-4900-bece-64531924a2cf","year":2011},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:28e551c56ef45e2b273a6d94b53c96740754e0ae429ac14ece19c42f7c706d93","observation_id":"33f0eb8a-8772-4f88-96ac-573a3386a84f","resolution":{"observed_at":"2026-05-20T05:13:03.868896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Between mdps and semi-mdps: A framework for temporal abstraction in reinforcement learning.Artificial intelligence, 112(1-2): 181–211","venue":null,"work_id":"3fad77b7-701d-40d1-8377-5fe5cda7ae1e","year":1999},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:c99aca3e75efb7a7d55ae596880cd115b6a3dfd2e925964ab4f4d2c102ef6389","observation_id":"900f780d-4a21-49f5-8432-afda5674526e","resolution":{"observed_at":"2026-05-20T05:13:03.871076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17016","last_updated":"2025-05-22T17:59:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-22T17:59:45Z","title":"Interactive Post-Training for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":"2505.17016","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17016","snapshot_observed_at":"2026-07-04T20:50:12.325218Z","title":"Interactive Post-Training for Vision-Language-Action Models","venue":"cs.LG","work_id":"1ad0b2af-71bb-415b-b955-e3350f1a1ae8","year":2025},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2505.17016","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:ff1ec1630a0181aac5ff34d2c652dd095164a49c02846ccbdd895286197f7a13","observation_id":"70116eac-c9ee-420b-875e-89ff832f3f60","resolution":{"observed_at":"2026-05-21T14:25:47.344448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Skid raw: Skill discovery from raw trajectories.IEEE robotics and automation letters, 6(3):4696–4703","venue":null,"work_id":"37898d52-e395-4b68-8e07-67f745da0134","year":2021},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:1fddeaba93c674f65c664edbbcbee1d4cefcc6b0b069a01f579a750d3f6526b0","observation_id":"ff95a705-7dc6-4b6d-99ee-370e761988ed","resolution":{"observed_at":"2026-05-20T05:13:03.873146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20020","last_updated":"2025-03-25T19:02:56Z","snapshot_observed_at":"2026-08-02T07:15:58.798604Z","submitted_at":"2025-03-25T19:02:56Z","title":"Gemini Robotics: Bringing AI into the Physical World","version":1},"cited_work":{"arxiv_id":"2503.20020","doi":"10.48550/arxiv.2503.20020","metadata_source":"pith","pith_arxiv_id":"2503.20020","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini Robotics: Bringing AI into the Physical World","venue":"cs.RO","work_id":"f7c5ce10-8364-4fbe-964f-2802b81c3a98","year":2025},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2503.20020","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:117c64623a52d1ef6f167d6fa6a1b9dca3c85ba522dd01adaef9a709f0b3df43","observation_id":"9079f50b-e532-4c19-a081-c8f83e6e792d","resolution":{"observed_at":"2026-05-20T05:13:03.448843Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":"2405.12213","doi":"10.48550/arxiv.2405.12213","metadata_source":"pith","pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Octo: An Open-Source Generalist Robot Policy","venue":"cs.RO","work_id":"f9ca0722-8855-48c3-a27a-0eefb7e19253","year":2024},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:323a9a7c892d5d9fa4db545610fef00161e6b0d63cda068271aac41946b526d0","observation_id":"6c7b3c5f-cf82-4405-85a5-94b1b6ef4e48","resolution":{"observed_at":"2026-05-20T05:13:03.392044Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18917","last_updated":"2024-12-12T10:39:06Z","snapshot_observed_at":"2026-07-06T18:21:52.950440Z","submitted_at":"2024-05-29T09:19:50Z","title":"Causal Action Influence Aware Counterfactual Data Augmentation","version":2},"cited_work":{"arxiv_id":"2405.18917","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.18917","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Causal action influence aware counterfactual data augmentation","venue":null,"work_id":"34cb8d35-b69b-4034-b967-e5aa6cc4e964","year":2024},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2405.18917","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:44c8968f03b14203251809e7cc25fe2d3df698c707a264e5ac609f7ef201626d","observation_id":"b22377b1-d255-4134-af4d-270b1b513dfa","resolution":{"observed_at":"2026-05-20T05:13:03.403715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00025","last_updated":"2024-07-12T12:51:00Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-12-28T23:34:43Z","title":"Any-point Trajectory Modeling for Policy Learning","version":3},"cited_work":{"arxiv_id":"2401.00025","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.00025","snapshot_observed_at":"2026-07-10T18:47:31.639635Z","title":"Any-point Trajectory Modeling for Policy Learning","venue":"cs.RO","work_id":"0c843c6a-ce05-4ca4-992b-e25516f490db","year":2023},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2401.00025","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:f3cfb51b3866dfd469803947a66bcfc715170f72c0fb2de6bea6271855800441","observation_id":"8cc35b27-8a73-4862-b012-3f6f481c3e8b","resolution":{"observed_at":"2026-05-20T05:13:03.389015Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19309","last_updated":"2025-02-04T08:49:11Z","snapshot_observed_at":"2026-07-31T23:24:14.896271Z","submitted_at":"2024-11-28T18:30:10Z","title":"GRAPE: Generalizing Robot Policy via Preference Alignment","version":2},"cited_work":{"arxiv_id":"2411.19309","doi":"10.48550/arxiv.2411.19309","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.19309","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Grape: Generalizing robot policy via preference alignment","venue":"arXiv (Cornell University)","work_id":"5bd96935-22ff-44dd-b907-e5d9bba0d61f","year":2024},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2411.19309","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:697e99fcf291fadc15c56295bc9fd595ddb9c748e94319cec3fa588128541fe4","observation_id":"5114bd6a-3171-4846-b807-df20d8a2dfa4","resolution":{"observed_at":"2026-05-20T05:13:03.383440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10345","last_updated":"2025-06-05T21:26:08Z","snapshot_observed_at":"2026-08-02T17:44:41.340688Z","submitted_at":"2024-12-13T18:40:51Z","title":"TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies","version":3},"cited_work":{"arxiv_id":"2412.10345","doi":"10.48550/arxiv.2412.10345","metadata_source":"pith","pith_arxiv_id":"2412.10345","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies","venue":"cs.RO","work_id":"56a1dd5b-7094-408b-8742-b80a424a62bb","year":2024},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"cited_paper":"/paper/2412.10345","citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:0a9a4976fbdc64137e02a817d533a4701a236fc79e29aad959829c9b38446774","observation_id":"8def5375-40d6-4e04-8aa6-0058daab9640","resolution":{"observed_at":"2026-05-20T05:13:03.394872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.19391","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T11:48:04.889143Z","title":"Lava-man: Learning visual action representations for robot manipulation","venue":null,"work_id":"ca3be7fb-4ee8-4d4f-86cb-fe0e5b8deb14","year":2025},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:5276c663e194ce95e625c077f2393004f0da59df33e32681e803cff24661595a","observation_id":"a23a9291-63cd-45db-ae69-3f8237568c6d","resolution":{"observed_at":"2026-05-20T05:13:03.380685Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":"49f4144b-6a30-4f19-95be-17cd40d411ef","year":2023},"citing_paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T05:12:26.907425Z"},"links":{"citing_paper":"/paper/2605.19580"},"observation_digest":"sha256:c0a12a2135425a3c969c1da6ceb4184e7104cb9bbbcca8f55c87d84e6ba5fc6d","observation_id":"0064377f-d5ad-43fe-9f15-9a4e38b63d3b","resolution":{"observed_at":"2026-05-20T05:13:03.860381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.19580","last_updated":"2026-05-19T09:22:49Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-06T23:30:16.094579Z","submitted_at":"2026-05-19T09:22:49Z","title":"PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":19,"verified_fuzzy":12},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2605.19580."}