{"as_of":"2026-08-10T11:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b1a2a021dd1b3988b6e2646455afa0d843658d842d6d6e71c652a2f6af02138","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T04:20:18.114193Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05674/citation-record","integrity":"/paper/2608.05674/integrity","json":"/paper/2608.05674/citation-record.json","paper":"/paper/2608.05674"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.09540","last_updated":"2023-03-22T17:22:35Z","snapshot_observed_at":"2026-08-06T15:07:40.203199Z","submitted_at":"2023-03-16T17:53:24Z","title":"SemDeDup: Data-efficient learning at web-scale through semantic deduplication","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09540","snapshot_observed_at":"2026-08-08T04:20:17.259542Z","title":"Semdedup: Data-efficient learning at web-scale through semantic deduplication.arXiv preprint arXiv:2303.09540, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.259542Z"},"links":{"cited_paper":"/paper/2303.09540","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:2f064e572e6203dbd8b236879b2d5031c75dd0c3adf33b883bb6d5358280e1b0","observation_id":"c6d40d33-a36c-48ab-bfdf-20ed7a5b93fa","resolution":{"observed_at":"2026-08-08T04:20:17.259542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06669","last_updated":"2025-08-04T04:50:21Z","snapshot_observed_at":"2026-08-04T23:08:22.516431Z","submitted_at":"2025-03-09T15:40:29Z","title":"AgiBot World Colosseo: A Large-scale Manipulation Platform for Scalable and Intelligent Embodied Systems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06669","snapshot_observed_at":"2026-08-08T04:20:17.265573Z","title":"Agibot world colosseo: A large-scale manipulation platform for scalable and intelligent embodied systems.arXiv preprint arXiv:2503.06669, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.265573Z"},"links":{"cited_paper":"/paper/2503.06669","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:61acb4f18059de47637baa0a16f611d433aaa91025dbfa97dfda2de738ebb23a","observation_id":"ffb24185-2136-4dfd-90b5-17f10d2c9957","resolution":{"observed_at":"2026-08-08T04:20:17.265573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-08T04:20:17.292790Z","title":"V-jepa 2: Self-supervised video models enable understanding, prediction and planning.arXiv preprint arXiv:2506.09985, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.292790Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:5efb0b555e9a9fc6ec8115e96b05ca4168c28e57e77d7c20f620bbe483aa836c","observation_id":"721ae9f4-4df6-461b-bbbb-6b0262e2bf3c","resolution":{"observed_at":"2026-08-08T04:20:17.292790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13030","last_updated":"2025-12-25T08:16:05Z","snapshot_observed_at":"2026-07-06T22:38:59.725645Z","submitted_at":"2025-12-15T06:58:40Z","title":"Motus: A Unified Latent Action World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13030","snapshot_observed_at":"2026-08-08T04:20:17.319779Z","title":"Motus: A unified latent action world model.arXiv preprint arXiv:2512.13030, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.319779Z"},"links":{"cited_paper":"/paper/2512.13030","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:6dddd2d20852e60f96425a21f273632a7e9aeb1c8fe142af779104d020899e4c","observation_id":"8a46947c-82bf-44e0-bfea-ad0cb5565f05","resolution":{"observed_at":"2026-08-08T04:20:17.319779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-08T04:20:17.347473Z","title":"Gr00t n1: An open foundation model for generalist humanoid robots.arXiv preprint arXiv:2503.14734, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.347473Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:1437754b7079856ecb81664f168727c8de3b6e8f92fa9d17eccbc3ec692898b7","observation_id":"13f8b882-044e-4d1b-bfff-6d8f5828e5b0","resolution":{"observed_at":"2026-08-08T04:20:17.347473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-08T04:20:17.376394Z","title":"arXiv preprint arXiv:2410.24164, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.376394Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:72db03862fdd549b16307a53edf5832492bed763b27963e266f5f88c5ebea99e","observation_id":"8ae98c6b-2744-47e9-b1ee-28f53e4b4286","resolution":{"observed_at":"2026-08-08T04:20:17.376394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-08T04:20:17.405321Z","title":"Rt-1: Robotics transformer for real-world control at scale.arXiv preprint arXiv:2212.06817, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.405321Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:5ab8a8c4b73f3415bebf0167dbcdb1bf98e4e9b8092abefc851b6dae09430626","observation_id":"9c32cd87-1cab-4c45-bd17-7cc9dfc3c558","resolution":{"observed_at":"2026-08-08T04:20:17.405321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.598384Z","title":"Dennis, Ashley Edwards, Jack Parker-Holder, Yuge Shi, Edward Hughes, Matthew Lai, Aditi Mavalankar, Richie Steigerwald, Chris Apps, et al","venue":null,"work_id":"34583036-7e41-423e-806d-dce96d2b5275","year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.410700Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:509e4dce8403429bc07afe6c4623243dca5019759d323c138788cde199c554b7","observation_id":"24670e7b-91a9-43a3-86c4-e3b244b8d6ca","resolution":{"observed_at":"2026-08-08T04:20:19.603254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06111","last_updated":"2025-11-03T11:52:57Z","snapshot_observed_at":"2026-08-09T00:51:47.897197Z","submitted_at":"2025-05-09T15:11:13Z","title":"UniVLA: Learning to Act Anywhere with Task-centric Latent Actions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06111","snapshot_observed_at":"2026-08-08T04:20:17.415546Z","title":"Univla: Learning to act anywhere with task-centric latent actions.arXiv preprint arXiv:2505.06111, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.415546Z"},"links":{"cited_paper":"/paper/2505.06111","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4140c830e5e006856433818e21e7327415ee66829dddeef8eca3982c0741f5e6","observation_id":"31f4f47e-a8c3-41bc-bf7b-724a234e8249","resolution":{"observed_at":"2026-08-08T04:20:17.415546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.583321Z","title":"Egocentric-100k, 2025","venue":null,"work_id":"3aa8b66a-9c1c-427f-8f18-e6c7e3561c95","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.421097Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:a4d97431193c052b2454765940f9043aefd2fe6758ade4f727163005b7251a06","observation_id":"b73ea498-3bb7-43f4-930f-b8fc3c3e2dc3","resolution":{"observed_at":"2026-08-08T04:20:19.588260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.567389Z","title":"Orb-slam3: An accurate open-source library for visual, visual–inertial, and multimap slam.IEEE transactions on robotics, 37(6): 1874–1890, 2021","venue":null,"work_id":"56d6cc8b-5145-4c7c-9c3f-1f3c07c69328","year":2021},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.425782Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:37e0f8081c7a53481533a66a2f5de3301ef8f96e645547679cb935d92d652593","observation_id":"aa93645c-2c4f-454d-b981-b08171337661","resolution":{"observed_at":"2026-08-08T04:20:19.572603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.430562Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.430562Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:729672d1d1c94ec730b446cd65a3f7c6834512aeb7d0a7fb1542653a6f43611f","observation_id":"8f1b3314-28cd-4af7-ad0c-390c3519f802","resolution":{"observed_at":"2026-08-08T04:20:17.430562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21539","last_updated":"2025-06-26T17:55:40Z","snapshot_observed_at":"2026-08-10T07:22:51.573401Z","submitted_at":"2025-06-26T17:55:40Z","title":"WorldVLA: Towards Autoregressive Action World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21539","snapshot_observed_at":"2026-08-08T04:20:17.435194Z","title":"Worldvla: Towards autoregressive action world model.arXiv preprint arXiv:2506.21539, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.435194Z"},"links":{"cited_paper":"/paper/2506.21539","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:b768b536b5285a4ef597369bf05382042fbb534051301d38959c3fb238b1c415","observation_id":"80515d3a-d747-4831-a1b6-a5338f3a7438","resolution":{"observed_at":"2026-08-08T04:20:17.435194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19249","last_updated":"2024-09-09T03:06:57Z","snapshot_observed_at":"2026-08-09T21:54:16.978187Z","submitted_at":"2024-02-29T15:22:17Z","title":"Mirage: Cross-Embodiment Zero-Shot Policy Transfer with Cross-Painting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19249","snapshot_observed_at":"2026-08-08T04:20:17.440001Z","title":"Mirage: Cross-embodiment zero-shot policy transfer with cross-painting.arXiv preprint arXiv:2402.19249, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.440001Z"},"links":{"cited_paper":"/paper/2402.19249","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:c4318ff47519309736d5f515ffb8bb80e13db73c8979c70a02f03ccfa87b9276","observation_id":"716aa8d5-1370-4c20-8bb7-a0f5b4d68207","resolution":{"observed_at":"2026-08-08T04:20:17.440001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.444923Z","title":"Moto: Latent motion token as the bridging language for learning robot manipulation from videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.444923Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:efcdc2d4445ba66f18a1642da18ca6fda750c661651236e8b455f05a26008acd","observation_id":"91ac49c7-f39c-4284-a055-45e07e72874f","resolution":{"observed_at":"2026-08-08T04:20:17.444923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.449306Z","title":"Rescaling egocentric vision: Collection, pipeline and challenges for epic-kitchens-100.International Journal of Computer Vision, 130:33–55, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.449306Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4b2c60b1214d6d7850360bef2048d94a10ef9c39e608371fcec5e6cf8bba6e0e","observation_id":"ee7d9eb6-1138-4f80-b461-5e64528d49d3","resolution":{"observed_at":"2026-08-08T04:20:17.449306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.531841Z","title":"Video language planning","venue":null,"work_id":"d570c7a9-1b9e-4721-97fe-8761833905ad","year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.454126Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:90999dbd0c210c290cd5a7ca1370aa6acfa8d6f87743fac550837eb7c377c908","observation_id":"645db272-770a-4ebe-8f57-0426f8644a29","resolution":{"observed_at":"2026-08-08T04:20:19.536611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.06949","last_updated":"2026-02-06T18:49:43Z","snapshot_observed_at":"2026-07-06T22:44:51.126114Z","submitted_at":"2026-02-06T18:49:43Z","title":"DreamDojo: A Generalist Robot World Model from Large-Scale Human Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.06949","snapshot_observed_at":"2026-08-08T04:20:17.459118Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.459118Z"},"links":{"cited_paper":"/paper/2602.06949","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:605cfe80235206f734ade05b633b1eee00ad5d1f38d844b2cbb3fc5871ceef1c","observation_id":"f0b5aba7-c0a0-46ac-b429-ae57247c91a0","resolution":{"observed_at":"2026-08-08T04:20:17.459118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.463745Z","title":"Ego4d: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.463745Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:abf51a3e0d90df5b7f34330db49037f7eac6870732441f1943a2f61ef1fb593a","observation_id":"8de8c896-699d-405d-8c7a-d2b608ad8e81","resolution":{"observed_at":"2026-08-08T04:20:17.463745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.506743Z","title":"Ego-exo4d: Un- derstanding skilled human activity from first- and third-person perspectives","venue":null,"work_id":"aa513d4f-fd30-4162-9fd2-8608f3f30b8f","year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.468217Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:db3594fa3771edadd5542fb246bfbca0d970fa90031baaa6378b0be798b0d884","observation_id":"11a84cdf-8427-4d45-bacd-aed56f77fb31","resolution":{"observed_at":"2026-08-08T04:20:19.511385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.493116Z","title":"Prediction with action: Visual policy learning via joint denoising process","venue":null,"work_id":"1967e58f-c037-4cca-810d-ca9e6a215716","year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.472516Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:b87258b981686afcbcf06ace07a909c3caf2fdfd4dd46172ffde16286f24589b","observation_id":"806eb031-ca14-46bd-9f85-a381988c4673","resolution":{"observed_at":"2026-08-08T04:20:19.497421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-08T04:20:17.476950Z","title":"Mastering diverse domains through world models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.476950Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:7aedbade91aba96cdab123f3f8a2d660935fccad7f9d0319cea1ccb472d3f477","observation_id":"f6bf58b0-c10d-4373-8062-2a1f7f34cecf","resolution":{"observed_at":"2026-08-08T04:20:17.476950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11709","last_updated":"2026-03-09T06:44:42Z","snapshot_observed_at":"2026-07-06T21:25:23.371749Z","submitted_at":"2025-05-16T21:34:47Z","title":"EgoDex: Learning Dexterous Manipulation from Large-Scale Egocentric Video","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11709","snapshot_observed_at":"2026-08-08T04:20:17.481561Z","title":"Egodex: Learning dexterous manipulation from large-scale egocentric video.arXiv preprint arXiv:2505.11709, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.481561Z"},"links":{"cited_paper":"/paper/2505.11709","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:df74d48530befd1e414d584de718db6e49966d51026f3a7559683e1a3942cf27","observation_id":"90851362-bed0-4675-8750-10ce35cd6849","resolution":{"observed_at":"2026-08-08T04:20:17.481561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.486347Z","title":"Robomind 2.0: A multimodal, bimanual mobile manipulation dataset for generalizable embodied intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.486347Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4225f5c38df8c891a5a19393782dc2f1a08dbeb56e89e351e739605d17497120","observation_id":"dc57ed6d-da16-499a-aa25-91ec782c4dcd","resolution":{"observed_at":"2026-08-08T04:20:17.486347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14803","last_updated":"2025-05-04T04:28:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T12:48:40Z","title":"Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14803","snapshot_observed_at":"2026-08-08T04:20:17.490892Z","title":"Video prediction policy: A generalist robot policy with predictive visual representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.490892Z"},"links":{"cited_paper":"/paper/2412.14803","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:df78a10397d36796c57204ec2b3e29b67c66a95ae567cadf8df5764c8706f4f0","observation_id":"3d33ec86-7bfb-4347-8b68-057949a39568","resolution":{"observed_at":"2026-08-08T04:20:17.490892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-08T04:20:17.512801Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.512801Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:8ee8cbdd86b3e8ea665049c0eb72c6fc784b13a9e41303c9186eab6c5a03e117","observation_id":"e334248f-1372-41be-af1f-6fa9c549d859","resolution":{"observed_at":"2026-08-08T04:20:17.512801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.479271Z","title":"Interndata-m1","venue":null,"work_id":"2863b5c9-20c9-42d0-a72e-6308d10681dc","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.540722Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:8585a19f8f01735b856a3c17521c4c19e13a0b43f0699cee2c86a86980397694","observation_id":"6612c5d9-83e5-4945-befc-b98369cddf28","resolution":{"observed_at":"2026-08-08T04:20:19.483644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-08T04:20:17.589345Z","title":"Openvla: An open-source vision-language-action model, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.589345Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:d4fe1a9471d239cad8ff986375fa329c6f147548eea015287dfb9d5e4c2d03ec","observation_id":"ef19f389-1546-4e98-9d15-fcb6ad89c383","resolution":{"observed_at":"2026-08-08T04:20:17.589345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.16163","last_updated":"2026-01-22T18:09:30Z","snapshot_observed_at":"2026-08-06T02:05:52.408905Z","submitted_at":"2026-01-22T18:09:30Z","title":"Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.16163","snapshot_observed_at":"2026-08-08T04:20:17.617524Z","title":"Cosmos policy: Fine-tuning video models for visuomotor control and planning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.617524Z"},"links":{"cited_paper":"/paper/2601.16163","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:569f251df1e7c25dc0d127339285c5071a21a54395f9d6adba448b5a9e5bf8ff","observation_id":"92148372-c732-448c-b85c-e6a1223c8fd8","resolution":{"observed_at":"2026-08-08T04:20:17.617524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.464948Z","title":"Learning to act from actionless videos through dense correspondences","venue":null,"work_id":"9dc760b6-39fa-4ea3-b744-94e6f0df8194","year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.648052Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:73ef5fb58225446e997b77f0c45c9e2c9924edf81b1167ad62b62596bb1783be","observation_id":"cc64ec47-9b59-422a-aee2-8170062b3ef7","resolution":{"observed_at":"2026-08-08T04:20:19.469772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23000","last_updated":"2026-04-24T20:40:11Z","snapshot_observed_at":"2026-08-07T23:28:46.005647Z","submitted_at":"2026-04-24T20:40:11Z","title":"Learning from the Best: Smoothness-Driven Metrics for Data Quality in Imitation Learning","version":1},"cited_work":{"arxiv_id":"2604.23000","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.23000","snapshot_observed_at":"2026-08-08T04:20:18.796549Z","title":"Learning from the Best: Smoothness-Driven Metrics for Data Quality in Imitation Learning","venue":"cs.RO","work_id":"e0fdd235-0ff4-431e-92c3-faac59286d43","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.664691Z"},"links":{"cited_paper":"/paper/2604.23000","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:d0ca4d4cd5954e0d779a3561bafa45bf0f876faae2b424c35a946a9fca965844","observation_id":"9ab5775e-274d-45e6-84fa-4d69846f5fc1","resolution":{"observed_at":"2026-08-08T04:20:18.801474Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.449326Z","title":"Let-base-dataset","venue":null,"work_id":"ea9686e4-b9ce-4221-99f0-5f4644de12f9","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.669540Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:d7facdb7ee4004274705402f7f2e5905afa7d4a35ce6f8809b8447ace25fec49","observation_id":"ee262e71-8c00-4974-941b-56bd4f637e34","resolution":{"observed_at":"2026-08-08T04:20:19.454402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.433080Z","title":"Behavior-1k: A benchmark for embodied ai with 1,000 everyday activities and realistic simulation","venue":null,"work_id":"9d99ae05-110a-462a-9bbd-5d529e292d0b","year":2023},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.674095Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:53a6a14a91d4cad06124deb82ff3d7e908da08f601db470ee90446f29b4cb3f4","observation_id":"ba2db704-6b9c-4731-a224-7c7b96626094","resolution":{"observed_at":"2026-08-08T04:20:19.437835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21998","last_updated":"2026-03-22T15:37:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T17:07:43Z","title":"Causal World Modeling for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21998","snapshot_observed_at":"2026-08-08T04:20:17.678978Z","title":"Causal world modeling for robot control.arXiv preprint arXiv:2601.21998, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.678978Z"},"links":{"cited_paper":"/paper/2601.21998","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:9765fb5ee7b1e91929d525fc8729324cc5c2bc6432e85d6c1756a4fe2d3fd1ef","observation_id":"f51fd8b7-e43a-4063-8dac-8644d6c42c76","resolution":{"observed_at":"2026-08-08T04:20:17.678978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-08-08T04:20:17.684378Z","title":"Cogact: A foundational vision-language-action model for synergizing cognition and action in robotic manipulation.arXiv preprint arXiv:2411.19650, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.684378Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4a336ec3d856edcec06b9f6e61c2159b686dcf57e218c2bba9183d8f71d52ecd","observation_id":"03893cec-0a12-4e22-b1eb-b4ace11a6aad","resolution":{"observed_at":"2026-08-08T04:20:17.684378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.418224Z","title":"Hamster: Hierarchical action models for open-world robot manipulation","venue":null,"work_id":"cdea6a12-e385-49b7-aa9b-bce641ad2ed1","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.689247Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:987ef953c79acf31c4227ae3b5e3b32203a91fdf66faac47758b48caeafc25af","observation_id":"bbc9aa23-ba79-4b69-8162-e900abd766c9","resolution":{"observed_at":"2026-08-08T04:20:19.423118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23570","last_updated":"2026-04-26T07:21:15Z","snapshot_observed_at":"2026-07-06T23:09:48.137856Z","submitted_at":"2026-04-26T07:21:15Z","title":"EgoLive: A Large-Scale Egocentric Dataset from Real-World Human Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.23570","snapshot_observed_at":"2026-08-08T04:20:17.693692Z","title":"Egolive: A large-scale egocentric dataset from real-world human tasks.arXiv preprint arXiv:2604.23570, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.693692Z"},"links":{"cited_paper":"/paper/2604.23570","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:1b8b1ca6b644b1d0655124a0fda80a9c9bfaeaa9d1630b79d0f1c80bfa002097","observation_id":"73948b7d-7fdd-43fc-9723-f33f793faca5","resolution":{"observed_at":"2026-08-08T04:20:17.693692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04999","last_updated":"2026-07-30T01:04:01Z","snapshot_observed_at":"2026-08-07T15:48:54.327194Z","submitted_at":"2025-05-08T07:07:58Z","title":"CLAM: Continuous Latent Action Models for Robot Learning from Unlabeled Demonstrations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04999","snapshot_observed_at":"2026-08-08T04:20:17.698342Z","title":"Clam: Continuous latent action models for robot learning from unlabeled demonstrations.arXiv preprint arXiv:2505.04999, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.698342Z"},"links":{"cited_paper":"/paper/2505.04999","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:d73f10dfa715c6eb6a918640ce7abe31ca1fca9c8e0bb2975db46c199e6a9057","observation_id":"7b4f74ba-1b1a-44e1-88e8-3c2f236b46ba","resolution":{"observed_at":"2026-08-08T04:20:17.698342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-08T04:20:17.702672Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.702672Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:0c892e21fa299f403957494d81491ac02e7f8e233d1a4a4ff50c92c11202daf0","observation_id":"ed480fc6-81e9-41c0-a127-6500b714971a","resolution":{"observed_at":"2026-08-08T04:20:17.702672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07100","last_updated":"2026-06-30T09:11:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-05T09:51:25Z","title":"LARA: Latent Action Representation Alignment for Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07100","snapshot_observed_at":"2026-08-08T04:20:17.707960Z","title":"Lara: Latent action representation alignment for vision-language-action models.arXiv preprint arXiv:2606.07100, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.707960Z"},"links":{"cited_paper":"/paper/2606.07100","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:b13e4b659ebbcdccd7cf878b249c9c39bb1b7a9e4f1eb192add336d7426d3de2","observation_id":"13de0e7e-4ccc-4bd0-bbfc-316db8033c25","resolution":{"observed_at":"2026-08-08T04:20:17.707960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12215","last_updated":"2026-06-03T04:04:20Z","snapshot_observed_at":"2026-08-02T23:57:43.860710Z","submitted_at":"2026-02-12T17:53:51Z","title":"LDA-1B: Scaling Latent Dynamics Action Model via Universal Embodied Data Ingestion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12215","snapshot_observed_at":"2026-08-08T04:20:17.713043Z","title":"Lda-1b: Scaling latent dynamics action model via universal embodied data ingestion","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.713043Z"},"links":{"cited_paper":"/paper/2602.12215","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:da1af97f0356fb6fe14ab838594deab573d9723dd846fc2a7ace153e5aed40ec","observation_id":"745ce748-b8d5-4ec5-b900-cf7f1d14e9c5","resolution":{"observed_at":"2026-08-08T04:20:17.713043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.403218Z","title":"Unifying perception and action: A hybrid- modality pipeline with implicit visual chain-of-thought for robotic action generation","venue":null,"work_id":"02468959-a9dc-403b-b1ff-9006700e1ecf","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.717794Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:444b3dcd3f09b3e9b3cef6257bf1a6ebf750e1d499e2ec770b2d9c6d89e0ee96","observation_id":"bc3d9c78-2cd5-4b53-9a4c-1cecfb258ddb","resolution":{"observed_at":"2026-08-08T04:20:19.408442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-08-08T04:20:17.721810Z","title":"Latent action learning requires supervision in the presence of distractors.arXiv preprint arXiv:2502.00379, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.721810Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:641cf55d73e1e0af0dc0207411957986c4b685512e304e086f7c2656b1194f13","observation_id":"67d6486f-d4e1-4932-bd3d-51e284061543","resolution":{"observed_at":"2026-08-08T04:20:17.721810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.388049Z","title":"Cosmos-embed1: A joint video-text embedder for physical ai, 2025","venue":null,"work_id":"9b491461-d6f8-4dd7-a359-fe4b8617e1b2","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.726667Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4aa9b88515d8fd3856909e8c6d8092a7903dbcf6676f637f9f8c11b80a3b8e59","observation_id":"c60be46d-ef60-4bb0-9bfe-b0fcc6a8cd73","resolution":{"observed_at":"2026-08-08T04:20:19.393027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.372521Z","title":"Baihu dataset","venue":null,"work_id":"6a08d939-2414-4836-9986-9a669174cf6b","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.731387Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:d35bcb57ff22a78b2059145e79aae56438c0f08ffc6fd50cc2a87d7a8bc73ac9","observation_id":"80cb2622-d304-4db9-9a44-f4131d897aa1","resolution":{"observed_at":"2026-08-08T04:20:19.377284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.15692","last_updated":"2025-12-19T18:30:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-17T18:47:31Z","title":"mimic-video: Video-Action Models for Generalizable Robot Control Beyond VLAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.15692","snapshot_observed_at":"2026-08-08T04:20:17.735904Z","title":"mimic-video: Video-action models for generalizable robot control beyond vlas.arXiv preprint arXiv:2512.15692, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.735904Z"},"links":{"cited_paper":"/paper/2512.15692","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:1741bebe1d2fa26b8b74cb6bb34c9517b9071a1b9f9e2445474626dfc26ffd0a","observation_id":"1f61b309-80d9-4290-9ca4-723161c95eca","resolution":{"observed_at":"2026-08-08T04:20:17.735904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.740500Z","title":"Reconstructing hands in 3d with transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.740500Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:2c5baeca4e68dc8b566fd894c006a1b7241c69d1482d13ef553c506ca7415173","observation_id":"0a76d984-57a8-4cc9-b325-ca2139ae8ddc","resolution":{"observed_at":"2026-08-08T04:20:17.740500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-08T04:20:17.745291Z","title":"Fast: Efficient action tokenization for vision-language-action models.arXiv preprint arXiv:2501.09747, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.745291Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4ad4b7bbcbb203b4808f4abf20e3754f99bb9a0c2eb8cb76f038018c0b4307fd","observation_id":"7c76b65f-ff59-42b9-9ba4-09eef952411d","resolution":{"observed_at":"2026-08-08T04:20:17.745291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07607","last_updated":"2026-07-07T17:04:24Z","snapshot_observed_at":"2026-08-10T10:03:25.795206Z","submitted_at":"2026-04-08T21:27:06Z","title":"EgoVerse: An Egocentric Human Dataset for Robot Learning from Around the World","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.07607","snapshot_observed_at":"2026-08-08T04:20:17.749807Z","title":"Egoverse: An egocentric human dataset for robot learning from around the world.arXiv preprint arXiv:2604.07607, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.749807Z"},"links":{"cited_paper":"/paper/2604.07607","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:6b6867441ded63259359be1f6b48ccb9ea6c37bfdb18418b7bc1f5a506904021","observation_id":"7ea55de1-9e25-4592-918e-5463672ec670","resolution":{"observed_at":"2026-08-08T04:20:17.749807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.02610","last_updated":"2022-01-07T18:59:32Z","snapshot_observed_at":"2026-08-09T08:53:11.112938Z","submitted_at":"2022-01-07T18:59:32Z","title":"Embodied Hands: Modeling and Capturing Hands and Bodies Together","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.02610","snapshot_observed_at":"2026-08-08T04:20:17.754322Z","title":"Embodied hands: Modeling and capturing hands and bodies together","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.754322Z"},"links":{"cited_paper":"/paper/2201.02610","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:11dcd7ad2203f09704ac177915f42564f3a375f812c307e606b459a7c641cd5d","observation_id":"4cb9c265-bc4e-4f9d-bec3-23bfec796d23","resolution":{"observed_at":"2026-08-08T04:20:17.754322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.345576Z","title":"Xperience-10m: A large-scale egocentric multimodal dataset with structured 3d/4d annotations, 2026","venue":null,"work_id":"d43d5e4b-43ec-417c-b744-fbfa6c280b5f","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.782938Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:aaa18351c5c104e3b20282e1c5c2ff184a1683300ba8e5850c0c52db820e629b","observation_id":"bfcce5ac-aa81-4693-a97c-b6043d703c47","resolution":{"observed_at":"2026-08-08T04:20:19.351131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.01544","last_updated":"2026-05-02T17:16:50Z","snapshot_observed_at":"2026-08-06T11:56:50.268753Z","submitted_at":"2026-05-02T17:16:50Z","title":"An Efficient Metric for Data Quality Measurement in Imitation Learning","version":1},"cited_work":{"arxiv_id":"2605.01544","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.01544","snapshot_observed_at":"2026-08-08T04:20:18.588377Z","title":"An Efficient Metric for Data Quality Measurement in Imitation Learning","venue":"cs.RO","work_id":"53c202bf-919f-4ac2-9b8d-ad561dc2b492","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.811009Z"},"links":{"cited_paper":"/paper/2605.01544","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:c8d7ec4bdc6a10ca40c28c08d74ec7c5229c02bea48204d83a5e9a14bcffe556","observation_id":"c4e4ba20-cd19-447b-8044-7863649f348a","resolution":{"observed_at":"2026-08-08T04:20:18.595098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.329079Z","title":"Emma-x: An embodied multimodal action model with grounded chain of thought and look-ahead spatial reasoning","venue":null,"work_id":"138b5a91-f8f8-4dc9-89b4-0660f66a4269","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.854766Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4150ec40a2efb815046512b226871e9ecce4ef7737e59ef2196feec8fd2c2675","observation_id":"49364af1-a6d4-452d-8c19-456d3b749db8","resolution":{"observed_at":"2026-08-08T04:20:19.334060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.313420Z","title":"Galaxea g0.5 technical report.arxiv, 2026","venue":null,"work_id":"38ce4ed9-56c2-42aa-a76f-753672c335f9","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.868299Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:90775bcd26579b54e3d95e2e8ed20020b27396a3adfef599dbd473d0a46f93b8","observation_id":"2e5c3cd3-caf2-4afa-b41b-067b9a6ea88b","resolution":{"observed_at":"2026-08-08T04:20:19.318339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27792","last_updated":"2026-07-15T07:09:44Z","snapshot_observed_at":"2026-08-02T15:15:08.869109Z","submitted_at":"2026-04-30T12:34:44Z","title":"Motubrain: An Advanced World Action Model for Robot Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27792","snapshot_observed_at":"2026-08-08T04:20:17.873076Z","title":"Motubrain: An advanced world action model for robot control.arXiv preprint arXiv:2604.27792, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.873076Z"},"links":{"cited_paper":"/paper/2604.27792","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:eaf98e378dff4b85fb92ce98e3c1f18dc30ec7dc113e2f9b1cdd3d4008f15fa0","observation_id":"4d62c81b-731e-4fd1-bafd-25ad225d4eb2","resolution":{"observed_at":"2026-08-08T04:20:17.873076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.297915Z","title":"Predictive in- verse dynamics models are scalable learners for robotic manipulation","venue":null,"work_id":"43d6eec1-4439-4100-a1c9-d951fb216e5d","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.878492Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:685b1cc195dafa7320ffd579ba194eb545d220547338561fbc9a58dbe17be20d","observation_id":"d2755c85-91b4-40fb-ac52-1677357c9d8d","resolution":{"observed_at":"2026-08-08T04:20:19.302893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.883021Z","title":"Interndata-a1: Pioneering high-fidelity synthetic data for pre-training generalist policy.arXiv preprint arXiv:2511.16651, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.883021Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:2a386cef73b73899240ec238df11f007868384d0413f544e3126e3a6b52e5b0e","observation_id":"99637964-6c58-47f5-98f7-218681273eae","resolution":{"observed_at":"2026-08-08T04:20:17.883021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.282598Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":"1d4097a2-284a-4967-b6d7-60d5f0fac5e7","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.887745Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:d05123230dc250c21334ad8f07de2f0484aeede98da52bde24d9453ea3c5675b","observation_id":"60678bf3-db2a-423d-8762-9066059d9dec","resolution":{"observed_at":"2026-08-08T04:20:19.287600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.267276Z","title":"Scaling proprioceptive-visual learning with heterogeneous pre-trained transformers","venue":null,"work_id":"5b298457-7a03-41e9-8363-a60518fd6ce4","year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.892249Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:bd79834904a377d3e78d1afe3d6437e488349b59a6c3fc02e5adcbdadc903eb5","observation_id":"8edb9feb-10ab-4b9b-88a5-b499a8ed7b6d","resolution":{"observed_at":"2026-08-08T04:20:19.271822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.896725Z","title":"Vq-vla: Improving vision-language-action models via scaling vector-quantized action tokenizers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.896725Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4ca64f508a7bb86ac3f949980e2cf30dcb07103d903694f41af07ba5235d084e","observation_id":"40fb96b1-1180-4285-9095-e64b55b5f79a","resolution":{"observed_at":"2026-08-08T04:20:17.896725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.242609Z","title":"Humanego: Zero-shot robot learning from minutes of human egocentric videos.arXiv e-prints, pages arXiv–2605, 2026","venue":null,"work_id":"d67db459-6805-450d-9dbd-026a75c66401","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.901082Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:fa8da13050d04c46aa058050244ab8092b1bd69fba384e6b9a29f8188b35fe53","observation_id":"8480c661-946f-4c66-9deb-eb5acb8461be","resolution":{"observed_at":"2026-08-08T04:20:19.247523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13877","last_updated":"2025-05-27T01:46:53Z","snapshot_observed_at":"2026-07-06T20:09:14.917734Z","submitted_at":"2024-12-18T14:17:16Z","title":"RoboMIND: Benchmark on Multi-embodiment Intelligence Normative Data for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13877","snapshot_observed_at":"2026-08-08T04:20:17.905555Z","title":"Robomind: Benchmark on multi-embodiment intelligence normative data for robot manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.905555Z"},"links":{"cited_paper":"/paper/2412.13877","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:234a21f643fbcd0d84477c8bc59f3fe0dea9797059189ed9dcb9bc0b40b79ba0","observation_id":"918693b3-e914-4992-9693-0fae7c5b7e5b","resolution":{"observed_at":"2026-08-08T04:20:17.905555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17441","last_updated":"2026-04-13T12:31:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-21T17:39:22Z","title":"RoboCOIN: An Open-Sourced Bimanual Robotic Data Collection for Integrated Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.17441","snapshot_observed_at":"2026-08-08T04:20:17.918768Z","title":"Robocoin: An open-sourced bimanual robotic data collection for integrated manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.918768Z"},"links":{"cited_paper":"/paper/2511.17441","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:db8564fda48d9810cf2901bf98055dba95253720356d98e6b7bc79b40fbc46e4","observation_id":"6e59e679-5677-4692-ab51-6814aaf0aa31","resolution":{"observed_at":"2026-08-08T04:20:17.918768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23073","last_updated":"2026-04-30T20:04:38Z","snapshot_observed_at":"2026-07-31T07:02:53.376869Z","submitted_at":"2026-04-24T23:57:45Z","title":"RL Token: Bootstrapping Online RL with Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.23073","snapshot_observed_at":"2026-08-08T04:20:17.942358Z","title":"Rl token: Bootstrapping online rl with vision-language-action models.arXiv preprint arXiv:2604.23073, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.942358Z"},"links":{"cited_paper":"/paper/2604.23073","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:858076e55ca4e7009b23622be2abe40833e5339445f45c16ba324a1acca1aefe","observation_id":"1d31e7d4-fdaa-4e38-98b1-9e465cf63053","resolution":{"observed_at":"2026-08-08T04:20:17.942358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:17.999798Z","title":"Gigaworld-policy: An efficient action-centered world–action model.arXiv preprint arXiv:2603.17240, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.999798Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:df40930e6481dc66d0f5757b3d74089000ee1b8c3a37adbf2cb79e37d9624ee1","observation_id":"9addfd48-b0ce-41fd-a3a5-b9b61e6268fd","resolution":{"observed_at":"2026-08-08T04:20:17.999798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.228308Z","title":"Latent action pretraining from videos","venue":null,"work_id":"464de041-d929-47d6-8d34-04aa4733fe1f","year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.025997Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4d9355c6d6ccdd68d50c99553a731c5944929560c9e1bcae37eeab54e69188ff","observation_id":"cc4d0f29-1699-4bc0-901b-915f80d7efb2","resolution":{"observed_at":"2026-08-08T04:20:19.232813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15922","last_updated":"2026-02-17T15:04:02Z","snapshot_observed_at":"2026-08-09T12:54:21.149243Z","submitted_at":"2026-02-17T15:04:02Z","title":"World Action Models are Zero-shot Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15922","snapshot_observed_at":"2026-08-08T04:20:18.032859Z","title":"World action models are zero-shot policies.arXiv preprint arXiv:2602.15922, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.032859Z"},"links":{"cited_paper":"/paper/2602.15922","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:cf8ec2581950141eac646879226e44bdfb1c55bb1d13545181ed30f30d6235ec","observation_id":"d7de02df-bdd7-4815-90b2-6a59d65b697e","resolution":{"observed_at":"2026-08-08T04:20:18.032859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02078","last_updated":"2026-06-30T05:51:48Z","snapshot_observed_at":"2026-08-03T12:41:49.134646Z","submitted_at":"2026-01-05T12:59:39Z","title":"Genie Sim 3.0 : A High-Fidelity Comprehensive Simulation Platform for Humanoid Robot","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.02078","snapshot_observed_at":"2026-08-08T04:20:18.038905Z","title":"Genie sim 3.0: A high-fidelity comprehensive simulation platform for humanoid robot.arXiv preprint arXiv:2601.02078, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.038905Z"},"links":{"cited_paper":"/paper/2601.02078","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:ffe9864f6280f230833674a13e336d9c287a41546244c565379879f9d94cf74e","observation_id":"6127a04d-15b7-48aa-8494-b37d76481408","resolution":{"observed_at":"2026-08-08T04:20:18.038905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.17846","last_updated":"2026-06-17T17:06:39Z","snapshot_observed_at":"2026-08-01T08:00:11.218777Z","submitted_at":"2026-06-16T12:14:39Z","title":"Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.17846","snapshot_observed_at":"2026-08-08T04:20:18.044437Z","title":"Qwen-robotmanip technical report: Alignment unlocks scale for robotic manipulation foundation models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.044437Z"},"links":{"cited_paper":"/paper/2606.17846","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:4202007c677df19e304f247d612b3317684a83c21fb8298ad6ef4de286a3c0c2","observation_id":"2725f2c2-eb14-403b-843d-87eb122cc2a1","resolution":{"observed_at":"2026-08-08T04:20:18.044437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.16666","last_updated":"2026-03-23T05:41:14Z","snapshot_observed_at":"2026-07-06T22:49:23.750692Z","submitted_at":"2026-03-17T15:33:43Z","title":"Fast-WAM: Do World Action Models Need Test-time Future Imagination?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.16666","snapshot_observed_at":"2026-08-08T04:20:18.049955Z","title":"Fast-wam: Do world action models need test-time future imagination? arXiv preprint arXiv:2603.16666, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.049955Z"},"links":{"cited_paper":"/paper/2603.16666","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:c0c6176ccfef8264d4ca6362347bde4adc8124a3cbaef9744c24d30f6c3d620f","observation_id":"8fcfa032-8c04-4f04-b209-ca046708bcbe","resolution":{"observed_at":"2026-08-08T04:20:18.049955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08693","last_updated":"2025-03-06T19:29:03Z","snapshot_observed_at":"2026-08-07T02:44:43.738657Z","submitted_at":"2024-07-11T17:31:01Z","title":"Robotic Control via Embodied Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08693","snapshot_observed_at":"2026-08-08T04:20:18.055631Z","title":"Robotic control via embodied chain-of-thought reasoning.arXiv preprint arXiv:2407.08693, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.055631Z"},"links":{"cited_paper":"/paper/2407.08693","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:6820e554a2fdce2ee3a32af9f40283bfa7121a4becd646b47fb7c02021df2abe","observation_id":"f216a178-9176-4952-8d7d-dde9833a9aff","resolution":{"observed_at":"2026-08-08T04:20:18.055631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:18.061102Z","title":"Atomicvla: Unlocking the potential of atomic skill learning in robots, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.061102Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:dccaddd43e761f9e0b2db98df3e2ddd92a00ed2d9563625076e34557d31c123e","observation_id":"3a61dded-a74b-4058-9477-5707da93762b","resolution":{"observed_at":"2026-08-08T04:20:18.061102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.213795Z","title":"Efros, Eli Shechtman, and Oliver Wang","venue":null,"work_id":"fb6990a8-092d-4adc-ba82-380e673454cc","year":2018},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.066384Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:7a492c09ae724b3b68c7d78f6b98e471a771e027096ed421898f43812da3678c","observation_id":"3905c5e6-cfc9-4635-955a-e431ed44d0ed","resolution":{"observed_at":"2026-08-08T04:20:19.218191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20100","last_updated":"2026-04-23T04:10:40Z","snapshot_observed_at":"2026-07-06T23:06:35.507008Z","submitted_at":"2026-04-22T01:51:48Z","title":"JoyAI-RA 0.1: A Foundation Model for Robotic Autonomy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.20100","snapshot_observed_at":"2026-08-08T04:20:18.073152Z","title":"Joyai-ra 0.1: A foundation model for robotic autonomy.arXiv preprintarXiv:2604.20100, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.073152Z"},"links":{"cited_paper":"/paper/2604.20100","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:ea47baaadf1dc942b4be86741bb82e820050a603010bc9dad05b35cb712c1869","observation_id":"d3a32a04-3acf-40dc-8994-f45e6dcb8493","resolution":{"observed_at":"2026-08-08T04:20:18.073152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.198058Z","title":"Dreamvla: a vision-language-action model dreamed with comprehensive world knowledge","venue":null,"work_id":"4b92316c-f764-4708-bce9-63995a435f00","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.089381Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:e5ff17086db7859af3cebd59b6a6d13e597f7c1211d4f2146bcd001e44f76608","observation_id":"fb08cb4e-37ef-4f48-a50d-bd418300f58e","resolution":{"observed_at":"2026-08-08T04:20:19.202799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:18.097497Z","title":"Cot-vla: Visual chain-of-thought reasoning for vision-language-action models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.097497Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:9c44e8f4f639a0924ee7015ea4d8c04880c3d9b0fa66b1b58236baa562397d4b","observation_id":"48253b1d-1e8b-4b68-a2bb-934fbdffb6f7","resolution":{"observed_at":"2026-08-08T04:20:18.097497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.172557Z","title":"Sim2real vla: Zero-shot generalization of synthesized skills to realistic manipulation","venue":null,"work_id":"fca3c48b-11ad-4d14-8dfe-893f616b12f5","year":2026},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.103196Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:c812796b2d6970fb54e8aa1bdc2c2723b7af075472d2ca938a6ac5a3ba6f7a34","observation_id":"21289431-3773-4879-9487-34d3f0d6fbbe","resolution":{"observed_at":"2026-08-08T04:20:19.177763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02792","last_updated":"2025-05-23T00:47:24Z","snapshot_observed_at":"2026-08-10T02:54:28.264405Z","submitted_at":"2025-04-03T17:38:59Z","title":"Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02792","snapshot_observed_at":"2026-08-08T04:20:18.108528Z","title":"Unified world models: Coupling video and action diffusion for pretraining on large robotic datasets.arXiv preprint arXiv:2504.02792, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.108528Z"},"links":{"cited_paper":"/paper/2504.02792","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:7f79f5276b552dc2b2774eb8264d9020b3aaa09994a2de17e2afa7ea92517fe0","observation_id":"0b821915-bf46-41c2-8330-6e208628e715","resolution":{"observed_at":"2026-08-08T04:20:18.108528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:20:19.156981Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":"0812f53b-f88a-4982-8fb4-968c42f385ca","year":2023},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:18.114193Z"},"links":{"citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:92dbedf0575e268fa48ae80f3cbdd78644c08abdd9c06f372ac0eb1fc608589f","observation_id":"ba009782-44f6-47f2-80f5-d6289af2b4da","resolution":{"observed_at":"2026-08-08T04:20:19.161758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00576","last_updated":"2025-08-30T18:04:19Z","snapshot_observed_at":"2026-08-06T11:26:06.418969Z","submitted_at":"2025-08-30T18:04:19Z","title":"Galaxea Open-World Dataset and G0 Dual-System VLA Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00576","snapshot_observed_at":"2026-08-08T04:20:17.578972Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.578972Z"},"links":{"cited_paper":"/paper/2509.00576","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:550ae7ce3eb84697587604e59842f99a208bc94847793d087400ebcfa5e11953","observation_id":"2441a3d6-23f3-4a82-99cc-c6675b880936","resolution":{"observed_at":"2026-08-08T04:20:17.578972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":2,"verified_fuzzy":26},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 0 inbound Pith citation observations for arXiv:2608.05674."}