{"as_of":"2026-08-12T22:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:39dcc9e28cb6d9127deca74c2158b86a6715b5ff3272964c274ffc2c4bb5deb2","coverage":[{"denominator":153,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:55:52.265052Z","state":"measured"},{"denominator":107,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":107,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T22:51:57.217548Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T20:46:33.635839Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.17449","snapshot_observed_at":"2026-08-05T22:51:57.217548Z","title":"Robotic manipulation via imitation learn- ing: Taxonomy, evolution, benchmark, and challenges,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06257","last_updated":"2025-08-08T12:22:36Z","snapshot_observed_at":"2026-08-08T22:12:49.743145Z","submitted_at":"2025-08-08T12:22:36Z","title":"Multi-Omics Analysis for Cancer Subtype Inference via Unrolling Graph Smoothness Priors","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:57.217548Z"},"links":{"cited_paper":"/paper/2508.17449","citing_paper":"/paper/2508.06257"},"observation_digest":"sha256:f2f8f528d86fb1dcbbabe603ee6ebed8a713bfe7c3a04169736691b32cbaff03","observation_id":"e4a243a0-1886-473c-a25d-245f4e323a45","resolution":{"observed_at":"2026-08-05T22:51:57.217548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.17449","snapshot_observed_at":"2026-08-03T15:05:04.378414Z","title":"Robotic manipulation via imitation learn- ing: Taxonomy, evolution, benchmark, and challenges.arXiv preprint arXiv:2508.17449, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.18368","last_updated":"2026-07-02T04:31:01Z","snapshot_observed_at":"2026-08-06T16:43:02.767420Z","submitted_at":"2025-12-20T13:46:08Z","title":"Learning Semantic Atomic Skills for Multi-Task Robotic Manipulation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T15:05:04.378414Z"},"links":{"cited_paper":"/paper/2508.17449","citing_paper":"/paper/2512.18368"},"observation_digest":"sha256:fafdf1b382a030d0d28827c0461a6f1bafa86191c6689b4b9733595795e74782","observation_id":"c8087e70-1560-402d-a92e-cb6b25fce7ce","resolution":{"observed_at":"2026-08-03T15:05:04.378414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"cited_work":{"arxiv_id":"2508.17449","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.17449","snapshot_observed_at":"2026-07-09T20:46:33.635839Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","venue":"cs.RO","work_id":"a6a3c7b8-3934-4eb0-bca0-bcb50f12f50b","year":2025},"citing_paper":{"arxiv_id":"2606.01047","last_updated":"2026-05-31T06:35:10Z","snapshot_observed_at":"2026-08-12T20:57:10.474923Z","submitted_at":"2026-05-31T06:35:10Z","title":"Learning Multi-Modal Trajectory Policies for Data-Efficient Robotic Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T17:26:36.956666Z"},"links":{"cited_paper":"/paper/2508.17449","citing_paper":"/paper/2606.01047"},"observation_digest":"sha256:4e74bc0d05f04f8268ac0b66d6156acf7672f6b48d985f3c05fb424ec3578f97","observation_id":"138f9714-3f7c-4e3a-8771-48e42c3713e2","resolution":{"observed_at":"2026-07-01T21:06:14.825506Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"cited_work":{"arxiv_id":"2508.17449","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.17449","snapshot_observed_at":"2026-07-09T20:46:33.635839Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","venue":"cs.RO","work_id":"a6a3c7b8-3934-4eb0-bca0-bcb50f12f50b","year":2025},"citing_paper":{"arxiv_id":"2606.25360","last_updated":"2026-06-24T03:45:06Z","snapshot_observed_at":"2026-08-05T09:22:56.337937Z","submitted_at":"2026-06-24T03:45:06Z","title":"Decoupling Semantics and Geometric Grounding: Spatial Visual Prompts for Language-Conditioned Imitation Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-25T21:23:44.253416Z"},"links":{"cited_paper":"/paper/2508.17449","citing_paper":"/paper/2606.25360"},"observation_digest":"sha256:5b855a1afecb616508132831c6c6eb2ec862d8a7fef12e7af0b56d785b36167d","observation_id":"3239d6f8-2b3f-4200-a385-b3431935b6c8","resolution":{"observed_at":"2026-07-04T19:20:07.152003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"cited_work":{"arxiv_id":"2508.17449","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.17449","snapshot_observed_at":"2026-07-09T20:46:33.635839Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","venue":"cs.RO","work_id":"a6a3c7b8-3934-4eb0-bca0-bcb50f12f50b","year":2025},"citing_paper":{"arxiv_id":"2607.07076","last_updated":"2026-07-08T07:08:11Z","snapshot_observed_at":"2026-08-08T13:37:08.811719Z","submitted_at":"2026-07-08T07:08:11Z","title":"PriGo: Test-Time Primitive Guidance to Diffusion and Flow Policies for Adaptive Robotic Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-09T20:38:38.404267Z"},"links":{"cited_paper":"/paper/2508.17449","citing_paper":"/paper/2607.07076"},"observation_digest":"sha256:73255a956d2aeca23521ff55286f27ae8dac930efcf95f4e168854bc2f1b9279","observation_id":"f38549da-8949-43ae-8897-c31b5490e21d","resolution":{"observed_at":"2026-07-09T20:46:33.637470Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.17449","snapshot_observed_at":"2026-08-01T22:07:40.751335Z","title":"Robotic manipulation via imitation learning: Taxonomy, evolution, benchmark, and challenges,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15880","last_updated":"2026-07-17T11:50:03Z","snapshot_observed_at":"2026-08-09T14:52:28.316141Z","submitted_at":"2026-07-17T11:50:03Z","title":"Dynamics-Aware Meta-Imitation for Generalization to Unseen Robotic Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T22:07:40.751335Z"},"links":{"cited_paper":"/paper/2508.17449","citing_paper":"/paper/2607.15880"},"observation_digest":"sha256:47f24c375a7b11ccd66a90d2a7551522d74570ffda2ac9f4fbf6649aef23a503","observation_id":"e2f104e6-1eca-4f38-b12e-a5c360206de5","resolution":{"observed_at":"2026-08-01T22:07:40.751335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.17449","snapshot_observed_at":"2026-08-01T00:49:56.444112Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26047","last_updated":"2026-07-28T17:56:07Z","snapshot_observed_at":"2026-08-10T18:15:50.341368Z","submitted_at":"2026-07-28T17:56:07Z","title":"S2A2: Audio-Visual Imitation Learning for Manipulation Tasks Using Acoustic Spatial Information","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T00:49:56.444112Z"},"links":{"cited_paper":"/paper/2508.17449","citing_paper":"/paper/2607.26047"},"observation_digest":"sha256:227d16d35ceea98618b8e4824cb36b127dae05b9e77ac3e95dd65c915403e958","observation_id":"473b425e-c2a5-4744-a67c-566d41849eaf","resolution":{"observed_at":"2026-08-01T00:49:56.444112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.17449/citation-record","integrity":"/paper/2508.17449/integrity","json":"/paper/2508.17449/citation-record.json","paper":"/paper/2508.17449"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:51.964904Z","title":"Loeb Classical Library","venue":null,"work_id":null,"year":1937},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:51.964904Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:053e43324c37d4a08aa7b7bb97e847efc1c56bb5e2fa8cf43c7da6f1138228d5","observation_id":"b339ca23-7b37-406b-8cde-4d722521a08a","resolution":{"observed_at":"2026-08-05T16:55:51.964904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:51.968689Z","title":"Diels and W","venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:51.968689Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:ade046c1b7be804ce13670f1ddcd83faaf5da8a7373ffbe03febaf4829595f5a","observation_id":"be728884-9e73-4fcb-baf8-9b0dcb4a23e3","resolution":{"observed_at":"2026-08-05T16:55:51.968689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:51.972069Z","title":"A review of robot learn- ing for manipulation: Challenges, representations, and algorithms,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:51.972069Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:e20ba560305403182097a4121c6ae29ae1922a131a0488cbbe33dab9de0c8516","observation_id":"2d05b3d2-ff63-4bb5-a5bd-a3221862e849","resolution":{"observed_at":"2026-08-05T16:55:51.972069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:51.976168Z","title":"Deep reinforcement learning for the control of robotic manipulation: a focussed mini-review,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:51.976168Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:831378910499c55af60c3fb92a8d4418d68c3e04f49f2ddf4a9b25ec5a4fcde8","observation_id":"9fa2c01a-fba3-4885-a901-ee6277874878","resolution":{"observed_at":"2026-08-05T16:55:51.976168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:51.979402Z","title":"Rob. auton. syst","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:51.979402Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:ec727adc39233fd8b52f89e1da92b22476f16858fd66c9f284da80fb2f31c6d0","observation_id":"e7fd3eeb-febe-4525-a5e0-d0696fd00968","resolution":{"observed_at":"2026-08-05T16:55:51.979402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:51.982690Z","title":"A survey on deep reinforcement learning algorithms for robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:51.982690Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:b4f61b204d8c30855a315c81e77a2b1ea1f96dfa5d114d9b5a72407f14e20da1","observation_id":"91822ecc-cbe0-4872-a4b2-d1a2aadb0103","resolution":{"observed_at":"2026-08-05T16:55:51.982690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:51.986649Z","title":"Deep learning approaches to grasp synthesis: A review,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:51.986649Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:6d1f6f81d28d5dc1a314aad876cd62d99b6eae43b4f97546b7ce9ca107990aa8","observation_id":"38945f7d-370b-474e-a5d3-bd7c1855d016","resolution":{"observed_at":"2026-08-05T16:55:51.986649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11537","last_updated":"2024-08-21T11:32:09Z","snapshot_observed_at":"2026-08-12T18:33:43.977533Z","submitted_at":"2024-08-21T11:32:09Z","title":"A Survey of Embodied Learning for Object-Centric Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2408.11537","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.11537","snapshot_observed_at":"2026-08-05T16:55:54.143500Z","title":"A Survey of Embodied Learning for Object-Centric Robotic Manipulation","venue":"cs.RO","work_id":"1bae8382-cdfe-4252-af9c-d94c82c8f6fa","year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:51.989772Z"},"links":{"cited_paper":"/paper/2408.11537","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:dbddc15ff70e0fc34daba8b6a1dbbcbe2cd139b0abb67a2dbdeac885c93f077a","observation_id":"0d72c5bd-fd99-450b-a9fb-2a68b1e37516","resolution":{"observed_at":"2026-08-05T16:55:54.146864Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:51.993241Z","title":"A review of embodied grasping,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:51.993241Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:84d47711056c7c179cbcb701db16f8588a106d86d40b34c7cec462fbb0f98371","observation_id":"0462a797-9112-4e88-bdf3-ba6ce8000ced","resolution":{"observed_at":"2026-08-05T16:55:51.993241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:51.996569Z","title":"Vision- language-action models: Concepts, progress, applications and chal- lenges,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:51.996569Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:220e619aa39bd8e2f3670aedc1f522e97e438390099c5df520bbd4b9d5f0e450","observation_id":"2f4b654b-8a8f-4dfc-9dea-1676368e838f","resolution":{"observed_at":"2026-08-05T16:55:51.996569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14093","last_updated":"2026-05-01T01:50:44Z","snapshot_observed_at":"2026-08-04T06:47:25.827167Z","submitted_at":"2024-05-23T01:43:54Z","title":"A Survey on Vision-Language-Action Models for Embodied AI","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14093","snapshot_observed_at":"2026-08-05T16:55:51.999629Z","title":"A survey on vision- language-action models for embodied ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:51.999629Z"},"links":{"cited_paper":"/paper/2405.14093","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:7e7e79bfcde0f1982c16dbe7653694202a27b1277b18d46f4f3de0022bd81405","observation_id":"d1ea8691-7494-4c1e-9de6-8f0950c22e45","resolution":{"observed_at":"2026-08-05T16:55:51.999629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01925","last_updated":"2025-07-02T17:34:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T17:34:52Z","title":"A Survey on Vision-Language-Action Models: An Action Tokenization Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01925","snapshot_observed_at":"2026-08-05T16:55:52.003151Z","title":"A survey on vision-language-action models: An action tokenization perspective,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.003151Z"},"links":{"cited_paper":"/paper/2507.01925","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:751aa3b4a2d854a7f61b0c24a51386338ead962096f50a8c98452c9992e5a0c6","observation_id":"55185485-8ff1-4f42-9203-4dd3343035d1","resolution":{"observed_at":"2026-08-05T16:55:52.003151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.006911Z","title":"Vision language action models in robotic manipulation: A systematic review,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.006911Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:85a9966d5bce0421f829013980d669baea5c083f4bec6f66682da4c53612fd47","observation_id":"97920d05-cf14-49c7-b878-b625a5827983","resolution":{"observed_at":"2026-08-05T16:55:52.006911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-05T16:55:52.009894Z","title":"Rt-1: Robotics transformer for real-world control at scale,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.009894Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:94ef4d534d23ce5c80c063478674a083c4ea75d028ea6df2230e188d58a6ed53","observation_id":"39fee9e2-59d8-4708-b9a2-3fd4c2285b8b","resolution":{"observed_at":"2026-08-05T16:55:52.009894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.013588Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.013588Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:e40867190386d75ddf0369ec2e1bd16837c4996a3700850f77b4ae5cfb25f9e1","observation_id":"0ccd2f15-2fa3-41ab-a934-44dc96ee92bd","resolution":{"observed_at":"2026-08-05T16:55:52.013588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.016617Z","title":"Denoising diffusion implicit mod- els,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.016617Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:c817cc97019d15cdd76d44a15dea7eb6631ac8e0b4658fbca908a5c4bc455916","observation_id":"67618fb1-c4b3-401f-9d26-cb5062fe1123","resolution":{"observed_at":"2026-08-05T16:55:52.016617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.019703Z","title":"Score-based generative modeling through stochastic differential equations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.019703Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:5de629bf1eaaebebbbf616124a63e74f2d0bf960e6ae25feb69dbd2605ddb088","observation_id":"9a42106e-27d3-4931-a6d1-f2d7ac25af7e","resolution":{"observed_at":"2026-08-05T16:55:52.019703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.022982Z","title":"Dpm-ot: A new diffusion probabilistic model based on optimal transport,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.022982Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:a0601922db62ed0a5aecce6ed0a266e1e40bed46da3604adc581da0dc9f2335c","observation_id":"d30999c9-b497-4388-b16f-cb0ee5d61248","resolution":{"observed_at":"2026-08-05T16:55:52.022982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.026000Z","title":"Flow matching for generative modeling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.026000Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:c32538ebb7670ff3108012b2fa7632a43e1f32a734ca398b29affee9c9ea0963","observation_id":"a2de3126-1efa-460e-9067-2ae72857956b","resolution":{"observed_at":"2026-08-05T16:55:52.026000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.029200Z","title":"Vector autoregressive models,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.029200Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:6b2a966fe140bd7b8e58b21230f76e9bad0229815233e3370e4c6d2f2d809207","observation_id":"2474d847-1390-4506-bc6f-1718613340cf","resolution":{"observed_at":"2026-08-05T16:55:52.029200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.032290Z","title":"Transformation autoregressive networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.032290Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:f666375507c32e41e94ebe8c756a807c66a4fb3109e36ab1b42151f393a5155d","observation_id":"fb54721c-3856-42b8-aa2b-353168b300ec","resolution":{"observed_at":"2026-08-05T16:55:52.032290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.035555Z","title":"Diffusion policy: Visuomotor policy learning via ac- tion diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.035555Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:38ec4b8db0b7df9aa54f8d8dca4bd3dc75312bc1cbcb59d926bb17600be4f96c","observation_id":"af0cabf4-1573-478f-b8b4-b5cb6a0552fc","resolution":{"observed_at":"2026-08-05T16:55:52.035555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.038985Z","title":"Zero-shot robotic manipulation with pre-trained image- editing diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.038985Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:cf7d8ba4d297ff7517d970e8c447b175f9bc56f60ae47985683cd10417256cd4","observation_id":"d4b91f86-79c5-4b2b-bc1f-21f151c4a78c","resolution":{"observed_at":"2026-08-05T16:55:52.038985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.042287Z","title":"Chaineddiffuser: Unifying trajectory diffusion and keypose prediction for robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.042287Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:603a4adceba9d0b38b1cbefa8d12de70fbdf912c27822989a440f7a0a9966763","observation_id":"310adf43-e652-468c-8172-7f977aa0af0c","resolution":{"observed_at":"2026-08-05T16:55:52.042287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.045045Z","title":"Learning an actionable discrete diffusion policy via large-scale actionless video pre- training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.045045Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:acc7f32681bb0d95b2b80d8428c2f068746a9b306f1d095ddf6399037674aea1","observation_id":"b812a0f3-d01b-40d0-aa81-cb4d8c5b1acf","resolution":{"observed_at":"2026-08-05T16:55:52.045045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.047684Z","title":"3d diffusion policy: Generalizable visuomotor policy learning via simple 3d representations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.047684Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:2090104c53c2be8cb3799a6449ca3fc4316d0ec9c307e0aa4d309325704c3eab","observation_id":"920dad2a-5dae-4dc7-9ae9-8c54cc4f1a89","resolution":{"observed_at":"2026-08-05T16:55:52.047684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.050496Z","title":"3d diffuser actor: Policy diffusion with 3d scene representations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.050496Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:8cad38a276fbe79d3e111a77a88b58cf2948f20cf43c5b47cba78e7337535662","observation_id":"2988b4cb-c3a2-46e8-a699-e8e910df55f1","resolution":{"observed_at":"2026-08-05T16:55:52.050496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.053204Z","title":"Equivariant diffusion policy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.053204Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:18c09c8cc56d780d601ecdc2f529eb93532db372f3de332317cb2fd6b7db77ae","observation_id":"d49ce526-23fa-4ba1-89e8-d2682c44341d","resolution":{"observed_at":"2026-08-05T16:55:52.053204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.055860Z","title":"Equibot: Sim (3)-equivariant diffusion policy for generalizable and data efficient learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.055860Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:ee51fb6e72404adc9de8bef10a2cabbae580176c176c134bb347049c6d5e69fc","observation_id":"f93578f5-19fe-423b-a2a7-00584c378f2d","resolution":{"observed_at":"2026-08-05T16:55:52.055860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05996","last_updated":"2024-07-08T14:46:44Z","snapshot_observed_at":"2026-08-10T20:47:29.627562Z","submitted_at":"2024-07-08T14:46:44Z","title":"Multimodal Diffusion Transformer: Learning Versatile Behavior from Multimodal Goals","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05996","snapshot_observed_at":"2026-08-05T16:55:52.058916Z","title":"Multimodal diffusion transformer: Learning versatile behavior from multimodal goals,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.058916Z"},"links":{"cited_paper":"/paper/2407.05996","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:ff3d1fe992a328b44e60610abebc022f6acaa6be1babe5de3d0d8305e34405ec","observation_id":"76e7b3a8-92e5-4153-b977-6f651ae96d02","resolution":{"observed_at":"2026-08-05T16:55:52.058916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.062358Z","title":"Sparse diffusion policy: A sparse, reusable, and flexible policy for robot learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.062358Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:e43e3aa05785d76bcfc2c3c42c4fea3aa118895d13b1639af829c597325a160f","observation_id":"d7f64dab-049a-4e99-931b-c563095744ab","resolution":{"observed_at":"2026-08-05T16:55:52.062358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.065101Z","title":"Skill expansion and composition in parameter space,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.065101Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:c469b0a25871fcc294ad588cde1d4be25655603c450ca90dd5ac2516edea2820","observation_id":"772bd655-45e6-4ffc-8780-ce144a2da42f","resolution":{"observed_at":"2026-08-05T16:55:52.065101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.068396Z","title":"Adamanip: Adaptive articulated object manipulation environments and policy learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.068396Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:749ce19a426c2e638db5ed0ded2e07e5db052a1afe7fca82445de75667a21238","observation_id":"ffe6f1b4-178c-429b-9067-9462af642d4b","resolution":{"observed_at":"2026-08-05T16:55:52.068396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.071283Z","title":"Afforddp: Generalizable diffusion policy with transferable affordance,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.071283Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:5e1001d6c0b84ebec0eade0a7b747d25e182141b4e58d4861b7708314240c4a5","observation_id":"da0fd148-c2bd-4faf-bb72-30e053aa2dd0","resolution":{"observed_at":"2026-08-05T16:55:52.071283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.074022Z","title":"Spatial-temporal graph diffusion policy with kinematic modeling for bimanual robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.074022Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:d942da028f01ca68035d3ee5adfd046b12c3a782086148a4a5d782348d91514c","observation_id":"1292afb0-0217-4ff3-b682-b3d8a6afde29","resolution":{"observed_at":"2026-08-05T16:55:52.074022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.076671Z","title":"Behavior robot suite: Streamlining real-world whole-body manipulation for everyday household activities,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.076671Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:726b21a7320f2f2a2cd72db349571e0dac55ca568c9fc95fbace6a26b12fda49","observation_id":"c1b64f35-b5a5-4618-95d0-56043c90fe9a","resolution":{"observed_at":"2026-08-05T16:55:52.076671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.01179","last_updated":"2025-05-02T10:47:21Z","snapshot_observed_at":"2026-08-12T22:50:55.402554Z","submitted_at":"2025-05-02T10:47:21Z","title":"Fast Flow-based Visuomotor Policies via Conditional Optimal Transport Couplings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.01179","snapshot_observed_at":"2026-08-05T16:55:52.079502Z","title":"Fast flow-based visuomotor policies via conditional optimal transport couplings,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.079502Z"},"links":{"cited_paper":"/paper/2505.01179","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:8adccedff855d8e492aac84950b8208e0c1bd9f6bc6a4fc2b0aec049cad0b846","observation_id":"abc3996f-bfe7-463a-9d58-5c2359835d3e","resolution":{"observed_at":"2026-08-05T16:55:52.079502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-05T16:55:52.082517Z","title":"Octo: An open-source generalist robot policy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.082517Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:9fa4f2465199022c0515a6d5322b7366cb820a1030b3196c110967145a1ad0c6","observation_id":"b6144c9a-4df9-4bdb-879a-b2e15880f699","resolution":{"observed_at":"2026-08-05T16:55:52.082517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03293","last_updated":"2025-06-04T08:30:06Z","snapshot_observed_at":"2026-08-12T14:04:58.697808Z","submitted_at":"2024-12-04T13:11:38Z","title":"Diffusion-VLA: Generalizable and Interpretable Robot Foundation Model via Self-Generated Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03293","snapshot_observed_at":"2026-08-05T16:55:52.085685Z","title":"Diffusion-vla: Scaling robot foundation models via unified diffusion and autoregression,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.085685Z"},"links":{"cited_paper":"/paper/2412.03293","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:ae95d0769e8b324de76e115e4cab13a2be8d6efa3e224be5f7427b10748add27","observation_id":"91f54363-3107-412c-bd71-703477719c40","resolution":{"observed_at":"2026-08-05T16:55:52.085685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-08-05T16:55:52.088553Z","title":"Cogact: A foundational vision-language-action model for synergizing cognition and action in robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.088553Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:c7ff6476087b5e6ca5a949bd1d77db846b88701854f47ec2de37f09016f42dad","observation_id":"15455438-8611-4a45-84ba-7a49ca7e39bf","resolution":{"observed_at":"2026-08-05T16:55:52.088553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14420","last_updated":"2025-02-21T07:28:36Z","snapshot_observed_at":"2026-08-08T15:02:42.425911Z","submitted_at":"2025-02-20T10:16:18Z","title":"ChatVLA: Unified Multimodal Understanding and Robot Control with Vision-Language-Action Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14420","snapshot_observed_at":"2026-08-05T16:55:52.091468Z","title":"Chatvla: Unified multimodal understanding and robot control with vision-language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.091468Z"},"links":{"cited_paper":"/paper/2502.14420","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:37d88e86b7bcd20b85f882013e2375c4822a052b066f6a9f509703359c600dd3","observation_id":"9a1b0fe7-1d5d-4f37-8fab-cf43743bbc1a","resolution":{"observed_at":"2026-08-05T16:55:52.091468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-08-05T16:55:52.094429Z","title":"Rdt-1b: a diffusion foundation model for bimanual manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.094429Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:a4a5026c8f33e0108687c6fda1de78f207f8978ddd6117ae91107bb9c647bcfe","observation_id":"bd2a1399-f367-4161-9cb4-32a2411bfdfd","resolution":{"observed_at":"2026-08-05T16:55:52.094429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06669","last_updated":"2025-08-04T04:50:21Z","snapshot_observed_at":"2026-08-04T23:08:22.516431Z","submitted_at":"2025-03-09T15:40:29Z","title":"AgiBot World Colosseo: A Large-scale Manipulation Platform for Scalable and Intelligent Embodied Systems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06669","snapshot_observed_at":"2026-08-05T16:55:52.097387Z","title":"Agibot world colosseo: A large-scale manipulation platform for scalable and intelligent embodied systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.097387Z"},"links":{"cited_paper":"/paper/2503.06669","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:15fef592d220b37e1a56c676db56ed4fa342d5559a573ab0d2cd2cff4cea53d0","observation_id":"9f059d89-63c1-414c-b968-b2b1188fd4b8","resolution":{"observed_at":"2026-08-05T16:55:52.097387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-05T16:55:52.100523Z","title":"Gr00t n1: An open foundation model for generalist humanoid robots,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.100523Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:c50f23b10bf124c27789ac9c2ff0e2bb0f7de0ef029af2cf1743b76760956447","observation_id":"6c843a89-c11c-4761-a0a2-7657f81e66d1","resolution":{"observed_at":"2026-08-05T16:55:52.100523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12705","last_updated":"2025-06-17T22:33:35Z","snapshot_observed_at":"2026-07-06T21:26:01.534136Z","submitted_at":"2025-05-19T04:55:39Z","title":"DreamGen: Unlocking Generalization in Robot Learning through Video World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12705","snapshot_observed_at":"2026-08-05T16:55:52.104049Z","title":"Dreamgen: Unlocking generalization in robot learning through neural trajectories,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.104049Z"},"links":{"cited_paper":"/paper/2505.12705","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:8f5e92a088074ec09a115548acff8d8915fcd6bc53d5c936445c5eccbbaa15e7","observation_id":"7d704153-2a59-4eb8-979f-625153e455f6","resolution":{"observed_at":"2026-08-05T16:55:52.104049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10631","last_updated":"2025-06-23T07:37:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-13T17:59:52Z","title":"HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10631","snapshot_observed_at":"2026-08-05T16:55:52.107538Z","title":"Hybridvla: Collaborative diffusion and autoregression in a unified vision-language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.107538Z"},"links":{"cited_paper":"/paper/2503.10631","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:ebbf2e311286c28974ac710a24d65247718c55379db4c2782cfdd8dd818e0ce8","observation_id":"dec7ff35-c95e-492c-98be-813b49b5afbc","resolution":{"observed_at":"2026-08-05T16:55:52.107538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.111197Z","title":"Affordance-based robot manipulation with flow matching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.111197Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:bb81fd696410361dd222b4f3a3ed336ae12df946d293d805ed3864c0db05c942","observation_id":"1ce339bf-6b86-469c-9f8b-aede24eadce1","resolution":{"observed_at":"2026-08-05T16:55:52.111197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.113875Z","title":"Reactive diffusion policy: Slow-fast visual-tactile policy learning for contact-rich manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.113875Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:a057574578918387a75223a724c8af3a5712c111c212602077d62156309f9810","observation_id":"09eb374d-7a57-4441-89bd-04a1395decf7","resolution":{"observed_at":"2026-08-05T16:55:52.113875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.116858Z","title":"Actionflow: Efficient, accurate, and fast policies with spatially symmetric flow matching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.116858Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:bc0a7278b1437697cd7fc0a28a0ad2e8166028e686ec3c7d0736301a06c229d9","observation_id":"b2355856-29a0-4673-90af-b056a7d6c145","resolution":{"observed_at":"2026-08-05T16:55:52.116858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-05T16:55:52.119863Z","title":"π0: A vision-language-action flow model for general robot control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.119863Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:b927bb58c226a92b024c0eea96682d28b38dcc2ac2ae2d11cf9382b462ecca99","observation_id":"6b9ab49d-43d9-409d-b057-bbffb4c6db71","resolution":{"observed_at":"2026-08-05T16:55:52.119863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03233","last_updated":"2025-08-27T03:43:58Z","snapshot_observed_at":"2026-08-07T00:53:01.614001Z","submitted_at":"2025-05-06T06:59:28Z","title":"GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03233","snapshot_observed_at":"2026-08-05T16:55:52.123267Z","title":"Graspvla: a grasping foundation model pre- trained on billion-scale synthetic action data,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.123267Z"},"links":{"cited_paper":"/paper/2505.03233","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:9210eefd80095adb56a2a7372abbe80a7741e98b389cba517310f430d10245fc","observation_id":"adc5e7e3-ad22-4236-9055-f868a42cc6b7","resolution":{"observed_at":"2026-08-05T16:55:52.123267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19417","last_updated":"2025-07-15T17:44:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T18:58:41Z","title":"Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19417","snapshot_observed_at":"2026-08-05T16:55:52.126320Z","title":"Hi robot: Open-ended instruction following with hierarchical vision-language-action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.126320Z"},"links":{"cited_paper":"/paper/2502.19417","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:e7d2eb34b3dcb7b1a192673b69f0b6cccb8c7eea1be530eeecf48c7dc9e85f0c","observation_id":"b65a24f0-cafa-4ccb-a942-93d8d69415ba","resolution":{"observed_at":"2026-08-05T16:55:52.126320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-08-05T16:55:52.129275Z","title":"Smolvla: A vision-language-action model for affordable and efficient robotics,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.129275Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:6f4a14f4d74a846bb1f84dab6045485702c61bce4526c287fbc0ee49983f0b1d","observation_id":"96b3b568-5762-49cc-876a-be52a19a8cf3","resolution":{"observed_at":"2026-08-05T16:55:52.129275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06173","last_updated":"2022-03-11T18:58:10Z","snapshot_observed_at":"2026-08-06T13:06:27.360959Z","submitted_at":"2022-03-11T18:58:10Z","title":"Masked Visual Pre-training for Motor Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.06173","snapshot_observed_at":"2026-08-05T16:55:52.132248Z","title":"Masked visual pre- training for motor control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.132248Z"},"links":{"cited_paper":"/paper/2203.06173","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:f8708f464961a2ff7dcdfefae488c24d2f3fd7e2709865878c73b4fb19436531","observation_id":"f054cdc0-d764-44db-a4dc-c2b754d0ca82","resolution":{"observed_at":"2026-08-05T16:55:52.132248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.135807Z","title":"Unleashing large-scale video generative pre-training for visual robot manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.135807Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:a267cdba9ff0fe8a83027d62f09a7d197b5b629a23edea27b7157775b5e21c92","observation_id":"cfb38acc-36e4-45f3-93ac-b0ba5ed60207","resolution":{"observed_at":"2026-08-05T16:55:52.135807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18977","last_updated":"2024-09-12T03:24:58Z","snapshot_observed_at":"2026-08-12T05:50:31.999615Z","submitted_at":"2024-06-27T08:13:33Z","title":"RoboUniView: Visual-Language Model with Unified View Representation for Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18977","snapshot_observed_at":"2026-08-05T16:55:52.138710Z","title":"Robouniview: Visual-language model with unified view representation for robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.138710Z"},"links":{"cited_paper":"/paper/2406.18977","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:879730a4ef6a23c9d22e60a3e3235250ee11c5f9e280ffa87175fd88fb383b10","observation_id":"b5fd9da0-c131-4d71-a7e5-6fb07c3c63ca","resolution":{"observed_at":"2026-08-05T16:55:52.138710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.141843Z","title":"Lift3d foundation policy: Lifting 2d large-scale pretrained models for robust 3d robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.141843Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:76b00beefba6a572989c8b4103e174b33298800798e1f35656ea92a408bf753c","observation_id":"c1c3e14f-2534-42e3-8858-4f7a71b5737d","resolution":{"observed_at":"2026-08-05T16:55:52.141843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18564","last_updated":"2025-07-13T17:41:57Z","snapshot_observed_at":"2026-08-11T02:15:26.907505Z","submitted_at":"2025-01-30T18:37:16Z","title":"SAM2Act: Integrating Visual Foundation Model with A Memory Architecture for Robotic Manipulation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18564","snapshot_observed_at":"2026-08-05T16:55:52.144895Z","title":"Sam2act: Integrating visual foundation model with a memory architecture for robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.144895Z"},"links":{"cited_paper":"/paper/2501.18564","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:c7786d527347bc316d157c071b6fcd08cd7117c1cdbf1040f978f12f92dc73f4","observation_id":"59ce92c0-ee5e-4ec7-b878-75ce382f8a95","resolution":{"observed_at":"2026-08-05T16:55:52.144895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-05T16:55:52.147753Z","title":"Fine-tuning vision-language-action models: Optimizing speed and success,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.147753Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:52e7600cd238907191d5cdbd265a29404069420c7a4f75320c2cf007103a88aa","observation_id":"a3f3db27-5c32-426c-ac12-ed70671888d3","resolution":{"observed_at":"2026-08-05T16:55:52.147753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06175","last_updated":"2022-11-11T10:04:29Z","snapshot_observed_at":"2026-08-08T03:18:33.595658Z","submitted_at":"2022-05-12T16:03:26Z","title":"A Generalist Agent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06175","snapshot_observed_at":"2026-08-05T16:55:52.150632Z","title":"A generalist agent,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.150632Z"},"links":{"cited_paper":"/paper/2205.06175","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:3b2653e35ecdb41d4e238651aa922e9028c0db487afdfc82b2fcf016804a83d8","observation_id":"1051c5a1-b443-43cb-9660-66f205cc173d","resolution":{"observed_at":"2026-08-05T16:55:52.150632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.153531Z","title":"Vima: General robot manipulation with multimodal prompts,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.153531Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:78583b152fc1de96a18612d8e9ef9b55d68a6a8f92d98b48f3838b993c404908","observation_id":"a333e620-536d-4034-899c-27071f1c243b","resolution":{"observed_at":"2026-08-05T16:55:52.153531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.156334Z","title":"Palm-e: An embodied multimodal language model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.156334Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:c202e399cb16457d9e352da58c5b353cbb9aa6afc55c14700694d7b548c0a2fb","observation_id":"0a167620-6ee2-4141-b630-4acf880e4ab3","resolution":{"observed_at":"2026-08-05T16:55:52.156334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.159413Z","title":"Learning fine-grained bimanual manipulation with low-cost hardware,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.159413Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:d7e3b30d532421e90423f9bf8db7ec50d68e70e8a9f6e31ca1503537f3f449a1","observation_id":"f9a30b39-fa5f-40b5-9ead-3cfd9430b6b3","resolution":{"observed_at":"2026-08-05T16:55:52.159413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.162168Z","title":"Vision-language foundation models as effective robot imitators,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.162168Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:623a736953ec91c422c3834d64798b3ef7c92f081550c1c5b6e9410d876bac4e","observation_id":"1eccf5f2-e538-4e04-a5bd-f42578db2eb4","resolution":{"observed_at":"2026-08-05T16:55:52.162168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.165237Z","title":"3d-vla: A 3d vision-language-action generative world model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.165237Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:020766b7613bde62a471c74bd5e1da4905b425e49d2409225153b31f58548cc6","observation_id":"afdef243-72a7-4021-82be-c622142b1891","resolution":{"observed_at":"2026-08-05T16:55:52.165237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.168258Z","title":"Behavior generation with latent actions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.168258Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:0153a20dcc77352546e24c2db8ae33e055dda8accd5e5bbe03af013c28311024","observation_id":"9895d477-aa8a-4bf8-a01b-99b9fae48977","resolution":{"observed_at":"2026-08-05T16:55:52.168258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.171052Z","title":"Openvla: An open-source vision-language-action model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.171052Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:632569b83940d1b6ec39495e0c76a9776b7b48d63222ce5d4a620cb324d51c8b","observation_id":"ccaf2615-070b-4571-acfe-f49ec802c828","resolution":{"observed_at":"2026-08-05T16:55:52.171052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.173876Z","title":"Quest: Self- supervised skill abstractions for learning continuous control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.173876Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:cd3a83452924b5cc265eaaeeaae8a3d0a621eadabf9d589177b560c114d967d0","observation_id":"91f591c3-0e22-4549-a9dc-0eb93cfb80c0","resolution":{"observed_at":"2026-08-05T16:55:52.173876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.176609Z","title":"Au- toregressive action sequence learning for robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.176609Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:ab47bfb681168f8fd23125674dc523245592d232bd97eda851697f7113bbd657","observation_id":"bebd569d-e46b-4e4c-af20-93de3689e715","resolution":{"observed_at":"2026-08-05T16:55:52.176609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06782","last_updated":"2025-08-10T06:09:58Z","snapshot_observed_at":"2026-08-12T16:04:52.077908Z","submitted_at":"2024-12-09T18:59:18Z","title":"CARP: Visuomotor Policy Learning via Coarse-to-Fine Autoregressive Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06782","snapshot_observed_at":"2026-08-05T16:55:52.179410Z","title":"Carp: Visuomotor policy learning via coarse-to-fine autoregressive prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.179410Z"},"links":{"cited_paper":"/paper/2412.06782","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:865fc16085c60f9d11c0f15bd976815232d287e5d80d16e71cf7e2a7fa65aa4b","observation_id":"9ab494ec-5051-41ee-8bf8-e93bc122867c","resolution":{"observed_at":"2026-08-05T16:55:52.179410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10345","last_updated":"2025-06-05T21:26:08Z","snapshot_observed_at":"2026-08-12T18:17:40.083518Z","submitted_at":"2024-12-13T18:40:51Z","title":"TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10345","snapshot_observed_at":"2026-08-05T16:55:52.183196Z","title":"Tracevla: Visual trace prompting en- hances spatial-temporal awareness for generalist robotic policies,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.183196Z"},"links":{"cited_paper":"/paper/2412.10345","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:e8e6b2b0b85cb264b69df7f0fbdc09ac37d899b8d31e61da06a51942597b08c6","observation_id":"23d425b4-18b6-4e9f-ae67-b23e3ec5efe6","resolution":{"observed_at":"2026-08-05T16:55:52.183196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14058","last_updated":"2026-02-13T02:05:15Z","snapshot_observed_at":"2026-08-05T18:48:10.679925Z","submitted_at":"2024-12-18T17:07:20Z","title":"What Matters in Building Vision-Language-Action Models for Generalist Robots","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14058","snapshot_observed_at":"2026-08-05T16:55:52.186146Z","title":"Towards generalist robot policies: What matters in building vision-language-action models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.186146Z"},"links":{"cited_paper":"/paper/2412.14058","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:cfe84ab940c8bbaa0e63eecbb93a8a8de471ef865f9ec27b740bd57183236890","observation_id":"941c0693-7845-4c8e-900e-1492f4a0ccc8","resolution":{"observed_at":"2026-08-05T16:55:52.186146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-05T16:55:52.189100Z","title":"Fast: Efficient action tokenization for vision-language-action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.189100Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:f9ad19d2eca493e2d82bdbee759c788644200fce7d8c5f7cf22687cac8dbc93a","observation_id":"4e33c551-7fab-42c5-bc95-867a4a125250","resolution":{"observed_at":"2026-08-05T16:55:52.189100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-05T16:55:52.191930Z","title":"Spatialvla: Exploring spatial representations for visual-language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.191930Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:a07cfe571e099a110e5cc425990183f0f5151dd2c1722a6dc9a008d257e06682","observation_id":"731ac391-91e8-4962-8720-635ec658be7e","resolution":{"observed_at":"2026-08-05T16:55:52.191930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.194916Z","title":"Vla-cache: Towards efficient vision-language-action model via adaptive token caching in robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.194916Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:ead5397fac2957b6ce23106675fda7b6d0d9484545ee3962ae311a07d6487d7c","observation_id":"473488c2-a8d9-4d6f-bfd8-b2b7ebd3e6df","resolution":{"observed_at":"2026-08-05T16:55:52.194916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05485","last_updated":"2025-05-10T18:11:38Z","snapshot_observed_at":"2026-08-08T19:05:01.694808Z","submitted_at":"2025-02-08T07:50:22Z","title":"HAMSTER: Hierarchical Action Models For Open-World Robot Manipulation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05485","snapshot_observed_at":"2026-08-05T16:55:52.197675Z","title":"Hamster: Hierarchical action models for open-world robot manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.197675Z"},"links":{"cited_paper":"/paper/2502.05485","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:d8a4b4b97f8483d0f5a7923d3678275437289ca0c6e80ef33d2a778b1189b0ce","observation_id":"8521a728-ac2d-4c3a-a5e1-3ac498d1cef2","resolution":{"observed_at":"2026-08-05T16:55:52.197675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.200941Z","title":"Magma: A foundation model for multimodal ai agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.200941Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:ed42431b3f4f276d0549fc03f936725871e77b61185879105b6bb42f0315fb67","observation_id":"d53396d7-983f-4352-8ccb-4f3f026d6916","resolution":{"observed_at":"2026-08-05T16:55:52.200941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.203652Z","title":"Cot-vla: Visual chain-of-thought reasoning for vision-language-action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.203652Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:35b166bbbf0fbdf45895edb55b7d72ed9ebd3c3247188dd2f358191586d7978c","observation_id":"6ba06790-709a-4f46-9cd3-b6c7e9ded505","resolution":{"observed_at":"2026-08-05T16:55:52.203652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06111","last_updated":"2025-11-03T11:52:57Z","snapshot_observed_at":"2026-08-09T00:51:47.897197Z","submitted_at":"2025-05-09T15:11:13Z","title":"UniVLA: Learning to Act Anywhere with Task-centric Latent Actions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06111","snapshot_observed_at":"2026-08-05T16:55:52.206366Z","title":"Univla: Learning to act anywhere with task-centric latent actions,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.206366Z"},"links":{"cited_paper":"/paper/2505.06111","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:cc86635e4ecbd4c2efe1ecf4c8d1ed439c20d3fd8d8bbfdd008f1385bd217a6a","observation_id":"9598972c-ae02-4222-8780-1f80f0ba7d3c","resolution":{"observed_at":"2026-08-05T16:55:52.206366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.209193Z","title":"Latent action pretraining from videos,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.209193Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:a9e3fc74dbf2f2fb02f58da8d6d0f169c1ad0a12640659562359ebe1c8143f2a","observation_id":"54d06d28-eac3-4787-869c-89ada0f0739b","resolution":{"observed_at":"2026-08-05T16:55:52.209193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.211733Z","title":"Robotic control via embodied chain-of-thought reasoning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.211733Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:00caa035a23b583b80e91b8cb455abe21da45c6c3e83ecdfad398e54e2130539","observation_id":"27a86d5b-8c3a-422a-9ae4-48d4005ffa7d","resolution":{"observed_at":"2026-08-05T16:55:52.211733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21539","last_updated":"2025-06-26T17:55:40Z","snapshot_observed_at":"2026-08-10T07:22:51.573401Z","submitted_at":"2025-06-26T17:55:40Z","title":"WorldVLA: Towards Autoregressive Action World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21539","snapshot_observed_at":"2026-08-05T16:55:52.214289Z","title":"Worldvla: Towards autore- gressive action world model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.214289Z"},"links":{"cited_paper":"/paper/2506.21539","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:61fd5521499e2a055941b686818f58dca4d6ffb2fcfae252841a1b6e2ea4212d","observation_id":"292cac8f-607e-48d9-bc07-d6abb04502a7","resolution":{"observed_at":"2026-08-05T16:55:52.214289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.217071Z","title":"Lotus: Continual imitation learning for robot manipulation through unsupervised skill discovery,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.217071Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:389756fafa6d159d405c3672efa4f73b47a9837b8fb529b9ec726a4dad92fec5","observation_id":"0c079c4f-238f-4179-918a-7ced2a660429","resolution":{"observed_at":"2026-08-05T16:55:52.217071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.219691Z","title":"What matters in language conditioned robotic imitation learning over unstructured data,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.219691Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:698935c826b0e67de8f2c323b49adf1e732be34aa2d4091c97f4133c8ed0ce9b","observation_id":"7529230a-2ace-4393-a316-566239a4a6e4","resolution":{"observed_at":"2026-08-05T16:55:52.219691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.222316Z","title":"Bridgevla: Input-output alignment for efficient 3d manipulation learning with vision-language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.222316Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:941a5b46f7fc0e36b2427346eccacdd8bf68124d945f34eeebe613c9033a6395","observation_id":"6cce1370-d91a-46c4-9d30-54516a4cc2ed","resolution":{"observed_at":"2026-08-05T16:55:52.222316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.224940Z","title":"Se (3)-diffusionfields: Learning smooth cost functions for joint grasp and motion optimization through diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.224940Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:43d287adcd4cb4e2e5da67e5b0226c499a9aa64f6aa0a0e871e5003398cd32da","observation_id":"f2843c86-4c44-42bd-8813-46c16ddaa01b","resolution":{"observed_at":"2026-08-05T16:55:52.224940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.228157Z","title":"A0: An affordance-aware hierarchical model for general robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.228157Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:51d0bfc8a2498b14239a69cad33e80704aeeb1453b3ed9e776ee1966d392a062","observation_id":"65a09a2f-2c95-42c3-aae1-de70d3da0232","resolution":{"observed_at":"2026-08-05T16:55:52.228157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.230688Z","title":"Flow matching imitation learning for multi-support manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.230688Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:d4cb72808fe1a844903b60ddbf4687e002ca50818a3c2b724aab7bd6b9d237a1","observation_id":"e2d4287f-b7f4-4e2a-9287-8d05c29d81b9","resolution":{"observed_at":"2026-08-05T16:55:52.230688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.233342Z","title":"Polarnet: 3d point clouds for language-guided robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.233342Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:f7c014436368539d89ec69ed363e1369a9cd4ee42c7f64379505092fc407a3a3","observation_id":"c2a15b88-fc0d-439a-a210-719a626815c5","resolution":{"observed_at":"2026-08-05T16:55:52.233342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.235989Z","title":"Instruction-driven history-aware policies for robotic ma- nipulations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.235989Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:0c8d0ae2109602229f6a5bf94fe743c3b5147577707373ff9cedad060006a1c1","observation_id":"117abcf5-ece3-45ef-8faf-2d8691aa095d","resolution":{"observed_at":"2026-08-05T16:55:52.235989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.238931Z","title":"Perceiver-actor: A multi-task transformer for robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.238931Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:c8162fa477acf5ad0d328d0d369c882435e82b6be90dbec1db605622ec3f8521","observation_id":"adc15eb7-b8d8-4bd8-ab0d-9551ef82ce93","resolution":{"observed_at":"2026-08-05T16:55:52.238931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.241586Z","title":"Rvt: Robotic view transformer for 3d object manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.241586Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:70bad52f6b3aad3415a63de64c10ee18577a3bf5aed4b4d448d7210e10859c65","observation_id":"cc18e18a-a758-498c-8252-615655ca601a","resolution":{"observed_at":"2026-08-05T16:55:52.241586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.244548Z","title":"Act3d: 3d feature field transformers for multi-task robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.244548Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:de63bb00513165acc0d33c8171a73145c9f13842b44c6c88c5a48b2e263ffb9f","observation_id":"f34fc0d0-1d0d-414f-94a9-5facfb834365","resolution":{"observed_at":"2026-08-05T16:55:52.244548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.247634Z","title":"Sam- e: Leveraging visual foundation model with sequence imitation for embodied manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.247634Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:ed940f00fd8d9d9a94a6119cddc3f9046e623ca45a103de66b19518f4d7c6c84","observation_id":"bf6652b6-009b-48a1-b277-5bc9c583ddc2","resolution":{"observed_at":"2026-08-05T16:55:52.247634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21351","last_updated":"2025-05-27T15:46:10Z","snapshot_observed_at":"2026-08-10T21:44:26.251818Z","submitted_at":"2025-05-27T15:46:10Z","title":"EquAct: An SE(3)-Equivariant Multi-Task Transformer for Open-Loop Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21351","snapshot_observed_at":"2026-08-05T16:55:52.250656Z","title":"Equact: An se (3)- equivariant multi-task transformer for open-loop robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.250656Z"},"links":{"cited_paper":"/paper/2505.21351","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:dfcc7d6cfb2276ea4828d11d3bd1a9d39e8167373e64d1aec888242b5015280c","observation_id":"2262f6d6-f125-45ac-97f1-4f052e6e10d4","resolution":{"observed_at":"2026-08-05T16:55:52.250656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.253808Z","title":"Cliport: What and where pathways for robotic manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.253808Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:559254f69a2089bc3d0e52510791022fd63cf31c3b8570e0c038384e9258cc48","observation_id":"99225dd8-1328-41c1-aeb0-4cc6d05d1812","resolution":{"observed_at":"2026-08-05T16:55:52.253808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.256407Z","title":"Moka: Open-vocabulary robotic manipulation through mark-based visual prompting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.256407Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:425c550f3e82677c42baa59511d7461874a20bc17810d113cd5578e36b61fc08","observation_id":"455e54cd-e5a8-476c-a414-bfd1cdb4d432","resolution":{"observed_at":"2026-08-05T16:55:52.256407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.258936Z","title":"Ram: Retrieval-based affordance transfer for generalizable zero-shot robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.258936Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:7173ed6a2f7a7e9ae1c2276aa4fc7043d35e7e8b256c9ac7305294c8c2da1da7","observation_id":"0578c6a1-2bdf-407e-a4b6-a3469a34f81c","resolution":{"observed_at":"2026-08-05T16:55:52.258936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:55:52.262167Z","title":"Rekep: Spatio-temporal reasoning of relational keypoint constraints for robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.262167Z"},"links":{"citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:45b7ea55253a42947c3c2f01f2744174e1c94888a59273258d8aa20861a68424","observation_id":"92ea1b5f-0a59-4284-9d81-59043bd85d5f","resolution":{"observed_at":"2026-08-05T16:55:52.262167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01345","last_updated":"2025-03-01T22:11:10Z","snapshot_observed_at":"2026-08-12T22:32:46.425651Z","submitted_at":"2024-10-02T09:02:34Z","title":"Towards Generalizable Vision-Language Robotic Manipulation: A Benchmark and LLM-guided 3D Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01345","snapshot_observed_at":"2026-08-05T16:55:52.265052Z","title":"Towards generalizable vision- language robotic manipulation: A benchmark and llm-guided 3d pol- icy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-05T16:55:52.265052Z"},"links":{"cited_paper":"/paper/2410.01345","citing_paper":"/paper/2508.17449"},"observation_digest":"sha256:fb622d415fc1229af6310e8b578be1515455724c452835b852dfa2ee1f8295b4","observation_id":"df17cc24-fc12-46b6-aa7c-ac86d441d755","resolution":{"observed_at":"2026-08-05T16:55:52.265052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.17449","last_updated":"2025-09-04T16:46:34Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-12T15:17:35.772655Z","submitted_at":"2025-08-24T17:01:15Z","title":"Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":153},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 100 of 153 outbound references and 7 inbound Pith citation observations for arXiv:2508.17449."}