{"as_of":"2026-08-09T01:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:79206b3b692f5c26e880143c4591ac836a68e2efb1368d947560d0813dedd559","coverage":[{"denominator":117,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:06:14.622405Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20033/citation-record","integrity":"/paper/2607.20033/integrity","json":"/paper/2607.20033/citation-record.json","paper":"/paper/2607.20033"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.322238Z","title":"Learning agile and dynamic motor skills for legged robots.Science Robotics, 4(26):eaau5872, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.322238Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:ffd678156bb5b687bbb5904d17ad0314b2c820fa3fe22d45642334df2688c98a","observation_id":"94359ae8-8180-4b6a-9a92-35b8e76da95e","resolution":{"observed_at":"2026-08-01T11:06:14.322238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.326173Z","title":"Learning quadrupedal locomotion over challenging terrain.Science Robotics, 5(47):eabc5986, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.326173Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:db13c44d2eaa3701907a0c5ea4af3183fe0a3420625dfd514db840d8d38bc632","observation_id":"31383d2c-fb02-4955-be36-b420bf8072af","resolution":{"observed_at":"2026-08-01T11:06:14.326173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.329059Z","title":"Visual dexterity: In-hand reorientation of novel and complex object shapes.Science Robotics, 8(84):eadc9244, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.329059Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:0294875c8e4f5dcdd809c90bb16b8d4d27d76de40fba9c803b47e5c4e50656a6","observation_id":"e85ff0d9-0444-46cc-b40e-76cfccf17004","resolution":{"observed_at":"2026-08-01T11:06:14.329059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07113","last_updated":"2019-10-16T00:59:05Z","snapshot_observed_at":"2026-08-02T15:37:37.200292Z","submitted_at":"2019-10-16T00:59:05Z","title":"Solving Rubik's Cube with a Robot Hand","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07113","snapshot_observed_at":"2026-08-01T11:06:14.332530Z","title":"Solving Rubik’s cube with a robot hand","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.332530Z"},"links":{"cited_paper":"/paper/1910.07113","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:46db40d1bf5e860d1dd235da99a719a6c48d729b024476ba05b8a908124f7b0e","observation_id":"d91eb503-8646-4787-ab3a-267304942f20","resolution":{"observed_at":"2026-08-01T11:06:14.332530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.336354Z","title":"QT-Opt: Scalable deep reinforcement learning for vision-based robotic manipulation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.336354Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:dff26fb0d9f3ac70b8e21b56871bbd5b999fc1c9e598a24a509430eb3344f360","observation_id":"b2be2375-b5ec-447b-86b5-13d25e217a23","resolution":{"observed_at":"2026-08-01T11:06:14.336354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.339512Z","title":"Scaling up multi-task robotic reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.339512Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:c952861a39e4f5dd964f0834664f7d4ad8e2b0771c3a74831858cc7420eca3d3","observation_id":"7a5d49b2-b912-43d9-ba97-5407b2ad3758","resolution":{"observed_at":"2026-08-01T11:06:14.339512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.345777Z","title":"A generalized path integral control approach to reinforce- ment learning.Journal of Machine Learning Research, 11:3137–3181, 2010","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.345777Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:6f63c445f50f553bd233117fb64bb368d7997bd44eaf3251b311f7d9f4aa542b","observation_id":"2db30b1a-54e8-4262-91f8-93d5771ac8c7","resolution":{"observed_at":"2026-08-01T11:06:14.345777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.349219Z","title":"Path integral guided policy search","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.349219Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:7dbc54c92a3231b63d2459e4568bfa2b0c3a8d8133af5ba65e07133456c2754f","observation_id":"56be6551-0e6d-4b8e-ac45-478c1fa5d384","resolution":{"observed_at":"2026-08-01T11:06:14.349219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.355179Z","title":"Learning coordinated badminton skills for legged manipulators.Science Robotics, 10(102):eadu3922, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.355179Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:8c4148c083674f715bb16358ce272f246255c30f9c203c032608d2213f3b3be2","observation_id":"42f478a6-c7ee-4ffb-bcaa-f124f707500e","resolution":{"observed_at":"2026-08-01T11:06:14.355179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.357852Z","title":"Precise and dexterous robotic manipulation via human-in- the-loop reinforcement learning.Science Robotics, 10(105):eads5033, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.357852Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:35eb09dfab0d0df796f65f189cf2c9d10f0cef985ff6ddbd700bbf9faf2fee9a","observation_id":"ce5ed6d5-3969-4b24-8c5d-287a8c5c444f","resolution":{"observed_at":"2026-08-01T11:06:14.357852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1126/scirobotics.ads6790","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Barreiros, Aykut Özgün Önol, Mengchao Zhang, Sam Creasey, Aimee Goncalves, Andrew Beaulieu, Aditya Bhat, Kate M","venue":"Science Robotics","work_id":"f3ce3fe1-7f9e-470b-9372-951bfe5a39e0","year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.360554Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:e43e3b36768ecb89ef6a352e2e0a2772ba70bfb61cb015db1074f6404a50b91b","observation_id":"58750782-11ed-4e7e-a708-c6d01e743cf2","resolution":{"observed_at":"2026-08-01T11:08:35.489516Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.363086Z","title":"Is imitation learning the route to humanoid robots?Trends in Cognitive Sciences, 3(6):233–242, 1999","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.363086Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:eaa11e9f9a356a4b3cbd584a2c9cf2ce4812db10a0c8271ac1c3c11dfb82b81d","observation_id":"ef832a9f-1fad-490c-8c2a-103f579e6ba3","resolution":{"observed_at":"2026-08-01T11:06:14.363086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.365672Z","title":"Sanketi, Grecia Salazar, Michael S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.365672Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:e2c92080964056a3e215ec3f914d391fab23c089a5b838c29f8a0d2b89beeecf","observation_id":"81d501af-ed7c-425d-b38c-aba62af36d4c","resolution":{"observed_at":"2026-08-01T11:06:14.365672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.368337Z","title":"In Proceedings of Robotics: Science and Systems, Los Angeles, CA, USA, 6 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.368337Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:ebbc8cda991c5d1be34e3048be4a1f7955584a5bb1481338cbf05f4bd7a147a5","observation_id":"e47ab465-17f2-4f00-96d1-ef4b9c8bc63f","resolution":{"observed_at":"2026-08-01T11:06:14.368337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-01T11:06:14.370745Z","title":"In9th Annual Conference on Robot Learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.370745Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:ae0c6894e72a6340f3c8d3c7af05c5f56f7cb8b9fa0f3182205d18689b7710d0","observation_id":"eb283036-c049-4964-b2ed-01884736ce38","resolution":{"observed_at":"2026-08-01T11:06:14.370745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.373831Z","title":"Toward next-generation learned robot manipulation.Science Robotics, 6(54):eabd9461,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.373831Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:59d1a4ede013cb7b28fc79354621d9f13f42e818d1b33c7635d87624d4192df4","observation_id":"1f836854-ada9-4d92-896d-664d4c65a5da","resolution":{"observed_at":"2026-08-01T11:06:14.373831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.379606Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.379606Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:8710445eaceeadd249970ffe67ad9d2930ffa7d48aa0ede538b938b0494ddb32","observation_id":"7446c1bd-1e0e-4fed-b958-4fa8a336a585","resolution":{"observed_at":"2026-08-01T11:06:14.379606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.382048Z","title":"Learning fine-grained bimanual manipulation with low-cost hardware","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.382048Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:b2d40c7e92f2222420cb9e191236807c2484de95b6f3661bae4bf96b44826dee","observation_id":"876d813f-f882-4067-886d-d3ac3bec386f","resolution":{"observed_at":"2026-08-01T11:06:14.382048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.385066Z","title":"RT-1: Robotics transformer for real-world control at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.385066Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:211b00365bf03fa792d2ce798dfe66f1a71f201274859db7fcc0ed026ec357d4","observation_id":"d1fcdd1e-5b8e-408f-9026-32a24c71b420","resolution":{"observed_at":"2026-08-01T11:06:14.385066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.388416Z","title":"Open X-Embodiment: Robotic learning datasets and RT-X models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.388416Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:c89897e872b5b136c8be3eaf3929bdd0bf1db68bc97d642dd3f3f7f819022670","observation_id":"8bb048f5-b077-4cc1-b109-24e8d470aeab","resolution":{"observed_at":"2026-08-01T11:06:14.388416Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.391072Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.391072Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:f24e53808e2ce08355d3a7d7bc9912d6f927ce9a9fee59be84b8d5ac7627e3cb","observation_id":"784b7789-1279-423c-b45d-60a55e13a68d","resolution":{"observed_at":"2026-08-01T11:06:14.391072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09930","last_updated":"2025-06-11T16:52:18Z","snapshot_observed_at":"2026-08-07T04:35:01.931995Z","submitted_at":"2025-06-11T16:52:18Z","title":"From Intention to Execution: Probing the Generalization Boundaries of Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09930","snapshot_observed_at":"2026-08-01T11:06:14.393672Z","title":"From intention to execution: Probing the generaliza- tion boundaries of vision-language-action models.arXiv preprint arXiv:2506.09930, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.393672Z"},"links":{"cited_paper":"/paper/2506.09930","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:76fe0a918cf24d602e64d81c685bc0aa183671cc67558fb6101e95136128d73d","observation_id":"7274a360-5f3c-4098-acd1-5d1578617171","resolution":{"observed_at":"2026-08-01T11:06:14.393672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.396754Z","title":"Ricl: Adding in-context adaptability to pre-trained vision-language-action models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.396754Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:b713f1a57d1ae76d5c370598554e745c97aef32cb759a511024fd189fa9fc00c","observation_id":"ba9bc7c0-aae1-4b8a-8edf-65c29bb08870","resolution":{"observed_at":"2026-08-01T11:06:14.396754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.399270Z","title":"FLaRe: Achieving masterful and adaptive robot policies with large-scale reinforcement learning fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.399270Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:5e00e37483745abd2a184057bbef5e08ef203f7386601d3854d5990acbd40015","observation_id":"408baf13-066f-49c7-b04e-bd321caf8875","resolution":{"observed_at":"2026-08-01T11:06:14.399270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.402247Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.402247Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:c57cbaf9e60a641b2a1b985bdc63bc4516ac0e7586e1023c2dd48695bd1d252b","observation_id":"a1afcf68-1be3-4145-896d-1bdd1d0be6e6","resolution":{"observed_at":"2026-08-01T11:06:14.402247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.404884Z","title":"Learning by watching: Extracting reusable task knowledge from visual observation of human performance.IEEE Transactions on Robotics and Automation, 10(6):799–822, 1994","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.404884Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:8647a52624d68799a5c56a6e567ea1d2d10f573fb82bd0a4dbe29833197d57f4","observation_id":"be24fb01-4931-4523-a20d-81b6d89f6d2b","resolution":{"observed_at":"2026-08-01T11:06:14.404884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.407354Z","title":"One-shot visual imitation learning via meta-learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.407354Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:1813d486edb1dfb2b46011b89f65db11ea604ac6d41a19cb911f13dcd9cab5ad","observation_id":"73f553e2-3f32-4fca-ab95-9133b8f05908","resolution":{"observed_at":"2026-08-01T11:06:14.407354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.409817Z","title":"One-shot imitation from observing humans via domain-adaptive meta-learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.409817Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:c940eeac9a799889ea0ce0ea68e9c94ed14f3e8ec8099f1a7f35c30c54ef5f08","observation_id":"69b31d01-597f-455d-b3dc-43433d1e98eb","resolution":{"observed_at":"2026-08-01T11:06:14.409817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.412233Z","title":"Towards more generalizable one-shot visual imitation learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.412233Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:9a9667a2f965aeb5dd984b10f564dbb84fbcd181dd2e6a81d9ec7389b18d6427","observation_id":"6b99bef7-0c7f-46e8-9acc-c37fe7e00dca","resolution":{"observed_at":"2026-08-01T11:06:14.412233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.15607/rss.2024.xx.052","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vid2Robot: 23 End-to-end Video-conditioned Policy Learning with Cross-Attention Transformers","venue":null,"work_id":"6282aaa0-bf92-4405-9d7f-e4432408e636","year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.414848Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:a891fc42edb137a5d03e233481d12dfe182b236a0bbf3dc595e7831c9644e4d3","observation_id":"10a83cc3-ad8f-45c6-8c6f-30a7cfeb88dd","resolution":{"observed_at":"2026-08-01T11:08:35.235070Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.417781Z","title":"Osvi-wm: One-shot visual imitation for unseen tasks using world-model-guided trajectory generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.417781Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:79cd7403f632f0db51562f81affc1220ad0272ffe0a5ddbf82b086068461b84b","observation_id":"7cc6af32-645c-4526-8f3f-64c6eddb73f8","resolution":{"observed_at":"2026-08-01T11:06:14.417781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.420468Z","title":"Remembering the past to imagine the future: the prospective brain.Nature Reviews Neuroscience, 8(9):657–661, 2007","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.420468Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:fdfef18e46ec506b64ae582bb26824c84d3348b736c41d0e92c03b772ddcdd63","observation_id":"b2f1a0b4-c5e9-4fe8-aa35-0436f800d3ae","resolution":{"observed_at":"2026-08-01T11:06:14.420468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.422854Z","title":"Infant imitation after a 1-week delay: long-term memory for novel acts and multiple stimuli","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.422854Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:95b3ad05749ca8aab63adfeda383cd1b79e143cc99f87c0e0f0c258c29917d61","observation_id":"d8b1e285-b93f-47a8-9890-c6ea725e75df","resolution":{"observed_at":"2026-08-01T11:06:14.422854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.425807Z","title":"Reinforcement learning and episodic memory in humans and animals: an integrative framework.Annual Review of Psychology, 68:101–128, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.425807Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:a893b737efa9b1562b59857d4036e392c29b5f415a1a3fd2c722a4656aebed15","observation_id":"f9c97278-27f3-4a00-877d-01141e6949c0","resolution":{"observed_at":"2026-08-01T11:06:14.425807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.428457Z","title":"Neural simulation of action: a unifying mechanism for motor cognition.NeuroImage, 14(1): S103–S109, 2001","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.428457Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:1e654d155305e93c13a03dae563588f118b32d548f160561154a406cc7c5fcec","observation_id":"38020a35-ef05-4b6a-9f53-03a01ce2e132","resolution":{"observed_at":"2026-08-01T11:06:14.428457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.431672Z","title":"A unifying computational framework for motor control and social interaction.Philosophical Transactions of the Royal Society B: Biological Sciences, 358(1431):593–602, 2003","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.431672Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:1a1dbda80e58d9d6e2e9416659b92882e6e0bc0af3d2330d2c7b9442ad53c117","observation_id":"8af4d18e-5d39-435e-b4fd-4e21921b9af2","resolution":{"observed_at":"2026-08-01T11:06:14.431672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.434086Z","title":"Neurophysiological mechanisms underlying the understanding and imitation of action.Nature Reviews Neuroscience, 2(9):661–670, 2001","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.434086Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:aba70e920fe01bd4561604fd5f0267539e98375c4eb9247e5905ba3bd76b3166","observation_id":"0fca39c9-e272-4c56-85f8-d64780b8154a","resolution":{"observed_at":"2026-08-01T11:06:14.434086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.436692Z","title":"Neural circuits underlying imitation learning of hand actions: an event-related fmri study.Neuron, 42(2):323–334,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.436692Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:59ccb2a59e54cb57e95fddcef2e75215b02326ccfd3db7814fa7fef7e2d43ff0","observation_id":"be67857c-2a1e-49bd-808a-935bd98a4d1a","resolution":{"observed_at":"2026-08-01T11:06:14.436692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.443751Z","title":"One-shot visual imitation via attributed waypoints and demonstration augmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.443751Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:edf7230e127e509891a20aa368ab2546cfbcfd8db6479f5f42e881101974803a","observation_id":"12435650-b02d-4012-bee6-23c93cb7b850","resolution":{"observed_at":"2026-08-01T11:06:14.443751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.446310Z","title":"Igniting vlms toward the embodied space.arXiv preprint arXiv:2509.11766, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.446310Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:3d898cc5cfe1e3293041eb904a444a6d7a25472174012539044bc05d384b1005","observation_id":"027ea5b4-0fbb-4fbd-bfc5-ced8b2edf762","resolution":{"observed_at":"2026-08-01T11:06:14.446310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.16666","last_updated":"2026-03-23T05:41:14Z","snapshot_observed_at":"2026-07-06T22:49:23.750692Z","submitted_at":"2026-03-17T15:33:43Z","title":"Fast-WAM: Do World Action Models Need Test-time Future Imagination?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.16666","snapshot_observed_at":"2026-08-01T11:06:14.449461Z","title":"Fast-wam: Do world action models need test-time future imagination?arXiv preprint arXiv:2603.16666, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.449461Z"},"links":{"cited_paper":"/paper/2603.16666","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:1b3a230ec4314e2bc09c88f90d8e46eeb6972bfd184fb097f1abc447421a8cc1","observation_id":"ffa0874f-a180-4039-a09f-10a890c3a654","resolution":{"observed_at":"2026-08-01T11:06:14.449461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.453040Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.453040Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:0d990b7197ef1c30e3da16342ca05c1b0ffa933dec5ad14472078f56b5655a58","observation_id":"51a79043-76a0-40aa-87ae-8ca72bf81b8e","resolution":{"observed_at":"2026-08-01T11:06:14.453040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.456412Z","title":"Tenenbaum, and Alberto Rodriguez","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.456412Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:4375b3bcb801ef6e42a4651a8dcf1574e2202be3e7571b0e7e4540ee17978157","observation_id":"18a546c5-4863-4443-b270-8509f0e6d75c","resolution":{"observed_at":"2026-08-01T11:06:14.456412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.461680Z","title":"Representation learning via global temporal alignment and cycle-consistency","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.461680Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:51a08700cee411ebc244c6937f3206e171a0a9c326b399218736a7db8d33fa47","observation_id":"28a84e25-d66a-41f3-9f52-84fc45183b83","resolution":{"observed_at":"2026-08-01T11:06:14.461680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.464919Z","title":"Temporal cycle- consistency learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.464919Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:1402c4763a531eded3192151990457b2015b88529ddfb2730e308a022fcb3aa0","observation_id":"5d8f974d-26c1-411b-884b-e7c22281e876","resolution":{"observed_at":"2026-08-01T11:06:14.464919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-01T11:06:14.467761Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.467761Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:c583119e3e4d5a649d78dc8530c276317cc06008c88f2c33c2e3503d10dcf4e0","observation_id":"a9f95ce4-39e2-4777-9c47-c9c98dc35ef3","resolution":{"observed_at":"2026-08-01T11:06:14.467761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-01T11:06:14.471220Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.471220Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:998f4996f2184113c3b90c9d610653983388cccb199a9cb46913d4d7d77f0746","observation_id":"1040c184-6f17-47fb-8826-4d2ca6522d32","resolution":{"observed_at":"2026-08-01T11:06:14.471220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.474142Z","title":"Mixture-of-transformers: A sparse and scalable architecture for multi-modal foundation models.Transactions on Machine Learning Research, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.474142Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:1890b5539222f3d4cda6249dd7d2b9cc807c013322ec09773e7dfd3ce105e0dc","observation_id":"0a175204-78dc-43cf-b59f-16cfa9c37749","resolution":{"observed_at":"2026-08-01T11:06:14.474142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.476838Z","title":"Unimax: Fairer and more effective language sampling for large-scale multilingual pretraining","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.476838Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:ed5b99b5eadd118bbf6d5247c221913b8f1b1dd0445c54976cfe4aee04cedde1","observation_id":"b9ccac01-c547-4ab2-b503-b9602fdd504d","resolution":{"observed_at":"2026-08-01T11:06:14.476838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.479147Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.479147Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:442a6cbec0cc099af20b073c336e332a5ec542310ca2fcbb7eeec90c1cbba129","observation_id":"b0eb4d62-8857-46f8-809c-9028f505536d","resolution":{"observed_at":"2026-08-01T11:06:14.479147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.481539Z","title":"A survey of robot learning from demonstra- tion.Robotics and Autonomous Systems, 57(5):469–483, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.481539Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:b8d72728e33cf6fd4a4057132f72f5efa995e23a78608dbbdf4a57577c6dc57e","observation_id":"700b5210-90ee-4047-854c-bb9053c7b8b1","resolution":{"observed_at":"2026-08-01T11:06:14.481539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.484658Z","title":"Recent advances in robot learning from demonstration.Annual Review of Control, Robotics, and Autonomous Systems, 3:297–330, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.484658Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:006391f5cc94a318d71890456cc8d6dfcbbb6ee3b5306841a65e77aba94a8108","observation_id":"df315fcf-07ea-4aab-91b6-32ec55bb714e","resolution":{"observed_at":"2026-08-01T11:06:14.484658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.487448Z","title":"Deep imitation learning for complex manipulation tasks from virtual reality teleoperation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.487448Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:d880ac1e78cfcace55464a85698b230080f45ad63bd790d3a5cbdb05e6f01604","observation_id":"74048569-48a6-4c74-b4d4-7545e985a833","resolution":{"observed_at":"2026-08-01T11:06:14.487448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.490077Z","title":"White, De Ru Tsai, Richard Jaepyeong Cha, Jeffrey Jopling, Chelsea Finn, and Axel Krieger","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.490077Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:2291efab6117930f0c3671ae28fefa976aeb1ed1c5c1cee6e3e3201f3d43c668","observation_id":"d0b8816f-c6c3-4570-b9ea-8996e34313de","resolution":{"observed_at":"2026-08-01T11:06:14.490077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.492719Z","title":"Pomerleau","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.492719Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:c48aa59656408f889bf107e62dbe80426a7cd83dd6a5668f9f69c63c38a1d70f","observation_id":"6b61211b-101d-4eea-8335-7ab704e100ff","resolution":{"observed_at":"2026-08-01T11:06:14.492719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.495603Z","title":"DexMV: Imitation learning for dexterous manipulation from human videos","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.495603Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:7677eb8b5c22e37585878390e221e9fb27c14a22a2f1a90c64fcc7828da64a8c","observation_id":"afa1f508-d928-4466-b0f2-d76c2faf8b7d","resolution":{"observed_at":"2026-08-01T11:06:14.495603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.498568Z","title":"DexCap: Scalable and portable mocap data collection system for dexterous manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.498568Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:de1a400b8e4b58ce608bbe05009e7481ed527fe70c877c7b9134201890b300ef","observation_id":"c7f7a8c9-ec0e-48c9-86bc-532764a32fc2","resolution":{"observed_at":"2026-08-01T11:06:14.498568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.501559Z","title":"Time- contrastive networks: Self-supervised learning from video","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.501559Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:cef7be8fb12103165080455ede4c3c74d7409d8a65975860d6c4f34f93d3822c","observation_id":"afb8bc1c-e540-4cb2-94c9-7951c2fd3680","resolution":{"observed_at":"2026-08-01T11:06:14.501559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.504183Z","title":"XIRL: Cross-embodiment inverse reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.504183Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:576ae611ce690c02fb5d43587222ba8bcb0a0c98c18cb6412bea63f4a516feec","observation_id":"d4c9585e-5891-4164-8631-1553896065e1","resolution":{"observed_at":"2026-08-01T11:06:14.504183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.506493Z","title":"Learning latent plans from play","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.506493Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:ce009d347ceb3102adbc7d8a3f9d99cf3ebfbdecff8892bad7841c5774e72c12","observation_id":"1e33ef4b-0629-4aa6-85b2-fcd1cd9099d5","resolution":{"observed_at":"2026-08-01T11:06:14.506493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.509891Z","title":"WHIRL: Human-to-robot imitation in the wild","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.509891Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:c9b96b9058f0ea907a572a120db2bff30beea9c9de038086895f659338087f2c","observation_id":"c3c9599d-7029-4486-af54-3c27bdab6c95","resolution":{"observed_at":"2026-08-01T11:06:14.509891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.512810Z","title":"MimicPlay: Long-horizon imitation learning by watching human play","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.512810Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:8054db254878fc6e3991e7d50dac8e18ff8a7edc3a4c6b8454448d87f3f78b96","observation_id":"112d697a-e618-4412-b1e1-f0b5d9fc2ce6","resolution":{"observed_at":"2026-08-01T11:06:14.512810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.516026Z","title":"EgoScale: Scaling dexterous manipulation with diverse egocentric human data.arXiv preprint arXiv:2602.16710, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.516026Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:654974c0892a06f033bf65882312937b031595ce2f08b98e6ae4b4e377b106db","observation_id":"24973500-e395-4d93-b909-25f2071fbfdf","resolution":{"observed_at":"2026-08-01T11:06:14.516026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.518497Z","title":"Graphmimic: Graph-to-graphs generative modeling from videos for policy learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.518497Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:748e1f8b30e3b2fb0284ca0a42d1ef5fae2768d14211a23e5f605996f3730b34","observation_id":"390b829b-ebf7-4843-af10-4e5c45e3306d","resolution":{"observed_at":"2026-08-01T11:06:14.518497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.520960Z","title":"Learning from videos through graph-to-graphs generative modeling for robotic manipulation.IEEE Transactions on Robotics, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.520960Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:2c120fe82c88c92840dac76873d9f60e7bdc7273081787472e72aa2b2dce5322","observation_id":"99768708-1335-45ec-81e5-27d75e9e9cc0","resolution":{"observed_at":"2026-08-01T11:06:14.520960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.523405Z","title":"Unifying latent action and latent state pre-training for policy learning from videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.523405Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:d52a30717d2c7f7d35b3f697e3879b4ef1f204877fcc0e875db545b7a79629e1","observation_id":"3e7e31b8-880f-4587-915b-20ba7637b14e","resolution":{"observed_at":"2026-08-01T11:06:14.523405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/02783649251390579","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"What foundation models can bring for robot learning in manipulation: A survey.The International Journal of Robotics Research, 45(7):1091–1142, 2026","venue":"The International Journal of Robotics Research","work_id":"ddda60ee-fb43-4696-8aa2-35174d72ccb2","year":2026},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.526382Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:d24a615913c2a54ebb5217649ccf091d6a6499b3e3b13268ba17363809d622a1","observation_id":"781cb97d-4995-4ee7-87a4-b320d779f16d","resolution":{"observed_at":"2026-08-01T11:08:33.882244Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.529125Z","title":"A generalist agent.Transactions on Machine Learning Research, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.529125Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:1aa7fbc43052734dd46cbd52314d1c128cda9ce64d1b55285ceafeaa3f46447e","observation_id":"77ab2abc-3199-4f29-bcdb-d2c98badd9c5","resolution":{"observed_at":"2026-08-01T11:06:14.529125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-01T11:06:14.531917Z","title":"OpenVLA: An open-source vision-language-action model.arXiv preprint arXiv:2406.09246, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.531917Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:568f48dd0c579df4c3906e0fed1c70ab7e82dc7e0d9c53487474617d067fb8d8","observation_id":"fb0d1a1d-cf45-4f9b-8a78-edb8201e8529","resolution":{"observed_at":"2026-08-01T11:06:14.531917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-08-01T11:06:14.535159Z","title":"RDT-1B: A diffusion foundation model for bimanual manipulation.arXiv preprint arXiv:2410.07864, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.535159Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:84b7980410c17eb80a8eae520dbcdf75d6206b4ab774ce90da612956d39791d6","observation_id":"ff948d1e-560f-4c63-bf25-c83dfafa71aa","resolution":{"observed_at":"2026-08-01T11:06:14.535159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-01T11:06:14.538632Z","title":"GR00T N1: An open foundation model for generalist humanoid robots.arXiv preprint arXiv:2503.14734, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.538632Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:9d1e8279dd8f620df89be0b6afcaed0eb408dbe070f37afd70ae5e15fb56f018","observation_id":"87767916-e1b5-43c8-b83d-3dabcddad686","resolution":{"observed_at":"2026-08-01T11:06:14.538632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.541377Z","title":"DexVLA: Vision-language model with plug-in diffusion expert for general robot control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.541377Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:f9ad50b8e996f9022d7ead18c73044004fb0284bf5e1f9b5f96d1c67dbb28059","observation_id":"134f733d-6053-4413-a13e-de46d76da460","resolution":{"observed_at":"2026-08-01T11:06:14.541377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-01T11:06:14.544302Z","title":"World models.arXiv preprint arXiv:1803.10122, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.544302Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:9f505ebd89af1f57f2734348e121c97ec145636c3612c911650634c6d65752b9","observation_id":"619e6b1c-7c13-4b27-a510-5be54472b18e","resolution":{"observed_at":"2026-08-01T11:06:14.544302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.547616Z","title":"Christensen, Hao Su, Jiajun Wu, and Yunzhu Li","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.547616Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:b47d80687af1174cb6a67f93d4b1187ed8cd3942764704c07c67ff55c857be30","observation_id":"fd73ad17-0a27-4b2e-a7b0-53b3cbdbfd26","resolution":{"observed_at":"2026-08-01T11:06:14.547616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.550447Z","title":"Dream to control: Learning behaviors by latent imagination","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.550447Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:e6e131f1ea714e9a61e9906ec2f462efcbbde1361d51cf596bd65c0ff5c3954e","observation_id":"8e5a81c2-8280-457f-955a-7f23b50b82d3","resolution":{"observed_at":"2026-08-01T11:06:14.550447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.552879Z","title":"Mastering atari with discrete world models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.552879Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:7262db1ee6d00d270a821f6399bb55f335b151af084cf5ab769684ad009da3c0","observation_id":"c0ffaba8-ea49-494c-b52a-8cfd9ed2b18a","resolution":{"observed_at":"2026-08-01T11:06:14.552879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-01T11:06:14.555885Z","title":"Mastering diverse control tasks through world models.Nature, 640:647–653, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.555885Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:47fef3d87d76f8e2d389023d8829841ca872765c70d589bdc1201686adda298f","observation_id":"e6306f43-0308-4587-98d6-6ca8181dbcdd","resolution":{"observed_at":"2026-08-01T11:06:14.555885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.559114Z","title":"Transformers are sample-efficient world models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.559114Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:e991de6939185c2dc71407e15da31a70c7d774149bee855a0c77d42f9cadf21d","observation_id":"3c9e6c71-f3cd-4e93-9efd-501502b663c8","resolution":{"observed_at":"2026-08-01T11:06:14.559114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.561523Z","title":"Learning latent dynamics for planning from pixels","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.561523Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:a390c0d625fae3d9796f74fe97986384ee9ba29af8ffd0e5dd760ee9a6f923bb","observation_id":"a5d7df0e-f679-468d-bf9c-ef9570296d81","resolution":{"observed_at":"2026-08-01T11:06:14.561523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.563950Z","title":"TD-MPC2: Scalable, robust world models for continuous control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.563950Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:85d7271bdbab9b1ec04cc3501b2124f2c38418adb823d6b2af1a212842eefe9e","observation_id":"110f68f1-0386-462c-af46-bf45e0b98119","resolution":{"observed_at":"2026-08-01T11:06:14.563950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.566431Z","title":"Learning universal policies via text-guided video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.566431Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:ed7d95a30f6824ac304fbe7ebf02a8167ddb35e6c9d06c7be831ed2ec548a52e","observation_id":"94f8e605-cca3-4b60-9c1d-4c98d62d3452","resolution":{"observed_at":"2026-08-01T11:06:14.566431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10639","last_updated":"2023-10-16T17:57:23Z","snapshot_observed_at":"2026-08-08T13:35:58.479807Z","submitted_at":"2023-10-16T17:57:23Z","title":"Zero-Shot Robotic Manipulation with Pretrained Image-Editing Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10639","snapshot_observed_at":"2026-08-01T11:06:14.568905Z","title":"Zero-shot robotic manipulation with pre-trained image-editing diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.568905Z"},"links":{"cited_paper":"/paper/2310.10639","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:1a506b8b0a1f0ac88a7c5fe6fbcbb29b31c4198c74d3245e2502b9bfaf3a66bc","observation_id":"b7e1df17-e044-4bd8-9a1c-23d5f8d9bc26","resolution":{"observed_at":"2026-08-01T11:06:14.568905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16283","last_updated":"2024-09-24T17:57:33Z","snapshot_observed_at":"2026-07-06T19:21:20.826877Z","submitted_at":"2024-09-24T17:57:33Z","title":"Gen2Act: Human Video Generation in Novel Scenarios enables Generalizable Robot Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16283","snapshot_observed_at":"2026-08-01T11:06:14.571661Z","title":"Gen2Act: Human video generation in novel scenarios enables generalizable robot manipulation.arXiv preprint arXiv:2409.16283, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.571661Z"},"links":{"cited_paper":"/paper/2409.16283","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:97a97aba0b1a0847566055e49a5487ae4a9d895e19866d12019f33f14cb4cfd6","observation_id":"edce3f62-877b-42f1-9843-747fa3f95dd1","resolution":{"observed_at":"2026-08-01T11:06:14.571661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.574317Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.574317Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:9d8300f480e98e3994ee8a93995c3713a6b4ec2cf0f524e0c4026645113ebf8b","observation_id":"1e470cd9-3bc3-4d45-aa8f-b3fe29a3c7d6","resolution":{"observed_at":"2026-08-01T11:06:14.574317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.15607/rss.2023.xix.012","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Structured world models from human videos","venue":null,"work_id":"3f0de438-c3d2-42a0-b240-aa6fa946564e","year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.579985Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:774cd7f32c309f1d800241790af79ec4e9f6cbe992f5eb769682d44d22f3fa99","observation_id":"7d410c0f-bfb4-44a8-93d0-6e17055a09c0","resolution":{"observed_at":"2026-08-01T11:08:33.664597Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06114","last_updated":"2024-09-26T17:14:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-09T19:42:22Z","title":"Learning Interactive Real-World Simulators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06114","snapshot_observed_at":"2026-08-01T11:06:14.582467Z","title":"UniSim: Learning interactive real-world simulators.arXiv preprint arXiv:2310.06114, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.582467Z"},"links":{"cited_paper":"/paper/2310.06114","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:8b3fb3af79913a0e0a9832344c4dc4507b000675fa98b45f7567e3522550dfc4","observation_id":"de6fb3e7-8aa7-4af0-8004-88e5f269a0a8","resolution":{"observed_at":"2026-08-01T11:06:14.582467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13139","last_updated":"2023-12-21T05:34:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-20T16:00:43Z","title":"Unleashing Large-Scale Video Generative Pre-training for Visual Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13139","snapshot_observed_at":"2026-08-01T11:06:14.586156Z","title":"Unleashing large-scale video generative pre-training for visual robot manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.586156Z"},"links":{"cited_paper":"/paper/2312.13139","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:171754e3c5c434cf0602e3f1846c16cfc59dc2094850981eb8c6804411a65194","observation_id":"4e04411a-ef19-461f-ac1c-3c2cca0e8351","resolution":{"observed_at":"2026-08-01T11:06:14.586156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06158","last_updated":"2024-10-08T16:00:47Z","snapshot_observed_at":"2026-08-03T02:22:13.984027Z","submitted_at":"2024-10-08T16:00:47Z","title":"GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06158","snapshot_observed_at":"2026-08-01T11:06:14.589412Z","title":"GR-2: A generative video-language-action model with web-scale knowledge for robot manipulation.arXiv preprint arXiv:2410.06158, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.589412Z"},"links":{"cited_paper":"/paper/2410.06158","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:170283c93dbf0edfdd8efc4366bad0a9faca7c1e8f999b341e304509b1d12722","observation_id":"94374568-be18-4fe0-971c-db4add5251ee","resolution":{"observed_at":"2026-08-01T11:06:14.589412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21998","last_updated":"2026-03-22T15:37:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T17:07:43Z","title":"Causal World Modeling for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21998","snapshot_observed_at":"2026-08-01T11:06:14.592112Z","title":"Causal world modeling for robot control.arXiv preprint arXiv:2601.21998, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.592112Z"},"links":{"cited_paper":"/paper/2601.21998","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:a8db51fc2acb9dcae42420ae2210aaf71d4c59dc8540c2eb3ff160414d3a8c34","observation_id":"44cb6556-8c36-4438-a42e-1088cef68574","resolution":{"observed_at":"2026-08-01T11:06:14.592112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.16163","last_updated":"2026-01-22T18:09:30Z","snapshot_observed_at":"2026-08-06T02:05:52.408905Z","submitted_at":"2026-01-22T18:09:30Z","title":"Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.16163","snapshot_observed_at":"2026-08-01T11:06:14.594721Z","title":"Cosmos Policy: Fine-tuning video models for visuomotor control and planning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.594721Z"},"links":{"cited_paper":"/paper/2601.16163","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:a30433fc5943725663b10aaf98af299d45d642e6c9215b9f514830daf970ba16","observation_id":"f8598fce-4266-4f2a-bd57-b6f6e29e4015","resolution":{"observed_at":"2026-08-01T11:06:14.594721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.01955","last_updated":"2026-06-01T09:14:51Z","snapshot_observed_at":"2026-08-03T02:17:56.167011Z","submitted_at":"2026-06-01T09:14:51Z","title":"WALL-WM: Carving World Action Modeling at the Event Joints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.01955","snapshot_observed_at":"2026-08-01T11:06:14.597777Z","title":"Wall-wm: Carving world action modeling at the event joints.arXiv preprint arXiv:2606.01955, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.597777Z"},"links":{"cited_paper":"/paper/2606.01955","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:66bda17a9c8803ca2a594cb57f1e01964e5cc8e5a92e712d4258b71858d118ff","observation_id":"300f0d8f-28ff-4f79-a89a-bace91da2b0c","resolution":{"observed_at":"2026-08-01T11:06:14.597777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.600746Z","title":"Exploring the limits of vision-language-action manipulation in cross-task generalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.600746Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:c292efddf8f7dff384896af1ff269806c71174b23bd05bf81eb95dd418bb72ff","observation_id":"9f9b48b6-6be0-4948-a395-c3d4df44427f","resolution":{"observed_at":"2026-08-01T11:06:14.600746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.603451Z","title":"Fmimic: Foundation models are fine-grained action learners from human videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.603451Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:f2555720acf003eeb5865cf3f323426699a9e74dd489a014876dd89b3cca1b09","observation_id":"f685af6c-0fe3-46cd-821d-980c8586a807","resolution":{"observed_at":"2026-08-01T11:06:14.603451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.605970Z","title":"Vlmimic: Vision language models are visual imitation learner for fine-grained actions.Advances in Neural Information Processing Systems, 37:77860–77887, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.605970Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:44f940e5e1f1d2ab7069596633edda8fa1590b10008814aa16ba1ad99bece096","observation_id":"0cb56dfd-3f98-4525-a1aa-7f57f7ad67ec","resolution":{"observed_at":"2026-08-01T11:06:14.605970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.608524Z","title":"Coarse-to-fine imitation learning: Robot manipulation from a single demonstration","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.608524Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:78a7517f053206d61840a2162acb9e324aea5f7ac3fc86d25053642ffb18c23a","observation_id":"93578dbe-4970-45f0-978f-574bf0687ae0","resolution":{"observed_at":"2026-08-01T11:06:14.608524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.610879Z","title":"OKAMI: Teaching humanoid robots manipulation skills through single video imitation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.610879Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:ed35f45eaa9e1fb8e48c77040e8362ee01e666dbae9e5d7973078d71c0fded36","observation_id":"2ed0a1e3-c3ea-4c8f-96ed-ee567b0706e6","resolution":{"observed_at":"2026-08-01T11:06:14.610879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.613386Z","title":"Learning a thousand tasks in a day.Science Robotics, 10(108):eadv7594, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.613386Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:9f1d8b4eacf498c83f9b9c7207f94f759a51caf5369af35a9deee7bd4487922b","observation_id":"c3c9c71f-3c13-4ca7-9a08-079a55691218","resolution":{"observed_at":"2026-08-01T11:06:14.613386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18121","last_updated":"2024-09-26T17:57:16Z","snapshot_observed_at":"2026-08-06T09:13:33.968909Z","submitted_at":"2024-09-26T17:57:16Z","title":"Robot See Robot Do: Imitating Articulated Object Manipulation with Monocular 4D Reconstruction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18121","snapshot_observed_at":"2026-08-01T11:06:14.615802Z","title":"Robot see robot do: Imitating articulated object manipulation with monocular 4d reconstruction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.615802Z"},"links":{"cited_paper":"/paper/2409.18121","citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:524fa41e8327828574477ab47b89a314f470118bd24ed93f4c2b665df1b58b43","observation_id":"0ec193ab-17e1-466c-b07c-06420afd6ece","resolution":{"observed_at":"2026-08-01T11:06:14.615802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.619387Z","title":"Zero-shot visual imitation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.619387Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:18e63d8ab30bb8f3d04585f37b4038af1f2f9495bf6b4ca970a2689d8b572716","observation_id":"04e4e0ce-0a87-4c93-be22-07bf401752a7","resolution":{"observed_at":"2026-08-01T11:06:14.619387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:06:14.622405Z","title":"Transformers for one-shot visual imitation","venue":null,"work_id":null,"year":2071},"citing_paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-01T11:06:14.622405Z"},"links":{"citing_paper":"/paper/2607.20033"},"observation_digest":"sha256:cc614c278aa044c9fc1e99f6c1fb1f2374b8184d5e417ba01723a8b564dfbaf6","observation_id":"e9d33f21-11f0-477a-a702-ebbe027d99f7","resolution":{"observed_at":"2026-08-01T11:06:14.622405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20033","last_updated":"2026-07-27T11:34:54Z","latest_version":3,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-04T04:24:48.840920Z","submitted_at":"2026-07-22T11:20:05Z","title":"Robots Acquire Manipulation Skills in Seconds from a Single Human Video"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":95,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":117},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 117 outbound references and 0 inbound Pith citation observations for arXiv:2607.20033."}