{"as_of":"2026-08-07T15:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:95bc4b463060df3814660e5d4281171198fbad02a2c509764d95cf4b4f04f67d","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:51:36.127656Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T06:48:14.554799Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T22:16:36.335996Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2511.04671","last_updated":"2026-04-15T03:42:52Z","snapshot_observed_at":"2026-08-01T04:13:43.111071Z","submitted_at":"2025-11-06T18:56:30Z","title":"X-Diffusion: Training Diffusion Policies on Cross-Embodiment Human Demonstrations","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-18T00:37:12.170711Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2511.04671"},"observation_digest":"sha256:ce778fdb57579f1bed06433a83fcdd5238d7ef36c85d9408410766dc308e25b9","observation_id":"08184c78-6d50-4ee1-bff1-766e366bb783","resolution":{"observed_at":"2026-05-18T00:40:33.752011Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2604.20348","last_updated":"2026-06-10T16:25:38Z","snapshot_observed_at":"2026-08-07T00:32:25.170573Z","submitted_at":"2026-04-22T08:51:07Z","title":"Bimanual Robot Manipulation via Multi-Agent In-Context Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T00:25:24.362191Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2604.20348"},"observation_digest":"sha256:f9332d8bfb80b1f88527a721fcadd1b37f65f44a675c7db6989cf4c4d2e91952","observation_id":"64b637e1-d756-4dcc-8b3d-8a34a03298fa","resolution":{"observed_at":"2026-05-10T00:29:47.506260Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2605.24934","last_updated":"2026-05-28T10:10:45Z","snapshot_observed_at":"2026-07-06T23:34:57.148983Z","submitted_at":"2026-05-24T08:26:41Z","title":"HumanEgo: Zero-Shot Robot Learning from Minutes of Human Egocentric Videos","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-30T01:02:58.035784Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2605.24934"},"observation_digest":"sha256:5a159e736881b5f76e0ff6118196558de6ee4ba9c1309e9700cdb0cdfbd3dea7","observation_id":"f1cd0c19-d6c0-4d0f-92a5-81be84f8848f","resolution":{"observed_at":"2026-07-01T15:45:48.712142Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2606.05952","last_updated":"2026-06-04T09:51:57Z","snapshot_observed_at":"2026-08-07T07:35:44.170638Z","submitted_at":"2026-06-04T09:51:57Z","title":"Learning of Robot Safety Policies via Adversarial Synthetic Scenarios","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T01:12:25.956015Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2606.05952"},"observation_digest":"sha256:109f24a21b2a038883e13f50d84a7ae587d6b40a87f19174835db92d7c6e84d9","observation_id":"46752ed2-8080-476f-9419-73bd2bdba9ab","resolution":{"observed_at":"2026-07-02T13:36:58.971265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2606.26025","last_updated":"2026-07-03T15:34:07Z","snapshot_observed_at":"2026-07-12T12:05:57.041170Z","submitted_at":"2026-06-24T16:53:36Z","title":"In-Context World Modeling for Robotic Control","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-25T19:12:22.513577Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2606.26025"},"observation_digest":"sha256:e8b4e34c65a21213108aae11c97923ff2ee24c1902e5b0add8e3081732ef5b17","observation_id":"9afd20f5-db4e-4edf-9feb-0023509c07bc","resolution":{"observed_at":"2026-07-04T21:00:09.579213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2606.26025","last_updated":"2026-07-03T15:34:07Z","snapshot_observed_at":"2026-07-12T12:05:57.041170Z","submitted_at":"2026-06-24T16:53:36Z","title":"In-Context World Modeling for Robotic Control","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T05:11:07.089829Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2606.26025"},"observation_digest":"sha256:5f33ab6b9b82c35dec17c2720ebc499b40b491062f542f5796cbd30b00e3b75f","observation_id":"9da99683-5dd7-469a-8365-3812b0941822","resolution":{"observed_at":"2026-07-04T13:29:51.621126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-12T12:05:57.682386Z","title":"Mimicdroid: In-context learning for humanoid robot manipulation from human play videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26025","last_updated":"2026-07-03T15:34:07Z","snapshot_observed_at":"2026-07-12T12:05:57.041170Z","submitted_at":"2026-06-24T16:53:36Z","title":"In-Context World Modeling for Robotic Control","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T12:05:57.682386Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2606.26025"},"observation_digest":"sha256:5561232b5aed76a9be84e534039019655709db310e85599e134e3a017c7411f6","observation_id":"10c874f3-da37-429e-a71c-642627d80fd2","resolution":{"observed_at":"2026-07-12T12:05:57.682386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":"2509.09769","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-09T22:16:36.335996Z","title":"Mimicdroid: In-context learning for humanoid manipulation from human play videos","venue":"cs.RO","work_id":"4c061ffd-6240-435f-9a55-7687242781ad","year":2025},"citing_paper":{"arxiv_id":"2607.06988","last_updated":"2026-07-10T02:22:52Z","snapshot_observed_at":"2026-07-31T14:59:13.878426Z","submitted_at":"2026-07-08T04:23:22Z","title":"WAM-TTT: Steering World-Action Models by Watching Human Play at Test Time","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-09T22:16:31.529359Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2607.06988"},"observation_digest":"sha256:a6eab8ca10d7dfb811c8d2f06054153128ead4a61aeb8ee353042ba728a93787","observation_id":"9f163656-9cde-4d67-a8db-f05d86f1c0ee","resolution":{"observed_at":"2026-07-09T22:16:36.338374Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09769","snapshot_observed_at":"2026-07-13T06:48:14.554799Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.06988","last_updated":"2026-07-10T02:22:52Z","snapshot_observed_at":"2026-07-31T14:59:13.878426Z","submitted_at":"2026-07-08T04:23:22Z","title":"WAM-TTT: Steering World-Action Models by Watching Human Play at Test Time","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T06:48:14.554799Z"},"links":{"cited_paper":"/paper/2509.09769","citing_paper":"/paper/2607.06988"},"observation_digest":"sha256:18938ceda713700c372e6ead4cd5e149453e36c8313dffef045e53cd16e09100","observation_id":"bca86fbd-c713-43c5-b318-7bf3c3740363","resolution":{"observed_at":"2026-07-13T06:48:14.554799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.09769/citation-record","integrity":"/paper/2509.09769/integrity","json":"/paper/2509.09769/citation-record.json","paper":"/paper/2509.09769"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:35.979246Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.979246Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:4c9a451d12748b879124a87f7fd207430355b2f4352e03a7f8772c0af7a6e33a","observation_id":"49b4c5c5-1134-42d7-890b-13f411560d03","resolution":{"observed_at":"2026-08-04T18:51:35.979246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.01557","last_updated":"2018-02-05T18:36:19Z","snapshot_observed_at":"2026-07-06T06:21:49.379500Z","submitted_at":"2018-02-05T18:36:19Z","title":"One-Shot Imitation from Observing Humans via Domain-Adaptive Meta-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.01557","snapshot_observed_at":"2026-08-04T18:51:35.982472Z","title":"One-shot imitation from observing humans via domain-adaptive meta-learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.982472Z"},"links":{"cited_paper":"/paper/1802.01557","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:0c6e87c29cb05e6e14dc6632571bd60f444e41359f7ecbaa19130611016ff44a","observation_id":"8bcd6db7-8ff7-4cde-a333-c674cf4f8a72","resolution":{"observed_at":"2026-08-04T18:51:35.982472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:35.986558Z","title":"Task-embedded control networks for few-shot imitation learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.986558Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:3c1bfcc704406d63692a2004da6c79bf9a85666c38fef61c18170ba0bb8468fd","observation_id":"f5075199-53e9-4f50-bbbc-2fd451b1e0c7","resolution":{"observed_at":"2026-08-04T18:51:35.986558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:35.989663Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.989663Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:971627713e0fc9330d53daab90d295a9874fd01fb95dd0661d61e26a34836f3a","observation_id":"4e79cee5-c384-42e8-8fa6-e3c52dea7609","resolution":{"observed_at":"2026-08-04T18:51:35.989663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:35.992047Z","title":"Flamingo: A visual language model for few- shot learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.992047Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:9e8b61b809499be3dc154cb4eb064b57fd7d703a41659c9d5b53ba69df4fe546","observation_id":"b0233dc6-c36b-4f2d-b522-0825b6b43474","resolution":{"observed_at":"2026-08-04T18:51:35.992047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:35.995043Z","title":"Prompting decision transformer for few-shot pol- icy generalization,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.995043Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:bfe732cd3351ab33878e45d8e972bbdad05fd0f67c3dae1a42b7793d4901d014","observation_id":"724a961b-56b2-4e88-b090-13a0d7358b64","resolution":{"observed_at":"2026-08-04T18:51:35.995043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09971","last_updated":"2024-02-01T00:42:31Z","snapshot_observed_at":"2026-08-04T03:14:08.494198Z","submitted_at":"2023-10-15T22:20:39Z","title":"AMAGO: Scalable In-Context Reinforcement Learning for Adaptive Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09971","snapshot_observed_at":"2026-08-04T18:51:35.998019Z","title":"Amago: Scalable in-context reinforcement learning for adaptive agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:35.998019Z"},"links":{"cited_paper":"/paper/2310.09971","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:9152e5c2bf1f9ee9c728ba9ffc0a88e539f7e855316d9171a448f632cf838b54","observation_id":"c0b02a88-c2be-414f-b846-d0f8fbb38d4f","resolution":{"observed_at":"2026-08-04T18:51:35.998019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14215","last_updated":"2022-10-25T17:57:49Z","snapshot_observed_at":"2026-07-06T14:10:20.983444Z","submitted_at":"2022-10-25T17:57:49Z","title":"In-context Reinforcement Learning with Algorithm Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14215","snapshot_observed_at":"2026-08-04T18:51:36.001004Z","title":"In-context reinforcement learning with algo- rithm distillation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.001004Z"},"links":{"cited_paper":"/paper/2210.14215","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:058a1220830ac5e2274ef766f99b7341f983940fc9de5670516a77246f3d38e0","observation_id":"49b1f0ed-07a2-448f-97d6-684f2da3d7d8","resolution":{"observed_at":"2026-08-04T18:51:36.001004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04759","last_updated":"2025-02-24T16:06:51Z","snapshot_observed_at":"2026-07-06T20:02:35.216265Z","submitted_at":"2024-12-06T03:54:55Z","title":"REGENT: A Retrieval-Augmented Generalist Agent That Can Act In-Context in New Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04759","snapshot_observed_at":"2026-08-04T18:51:36.003802Z","title":"Regent: A retrieval-augmented generalist agent that can act in-context in new environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.003802Z"},"links":{"cited_paper":"/paper/2412.04759","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:efa0f414ac625c55615adc634309204b87f5064062b04c5c6c1f02b657339c25","observation_id":"d217f832-5e6c-455a-b125-f53f81695552","resolution":{"observed_at":"2026-08-04T18:51:36.003802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19578","last_updated":"2024-10-17T19:31:39Z","snapshot_observed_at":"2026-07-06T17:52:38.371963Z","submitted_at":"2024-03-28T17:04:00Z","title":"Keypoint Action Tokens Enable In-Context Imitation Learning in Robotics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19578","snapshot_observed_at":"2026-08-04T18:51:36.007414Z","title":"Keypoint action tokens enable in-context imitation learning in robotics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.007414Z"},"links":{"cited_paper":"/paper/2403.19578","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:67e1d362f40806d2630c3b14685f63f9aef44499c124d1ee28ba7d819832d364","observation_id":"d1f3c36e-f9f0-42d6-9f23-d465ce58dc57","resolution":{"observed_at":"2026-08-04T18:51:36.007414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15980","last_updated":"2024-09-27T20:10:08Z","snapshot_observed_at":"2026-07-06T19:07:16.252072Z","submitted_at":"2024-08-28T17:50:19Z","title":"In-Context Imitation Learning via Next-Token Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15980","snapshot_observed_at":"2026-08-04T18:51:36.010783Z","title":"In-context imitation learning via next-token pre- diction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.010783Z"},"links":{"cited_paper":"/paper/2408.15980","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:c7a2d7e7493b5c64e12e1b4b9752ed6b4e0c5c3c88e1d1aea52ef30fb1784963","observation_id":"e79e46de-9492-40d1-a858-2b00bc01fdc0","resolution":{"observed_at":"2026-08-04T18:51:36.010783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12633","last_updated":"2025-04-25T15:22:45Z","snapshot_observed_at":"2026-07-06T19:52:42.231424Z","submitted_at":"2024-11-19T16:45:52Z","title":"Instant Policy: In-Context Imitation Learning via Graph Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12633","snapshot_observed_at":"2026-08-04T18:51:36.013303Z","title":"Instant policy: In-context imitation learning via graph diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.013303Z"},"links":{"cited_paper":"/paper/2411.12633","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:e0c94e89174eb383ba7c819c92bdea02a077f3568a64cb93ba0b819bb35b49fc","observation_id":"bc756b72-5d4d-4090-afa6-a22a82fce9ce","resolution":{"observed_at":"2026-08-04T18:51:36.013303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03801","last_updated":"2023-12-06T15:19:28Z","snapshot_observed_at":"2026-08-02T14:22:22.861434Z","submitted_at":"2023-12-06T15:19:28Z","title":"Generalization to New Sequential Decision Making Tasks with In-Context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03801","snapshot_observed_at":"2026-08-04T18:51:36.016697Z","title":"Generalization to new sequential de- cision making tasks with in-context learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.016697Z"},"links":{"cited_paper":"/paper/2312.03801","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:2793ab8c2ed9fe8b7681fc6f31fef4ad80e8533424aa090b5c60646635b1c341","observation_id":"93d744c2-b19e-4a63-8727-6175ad7260bc","resolution":{"observed_at":"2026-08-04T18:51:36.016697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17234","last_updated":"2024-09-12T15:22:09Z","snapshot_observed_at":"2026-07-06T18:20:35.626876Z","submitted_at":"2024-05-27T14:50:42Z","title":"Benchmarking General-Purpose In-Context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17234","snapshot_observed_at":"2026-08-04T18:51:36.019940Z","title":"Benchmarking general-purpose in-context learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.019940Z"},"links":{"cited_paper":"/paper/2405.17234","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:19c6ea205e8f904ed068e64e7992b1ec5ca26807f91f9398caf74cff47d8c51f","observation_id":"54e1324d-dd74-4240-b012-5a1fbc21dcaf","resolution":{"observed_at":"2026-08-04T18:51:36.019940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04458","last_updated":"2024-01-09T13:38:35Z","snapshot_observed_at":"2026-07-06T14:28:25.630901Z","submitted_at":"2022-12-08T18:30:22Z","title":"General-Purpose In-Context Learning by Meta-Learning Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04458","snapshot_observed_at":"2026-08-04T18:51:36.022159Z","title":"General-purpose in-context learning by meta- learning transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.022159Z"},"links":{"cited_paper":"/paper/2212.04458","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:86cf0d52685f653724e6ce6f2205c87df637203645a7af0da7a22a1b153e9b57","observation_id":"b0fb77fe-8fd0-4cb2-b171-cc76dc4ea49f","resolution":{"observed_at":"2026-08-04T18:51:36.022159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02062","last_updated":"2025-08-04T05:01:11Z","snapshot_observed_at":"2026-08-07T05:43:24.420206Z","submitted_at":"2025-08-04T05:01:11Z","title":"RICL: Adding In-Context Adaptability to Pre-Trained Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02062","snapshot_observed_at":"2026-08-04T18:51:36.024764Z","title":"Ricl: Adding in-context adaptability to pre-trained vision-language-action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.024764Z"},"links":{"cited_paper":"/paper/2508.02062","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:681c82a2110a0b2acae598e108d10aae24dcc2daf99e7b97e4f420690ea14a01","observation_id":"6f9e3fb2-2f4b-4f51-8dde-23275b7f18c2","resolution":{"observed_at":"2026-08-04T18:51:36.024764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.027742Z","title":"Roboturk: A crowdsourcing platform for robotic skill learning through imitation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.027742Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:250f35f5699290369c868af32feab1d600533cb4b0ec39f29eb1f71f5800e70b","observation_id":"def31ae2-80fe-48f9-96b1-d8309a8ea97c","resolution":{"observed_at":"2026-08-04T18:51:36.027742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-04T18:51:36.029863Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.029863Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:92da115042510b013eb0236702c9a311b643197de93cfc7f82cc545e7e5e5503","observation_id":"07f99e7f-6d36-4972-b129-f6ba770ffeb3","resolution":{"observed_at":"2026-08-04T18:51:36.029863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.031973Z","title":"Droid: A large-scale in-the-wild robot manipulation dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.031973Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:75c2b73508886ab650e2c98eeb9344443bafdc71575cc0a2d49b384b320d0237","observation_id":"b74bd45c-f74f-4eaa-84d2-b3ffa5aaa2cd","resolution":{"observed_at":"2026-08-04T18:51:36.031973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12422","last_updated":"2023-10-13T05:44:37Z","snapshot_observed_at":"2026-08-06T12:55:15.512516Z","submitted_at":"2023-02-24T02:54:15Z","title":"MimicPlay: Long-Horizon Imitation Learning by Watching Human Play","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12422","snapshot_observed_at":"2026-08-04T18:51:36.033954Z","title":"Mimicplay: Long-horizon imitation learning by watching human play,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.033954Z"},"links":{"cited_paper":"/paper/2302.12422","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:ab4126647dd54a9f1bd6fa05ade5d4476557f6c0c83677a9725c2e3cbce30e58","observation_id":"8b1c8003-e080-485b-b741-df5d63ee743f","resolution":{"observed_at":"2026-08-04T18:51:36.033954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.037439Z","title":"Learning latent plans from play,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.037439Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:35e6b73a8378651f257958c8592c70c713f73d36e1fda1268d1443829397ce2b","observation_id":"37bb429d-0435-4457-96ac-f0202c3c5f22","resolution":{"observed_at":"2026-08-04T18:51:36.037439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15943","last_updated":"2022-05-03T10:36:39Z","snapshot_observed_at":"2026-07-06T12:03:35.232581Z","submitted_at":"2021-10-29T17:42:08Z","title":"MetaICL: Learning to Learn In Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.15943","snapshot_observed_at":"2026-08-04T18:51:36.039660Z","title":"Metaicl: Learning to learn in context,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.039660Z"},"links":{"cited_paper":"/paper/2110.15943","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:7316f2d6a5a1bf6593f0adf1087754a151f711c08ecc03411667160d26ce3da6","observation_id":"9bf8e2bb-386b-424e-8cd8-5854ade764b1","resolution":{"observed_at":"2026-08-04T18:51:36.039660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.042123Z","title":"Okami: Teaching humanoid robots manipulation skills through single video imitation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.042123Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:5f9432e4f2a565d11bc06840e095be04d67cae3d4ba0c540217694cd7462f9be","observation_id":"dd95dc28-dced-43dd-8a9d-070730f29998","resolution":{"observed_at":"2026-08-04T18:51:36.042123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.044696Z","title":"Humanoid policy˜ human policy,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.044696Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:ffa9ebb2a1c584719c4f917d930e20b71da64581d626db6f79ff54cb2a4558fc","observation_id":"8a51b61e-29aa-4413-aa4d-e71152c903c6","resolution":{"observed_at":"2026-08-04T18:51:36.044696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.046884Z","title":"Representation and control of the task space in humans and humanoid robots,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.046884Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:342f8f961930feb8da8ab3b09ef66a8943619a711369b282d52b676953b06719","observation_id":"509fba2d-f547-4d7d-a2b1-a95c9a41648b","resolution":{"observed_at":"2026-08-04T18:51:36.046884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.049590Z","title":"Masked autoencoders are scalable vision learners,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.049590Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:fa4dfe6e50f718b97346e458696b16099711cad8d9f648af79607d3ac68b8c6e","observation_id":"f88b31c8-61c2-44e0-8b32-f35e88c2554f","resolution":{"observed_at":"2026-08-04T18:51:36.049590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14391","last_updated":"2025-04-10T07:50:15Z","snapshot_observed_at":"2026-07-06T17:20:33.356092Z","submitted_at":"2024-01-25T18:49:57Z","title":"Rethinking Patch Dependence for Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14391","snapshot_observed_at":"2026-08-04T18:51:36.051840Z","title":"Rethinking patch dependence for masked autoen- coders,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.051840Z"},"links":{"cited_paper":"/paper/2401.14391","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:b3cd4cd7e1b540ef8b061828b52903134d346eb14c479c6b791ace5d5a91e2fe","observation_id":"3ec0d3bc-0cb9-44a5-ae09-2088c2739165","resolution":{"observed_at":"2026-08-04T18:51:36.051840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12943","last_updated":"2024-08-27T23:15:11Z","snapshot_observed_at":"2026-07-06T17:47:13.814205Z","submitted_at":"2024-03-19T17:47:37Z","title":"Vid2Robot: End-to-end Video-conditioned Policy Learning with Cross-Attention Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12943","snapshot_observed_at":"2026-08-04T18:51:36.054289Z","title":"Vid2robot: End-to-end video-conditioned pol- icy learning with cross-attention transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.054289Z"},"links":{"cited_paper":"/paper/2403.12943","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:f789818ca28d20a71a2b150eec3f0c9c310fc1fe40bb9540f6c664ded89e6176","observation_id":"10acbeeb-755b-47a5-817c-206621baabf8","resolution":{"observed_at":"2026-08-04T18:51:36.054289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02011","last_updated":"2023-02-03T21:39:52Z","snapshot_observed_at":"2026-07-06T14:48:14.652568Z","submitted_at":"2023-02-03T21:39:52Z","title":"Zero-Shot Robot Manipulation from Passive Human Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02011","snapshot_observed_at":"2026-08-04T18:51:36.056679Z","title":"Zero-shot robot manipulation from pas- sive human videos,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.056679Z"},"links":{"cited_paper":"/paper/2302.02011","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:4ef07530fc477e400eaa8782388ff3338a4069dd6552b6117fcee50b35fbdb63","observation_id":"40cd3cc1-a873-4d66-b080-b5d106956de5","resolution":{"observed_at":"2026-08-04T18:51:36.056679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.058929Z","title":"Hand me the data: Fast robot adaptation via hand path retrieval,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.058929Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:39c7c206ae5d1265b25964bb0a7a8a23b843cfe031a665feaee6b4cefadfb30f","observation_id":"b60583e3-30e0-459a-849a-ee1c62674b06","resolution":{"observed_at":"2026-08-04T18:51:36.058929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.060965Z","title":"Robocasa: Large-scale simulation of ev- eryday tasks for generalist robots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.060965Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:5467e6d9f3ccdf4f63e9ba619a52c76453ddab989fc82e8e1d0821a4430b46b7","observation_id":"918742f8-31b4-4d7f-ad6f-a71874cdc860","resolution":{"observed_at":"2026-08-04T18:51:36.060965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12293","last_updated":"2025-01-18T02:57:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-25T15:32:31Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12293","snapshot_observed_at":"2026-08-04T18:51:36.063023Z","title":"Robosuite: A modular simulation frame- work and benchmark for robot learning,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.063023Z"},"links":{"cited_paper":"/paper/2009.12293","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:8b8dd7ee68bad402c8702414d577f712c6ddf4eae958c48801e9474f6996ccc7","observation_id":"8ebeba5f-2ff0-44c0-b08a-a321f91e036d","resolution":{"observed_at":"2026-08-04T18:51:36.063023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.065798Z","title":"Evolutionary principles in self-referential learning,","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.065798Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:c67db2e28adeff383ed1ca5d72ee6d2c68ec6a0c8b811dfd2a9d8ee51586d87f","observation_id":"32148449-3222-4240-9882-2ea1883395bd","resolution":{"observed_at":"2026-08-04T18:51:36.065798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.068210Z","title":"Meta-neural networks that learn by learning,","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.068210Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:171340a20556fa6c97a2a4af026adac9340a76cefcac3592dd5430a347b55fd9","observation_id":"aee686bf-a4e2-4d51-80de-505bdfcf9e6b","resolution":{"observed_at":"2026-08-04T18:51:36.068210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.070278Z","title":"Meta-learning with memory-augmented neu- ral networks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.070278Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:68e560778ed49b8b36b9bc906b67173bd9be19d8d2ded36e16dccb47c4dd75b3","observation_id":"fa7d62ca-4592-4742-9683-69c6a161def8","resolution":{"observed_at":"2026-08-04T18:51:36.070278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.072563Z","title":"Learning to learn using gradient descent,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.072563Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:a519b099c3f8bafe16d933afa3466819dd71915c5c2356d89148ca1a4e8a7d20","observation_id":"02400fbd-9494-42c3-b527-6552e639eb97","resolution":{"observed_at":"2026-08-04T18:51:36.072563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.02779","last_updated":"2016-11-10T01:17:36Z","snapshot_observed_at":"2026-08-02T07:58:55.035919Z","submitted_at":"2016-11-09T00:13:29Z","title":"RL$^2$: Fast Reinforcement Learning via Slow Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.02779","snapshot_observed_at":"2026-08-04T18:51:36.074938Z","title":"Rl2: Fast reinforcement learning via slow reinforcement learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.074938Z"},"links":{"cited_paper":"/paper/1611.02779","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:5da6c771bad58420e46e9e0d58c3225657df87e1c800200dcef441a366e6176d","observation_id":"adc6d6fb-deb2-42c8-9d04-e7115d8d3350","resolution":{"observed_at":"2026-08-04T18:51:36.074938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.077854Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.077854Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:6be0628658657c387552d77c7f6b63f01d892606bd3e83c8dcc7def41f50b3f7","observation_id":"cdc1fc02-0533-4b80-9b16-a0a1c38eb02e","resolution":{"observed_at":"2026-08-04T18:51:36.077854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03380","last_updated":"2021-11-11T19:06:52Z","snapshot_observed_at":"2026-08-04T16:13:46.930282Z","submitted_at":"2021-07-07T17:59:07Z","title":"RRL: Resnet as representation for Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03380","snapshot_observed_at":"2026-08-04T18:51:36.079940Z","title":"Rrl: Resnet as representation for reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.079940Z"},"links":{"cited_paper":"/paper/2107.03380","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:50dcc30717e8c191358c35aef054b8d8ae0f03eef68140f20f1c454fb98afedd","observation_id":"dca32268-79bc-46cc-8be0-8ab31de29413","resolution":{"observed_at":"2026-08-04T18:51:36.079940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12601","last_updated":"2022-11-18T05:57:09Z","snapshot_observed_at":"2026-08-02T11:48:59.131827Z","submitted_at":"2022-03-23T17:55:09Z","title":"R3M: A Universal Visual Representation for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12601","snapshot_observed_at":"2026-08-04T18:51:36.082371Z","title":"R3m: A universal visual representation for robot manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.082371Z"},"links":{"cited_paper":"/paper/2203.12601","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:aec56f4f3fc9f8175986538cb2bd909101b9038805b51c7cf2cead1c16e394c6","observation_id":"c69ccdf7-8877-4ac6-ae8a-ee135e90f0c8","resolution":{"observed_at":"2026-08-04T18:51:36.082371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.085131Z","title":"Where are we in the search for an artificial visual cortex for embodied intelligence?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.085131Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:0bf608655ae4043efd613ee37f80c1ab07036087554098581d4b26ef1a7d750e","observation_id":"5d7d30ec-7118-44fe-994b-5689878dff2d","resolution":{"observed_at":"2026-08-04T18:51:36.085131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.087661Z","title":"Concept2robot: Learning manipulation concepts from instructions and human demonstrations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.087661Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:e09e2184e66bbbb84066cad610ae834051f750dcf91728318e6d5310578c2139","observation_id":"873910a3-fe4f-49e8-b716-9e1ff0868e50","resolution":{"observed_at":"2026-08-04T18:51:36.087661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.089935Z","title":"Liv: Language-image representations and rewards for robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.089935Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:f3472342708cb72e8903f3884ce5f52f5322d78b78e97e73d4cb70ca0ad164b2","observation_id":"c4a10568-dce8-441f-8e13-4eb6d82b2fa4","resolution":{"observed_at":"2026-08-04T18:51:36.089935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00030","last_updated":"2023-03-07T02:29:59Z","snapshot_observed_at":"2026-08-02T00:17:16.761436Z","submitted_at":"2022-09-30T18:14:07Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00030","snapshot_observed_at":"2026-08-04T18:51:36.092177Z","title":"Vip: Towards universal visual reward and representation via value-implicit pre-training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.092177Z"},"links":{"cited_paper":"/paper/2210.00030","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:da0f1f9ebdd38ad1340bb882a5b9e6e1f3e2051c6cc48e8fb35039a652ef3d39","observation_id":"bb877225-36ee-4d3a-a5ee-bbf5e02b9119","resolution":{"observed_at":"2026-08-04T18:51:36.092177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23289","last_updated":"2024-10-30T17:59:41Z","snapshot_observed_at":"2026-07-06T19:42:25.742756Z","submitted_at":"2024-10-30T17:59:41Z","title":"Bridging the Human to Robot Dexterity Gap through Object-Oriented Rewards","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23289","snapshot_observed_at":"2026-08-04T18:51:36.094634Z","title":"Bridging the human to robot dex- terity gap through object-oriented rewards,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.094634Z"},"links":{"cited_paper":"/paper/2410.23289","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:76b5488a8a917de0e1575e617e64388ec552f39574fbd0458db35695f820b6fb","observation_id":"ab8183e0-9cea-4518-8edf-f37c2a33ba02","resolution":{"observed_at":"2026-08-04T18:51:36.094634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03666","last_updated":"2024-05-06T17:43:34Z","snapshot_observed_at":"2026-07-06T18:10:33.673157Z","submitted_at":"2024-05-06T17:43:34Z","title":"ScrewMimic: Bimanual Imitation from Human Videos with Screw Space Projection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03666","snapshot_observed_at":"2026-08-04T18:51:36.096917Z","title":"Screwmimic: Bimanual imitation from human videos with screw space projection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.096917Z"},"links":{"cited_paper":"/paper/2405.03666","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:71ec95e43e05b4832fcf790989a56f5562b37e333dc9fda77a04f9314673e88f","observation_id":"2e30f510-7f36-47ca-a90a-90391e87da85","resolution":{"observed_at":"2026-08-04T18:51:36.096917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24221","last_updated":"2024-10-31T17:59:55Z","snapshot_observed_at":"2026-08-05T13:48:05.430048Z","submitted_at":"2024-10-31T17:59:55Z","title":"EgoMimic: Scaling Imitation Learning via Egocentric Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24221","snapshot_observed_at":"2026-08-04T18:51:36.099335Z","title":"Egomimic: Scaling imitation learning via egocentric video,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.099335Z"},"links":{"cited_paper":"/paper/2410.24221","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:ffd761cc23e2f2b0afaeb20ff58df4a873bb74fc7d10b1607ba5b0088c9de26c","observation_id":"32091f57-4abb-4acf-95f9-b25915a68215","resolution":{"observed_at":"2026-08-04T18:51:36.099335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.101720Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.101720Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:627c68b8dd7adff968ba05005796647741ac639f2e034c0f8a3f0f4dc08ff4cb","observation_id":"7e090c30-8b6c-4e10-8bf9-d753907dd415","resolution":{"observed_at":"2026-08-04T18:51:36.101720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.103866Z","title":"Reconstructing hands in 3D with transform- ers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.103866Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:376168fc5f2a78da61d93246024e68687ae504a6c48ac69fc6d448fc3f7bf759","observation_id":"9fde1f81-89cf-4b44-bd30-56569c5c6e50","resolution":{"observed_at":"2026-08-04T18:51:36.103866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00779","last_updated":"2026-05-28T01:50:51Z","snapshot_observed_at":"2026-07-06T20:45:08.434808Z","submitted_at":"2025-03-02T08:06:55Z","title":"Phantom: Training Robots Without Robots Using Only Human Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00779","snapshot_observed_at":"2026-08-04T18:51:36.106113Z","title":"Phantom: Training robots without robots using only human videos,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.106113Z"},"links":{"cited_paper":"/paper/2503.00779","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:e1c4dfeaf0577e79837ef337faf1e4f960b7068bd9e9a729821420b554b6a362","observation_id":"95d91406-94d2-4a22-a1e9-38d3cc1a2ba9","resolution":{"observed_at":"2026-08-04T18:51:36.106113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20321","last_updated":"2025-09-04T08:23:37Z","snapshot_observed_at":"2026-07-06T18:22:53.072592Z","submitted_at":"2024-05-30T17:56:54Z","title":"Vision-based Manipulation from Single Human Video with Open-World Object Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20321","snapshot_observed_at":"2026-08-04T18:51:36.108784Z","title":"Vision-based manipulation from single hu- man video with open-world object graphs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.108784Z"},"links":{"cited_paper":"/paper/2405.20321","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:88ee8c0615eff68905120c0ea2ed9e2c0b919d7adf973c1c7a16426a77b67ffd","observation_id":"f3066f7f-e8a0-4f0c-8bc1-bb9f7a5c211f","resolution":{"observed_at":"2026-08-04T18:51:36.108784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-04T18:51:36.111093Z","title":"Dinov2: Learning robust visual features with- out supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.111093Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:28700848a5e051649129a29a9563c003e3beb4ac2e6288c3e11c52aee4cf5e4f","observation_id":"b7a1aacb-ddf0-4850-9ced-6162638e0d3f","resolution":{"observed_at":"2026-08-04T18:51:36.111093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13705","last_updated":"2023-04-23T19:10:53Z","snapshot_observed_at":"2026-08-03T01:22:01.078078Z","submitted_at":"2023-04-23T19:10:53Z","title":"Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13705","snapshot_observed_at":"2026-08-04T18:51:36.113708Z","title":"Learning fine-grained bimanual manipulation with low-cost hardware,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.113708Z"},"links":{"cited_paper":"/paper/2304.13705","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:f40ceaa77ac0b932610e2993ed111c2a30e1013d842b4de586d8fe3e9ccceb78","observation_id":"c7959343-5e0f-4470-ab35-d99baa8b485a","resolution":{"observed_at":"2026-08-04T18:51:36.113708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.116533Z","title":"Robocasa: Large-scale simulation of ev- eryday tasks for generalist robots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.116533Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:f0a3adba51bc44019982c0fa02c0d7f73220a49d3c9a2a8471a35a481e01f835","observation_id":"629086a4-0c76-4702-99f1-dcef23c9f511","resolution":{"observed_at":"2026-08-04T18:51:36.116533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.118520Z","title":"Legato: Cross-embodiment imitation using a grasping tool,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.118520Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:656126a88462cac692b25f060ba8b856e6ade1c20f9569b06047f2b2ef65d37c","observation_id":"c68f25b1-6ea0-4947-a80c-0f1efd5fdb79","resolution":{"observed_at":"2026-08-04T18:51:36.118520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13669","last_updated":"2024-05-28T06:39:17Z","snapshot_observed_at":"2026-07-06T17:33:21.399878Z","submitted_at":"2024-02-21T10:06:08Z","title":"Self-Distillation Bridges Distribution Gap in Language Model Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13669","snapshot_observed_at":"2026-08-04T18:51:36.121101Z","title":"Self-distillation bridges distribution gap in lan- guage model fine-tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.121101Z"},"links":{"cited_paper":"/paper/2402.13669","citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:6eaf65e8ededb8984d0d6586795926d5545ca7831888085433172e06cca2be42","observation_id":"b139d678-ebc3-4869-83b6-b94fe3e0e069","resolution":{"observed_at":"2026-08-04T18:51:36.121101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.123316Z","title":"Does continual learning equally forget all pa- rameters?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.123316Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:9f37c6b20499126d8cd75803dcb65b61318d32d64ac04f0d5ec930311ec008b1","observation_id":"9c882efb-1139-4228-b6eb-e800c10490ce","resolution":{"observed_at":"2026-08-04T18:51:36.123316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.125796Z","title":"Segment anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.125796Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:8c2a1edf5e3228a9de01a9bbb56fd4dbb6f879d7817401b31c438a40a8795a54","observation_id":"eaca2272-ab9b-4419-9cba-fef227e19ff3","resolution":{"observed_at":"2026-08-04T18:51:36.125796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:51:36.127656Z","title":"Decoupling human and camera motion from videos in the wild,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T18:51:36.127656Z"},"links":{"citing_paper":"/paper/2509.09769"},"observation_digest":"sha256:84056f0060dc84034baa1458088294d73539e5a2a8b58182f8be574ea78d1f51","observation_id":"21fce94b-14a0-4ddf-a77e-23c89142ee12","resolution":{"observed_at":"2026-08-04T18:51:36.127656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.09769","last_updated":"2025-09-11T18:02:48Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-05T21:03:29.576416Z","submitted_at":"2025-09-11T18:02:48Z","title":"MimicDroid: In-Context Learning for Humanoid Robot Manipulation from Human Play Videos"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 9 inbound Pith citation observations for arXiv:2509.09769."}