{"as_of":"2026-08-19T18:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:585631a7b08147f2d39431ef2cc1fa324630eee0efbf9adebaa746af4a0df831","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:15:08.021366Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25895/citation-record","integrity":"/paper/2607.25895/integrity","json":"/paper/2607.25895/citation-record.json","paper":"/paper/2607.25895"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:07.843794Z","title":"RT-1: Robotics transformer for real-world control at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.843794Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:03c622032c746afc6130aac16476ef2a4ad81159c626c547f8670e4af7b4e642","observation_id":"147f4e00-5f78-40f2-89ff-928413c31031","resolution":{"observed_at":"2026-08-01T01:15:07.843794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12952","last_updated":"2024-01-17T22:41:29Z","snapshot_observed_at":"2026-08-18T12:56:00.263505Z","submitted_at":"2023-08-24T17:41:20Z","title":"BridgeData V2: A Dataset for Robot Learning at Scale","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12952","snapshot_observed_at":"2026-08-01T01:15:07.847028Z","title":"BridgeData V2: A dataset for robot learning at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.847028Z"},"links":{"cited_paper":"/paper/2308.12952","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:856afb7ae806b10fd779a4984e528a0ea710b2d51f9b54d1f7fa8a1a3f730fb4","observation_id":"2e53a6d7-d331-4f09-b78f-87b7c1bca915","resolution":{"observed_at":"2026-08-01T01:15:07.847028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-01T01:15:07.850750Z","title":"DROID: A large-scale in-the-wild robot manipulation dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.850750Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:9457487b40799a0d769bdcba79574d0d7ceb16c97ce2db237f25031b8d56ee20","observation_id":"ff3adf4c-4839-42e8-9da1-d0a358e67b63","resolution":{"observed_at":"2026-08-01T01:15:07.850750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06669","last_updated":"2025-08-04T04:50:21Z","snapshot_observed_at":"2026-08-16T04:42:52.370966Z","submitted_at":"2025-03-09T15:40:29Z","title":"AgiBot World Colosseo: A Large-scale Manipulation Platform for Scalable and Intelligent Embodied Systems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06669","snapshot_observed_at":"2026-08-01T01:15:07.853360Z","title":"AgiBot World Colosseo: A large-scale manipulation platform for scalable and intelligent embodied systems.arXiv preprint arXiv:2503.06669, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.853360Z"},"links":{"cited_paper":"/paper/2503.06669","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:2a1b77e2c99e0ac03ed4f19ad44826dfdaa490086aab631bb3a7fd78153397d9","observation_id":"868d0f32-df5c-46bc-a100-c44df49e1443","resolution":{"observed_at":"2026-08-01T01:15:07.853360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13877","last_updated":"2025-05-27T01:46:53Z","snapshot_observed_at":"2026-08-15T09:21:12.808847Z","submitted_at":"2024-12-18T14:17:16Z","title":"RoboMIND: Benchmark on Multi-embodiment Intelligence Normative Data for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13877","snapshot_observed_at":"2026-08-01T01:15:07.856378Z","title":"RoboMIND: Benchmark on multi-embodiment intelligence normative data for robot manipulation.arXiv preprint arXiv:2412.13877, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.856378Z"},"links":{"cited_paper":"/paper/2412.13877","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:87c43484cb13c257a09efd97951efb98919601a3e1acba389804c537b5d62025","observation_id":"2e669a11-8af6-47c7-be3c-66313ca7aee6","resolution":{"observed_at":"2026-08-01T01:15:07.856378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10329","last_updated":"2024-03-06T00:11:34Z","snapshot_observed_at":"2026-08-18T16:58:44.329929Z","submitted_at":"2024-02-15T21:11:50Z","title":"Universal Manipulation Interface: In-The-Wild Robot Teaching Without In-The-Wild Robots","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10329","snapshot_observed_at":"2026-08-01T01:15:07.859324Z","title":"Universal manipulation interface: In-the-wild robot teaching without in-the-wild robots","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.859324Z"},"links":{"cited_paper":"/paper/2402.10329","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:6a9a93b0fa4619eed5b0d8357914a1bfc4d1d4bab4c946e2c36c63e046fbbc8b","observation_id":"6a673843-423f-47d1-8ca4-7b4c690c5fa3","resolution":{"observed_at":"2026-08-01T01:15:07.859324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19499","last_updated":"2025-02-01T06:32:46Z","snapshot_observed_at":"2026-08-18T01:21:20.553241Z","submitted_at":"2024-09-29T00:55:20Z","title":"FastUMI: A Scalable and Hardware-Independent Universal Manipulation Interface with Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19499","snapshot_observed_at":"2026-08-01T01:15:07.861801Z","title":"FastUMI: A scalable and hardware-independent universal manip- ulation interface with dataset.arXiv preprint arXiv:2409.19499, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.861801Z"},"links":{"cited_paper":"/paper/2409.19499","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:c7d505da9b2f8f5c351327708a4b0cf7ba0d88f126576a1a11bcf87f255ad80a","observation_id":"0065c2d7-f858-452b-9cdc-f6af0a9b9a7b","resolution":{"observed_at":"2026-08-01T01:15:07.861801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18647","last_updated":"2026-06-26T02:30:53Z","snapshot_observed_at":"2026-08-19T04:08:17.011634Z","submitted_at":"2024-10-24T11:19:30Z","title":"Data Scaling Laws in Imitation Learning for Robotic Manipulation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18647","snapshot_observed_at":"2026-08-01T01:15:07.863974Z","title":"Data scaling laws in imitation learning for robotic manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.863974Z"},"links":{"cited_paper":"/paper/2410.18647","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:12ea669de630459f94aed431722d687479a98aabdd305f8c0534843706825afd","observation_id":"f5273232-f96a-4635-a2e9-1e2fb399d211","resolution":{"observed_at":"2026-08-01T01:15:07.863974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.03081","last_updated":"2025-08-25T06:01:46Z","snapshot_observed_at":"2026-08-16T12:53:02.126679Z","submitted_at":"2025-03-05T00:44:12Z","title":"AirExo-2: Scaling up Generalizable Robotic Imitation Learning with Low-Cost Exoskeletons","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.03081","snapshot_observed_at":"2026-08-01T01:15:07.866868Z","title":"AirExo-2: Scaling up generalizable robotic imitation learning with low-cost exoskeletons.arXiv preprint arXiv:2503.03081, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.866868Z"},"links":{"cited_paper":"/paper/2503.03081","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:59f5dca1f88030374b09e59436e91b911b20c2b010fc752a99a4ac3f1566a770","observation_id":"defe2762-7122-4579-a349-712df11df18b","resolution":{"observed_at":"2026-08-01T01:15:07.866868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-01T01:15:07.870173Z","title":"GR00T N1: An open foundation model for generalist humanoid robots.arXiv preprint arXiv:2503.14734, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.870173Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:b0c825e229e8e5dd46a0be571902dedebb555a533205b91f25638560173de6c3","observation_id":"38b77d06-c153-4515-89e5-cbf42d0088f1","resolution":{"observed_at":"2026-08-01T01:15:07.870173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23523","last_updated":"2025-08-01T06:30:43Z","snapshot_observed_at":"2026-08-14T01:02:55.742291Z","submitted_at":"2025-07-31T13:06:59Z","title":"H-RDT: Human Manipulation Enhanced Bimanual Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23523","snapshot_observed_at":"2026-08-01T01:15:07.873690Z","title":"H-RDT: Human manipulation enhanced bimanual robotic manip- ulation.arXiv preprint arXiv:2507.23523, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.873690Z"},"links":{"cited_paper":"/paper/2507.23523","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:459e1258ee2421b46fce65a1289a3cc3c9b2215baccc27626c5109ba3c3d5252","observation_id":"1ee8d4e8-cd52-4cc4-9390-7f454d0ecc91","resolution":{"observed_at":"2026-08-01T01:15:07.873690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:07.876478Z","title":"John, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.876478Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:be594db1c3200698a270c819576291bfff6737c81286a1db32294e4be5c4805e","observation_id":"dcc07222-1174-4731-97f2-5d0ee71b9681","resolution":{"observed_at":"2026-08-01T01:15:07.876478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13001","last_updated":"2026-04-16T16:19:28Z","snapshot_observed_at":"2026-08-17T23:55:14.847258Z","submitted_at":"2026-04-14T17:34:21Z","title":"XRZero-G0: Pushing the Frontier of Dexterous Robotic Manipulation with Interfaces, Quality and Ratios","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.13001","snapshot_observed_at":"2026-08-01T01:15:07.878525Z","title":"XRZero-G0: Pushing the frontier of dexterous robotic manipulation with interfaces, quality and ratios.arXiv preprint arXiv:2604.13001, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.878525Z"},"links":{"cited_paper":"/paper/2604.13001","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:39d61940542e7f4c4f194aa8f7a2af601e2d784341e5b43d9c7599f435987e5b","observation_id":"a30d030d-8c85-4b7b-9df7-40e800deffa6","resolution":{"observed_at":"2026-08-01T01:15:07.878525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:07.881171Z","title":"RDT2: Exploring the scaling limit of UMI data towards zero-shot cross-embodiment generalization.arXiv preprint arXiv:2602.03310, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.881171Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:bfd482e3616270e8d201983e7026b95fc4199ed7d8b9479ead0e3337d9533e75","observation_id":"d5d3449a-cd41-4454-a54f-7c5a59611904","resolution":{"observed_at":"2026-08-01T01:15:07.881171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00595","last_updated":"2023-09-26T10:47:35Z","snapshot_observed_at":"2026-08-17T23:49:22.371557Z","submitted_at":"2023-07-02T15:33:31Z","title":"RH20T: A Comprehensive Robotic Dataset for Learning Diverse Skills in One-Shot","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00595","snapshot_observed_at":"2026-08-01T01:15:07.883647Z","title":"RH20T: A comprehensive robotic dataset for learning diverse skills in one-shot.arXiv preprint arXiv:2307.00595, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.883647Z"},"links":{"cited_paper":"/paper/2307.00595","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:51c0ff13260b380e95320eb0425e82d5823f9238b6fae3b7a48fe04c801bdabe","observation_id":"a424e8c8-f4dd-450d-b2af-3278cbff3aa0","resolution":{"observed_at":"2026-08-01T01:15:07.883647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-01T01:15:07.886373Z","title":"Open X-embodiment: Robotic learning datasets and RT-X models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.886373Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:791de812f5f2936f7fd2151002b49df91837beffebcab4566b7eb77914180452","observation_id":"978c0a20-2697-4f79-b889-5d8d981413a3","resolution":{"observed_at":"2026-08-01T01:15:07.886373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:07.888913Z","title":"RoboMIND 2.0: A multimodal, bimanual mobile manipulation dataset for generalizable embodied intelligence.arXiv preprint arXiv:2512.24653, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.888913Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:8786a99d0b9ab9364f35400b0697cab0206c823ac8f70c7141eff8ad1f8ef9d7","observation_id":"9aa15162-6e2c-4724-a890-8a2645afcbad","resolution":{"observed_at":"2026-08-01T01:15:07.888913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07058","last_updated":"2022-03-11T19:40:26Z","snapshot_observed_at":"2026-08-16T17:49:30.208747Z","submitted_at":"2021-10-13T22:19:32Z","title":"Ego4D: Around the World in 3,000 Hours of Egocentric Video","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07058","snapshot_observed_at":"2026-08-01T01:15:07.890816Z","title":"Ego4D: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.890816Z"},"links":{"cited_paper":"/paper/2110.07058","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:d5c914743073a00de36f66cf36f6fab48b72145acac02b25ef43da3b9172ec6b","observation_id":"d44abac6-5073-4d1a-961e-d191ede4d4ef","resolution":{"observed_at":"2026-08-01T01:15:07.890816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18259","last_updated":"2024-09-25T21:55:38Z","snapshot_observed_at":"2026-08-16T14:38:59.216162Z","submitted_at":"2023-11-30T05:21:07Z","title":"Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18259","snapshot_observed_at":"2026-08-01T01:15:07.893849Z","title":"Ego-Exo4D: Understanding skilled human activity from first- and third-person perspectives","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.893849Z"},"links":{"cited_paper":"/paper/2311.18259","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:c7556b8f8bd9b5d01838fb45191f4e3c3fc3761d46102fb65c47f74c48728e97","observation_id":"d0dddefd-ac1e-4f22-8201-0c093845a150","resolution":{"observed_at":"2026-08-01T01:15:07.893849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11709","last_updated":"2026-03-09T06:44:42Z","snapshot_observed_at":"2026-08-12T03:35:51.024147Z","submitted_at":"2025-05-16T21:34:47Z","title":"EgoDex: Learning Dexterous Manipulation from Large-Scale Egocentric Video","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11709","snapshot_observed_at":"2026-08-01T01:15:07.897484Z","title":"Yoon, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.897484Z"},"links":{"cited_paper":"/paper/2505.11709","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:7d92955e75943a7c275d7679e6549a1d514a52d2988b065d2f1efd31518da755","observation_id":"7c36d10b-e489-4729-82f4-79904937a768","resolution":{"observed_at":"2026-08-01T01:15:07.897484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:07.900559Z","title":"FastUMI-100K: Advancing data-driven robotic manipulation with a large-scale UMI-style dataset.arXiv preprint arXiv:2510.08022, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.900559Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:17442f7211a612a86f81f7aaf1cd1cc00dc76e04375d990627213d4997247580","observation_id":"9413fe39-8258-4e23-914b-831abc79836c","resolution":{"observed_at":"2026-08-01T01:15:07.900559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.04708","last_updated":"2026-06-04T07:21:55Z","snapshot_observed_at":"2026-08-15T11:17:04.176935Z","submitted_at":"2026-06-03T10:38:45Z","title":"VISTA: Vision-Grounded and Physics-Validated Adaptation of UMI data for VLA Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.04708","snapshot_observed_at":"2026-08-01T01:15:07.902567Z","title":"VISTA: Vision-grounded and physics-validated adaptation of UMI data for VLA training.arXiv preprint arXiv:2606.04708, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.902567Z"},"links":{"cited_paper":"/paper/2606.04708","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:8e9614a083521ce478027354122e94f779b669ec8fa7622b451dde968e14f78c","observation_id":"bf8f3ca5-a8cd-4e1e-8ba6-d69d3fdf730a","resolution":{"observed_at":"2026-08-01T01:15:07.902567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07788","last_updated":"2024-07-04T04:35:04Z","snapshot_observed_at":"2026-08-18T19:25:21.657274Z","submitted_at":"2024-03-12T16:23:49Z","title":"DexCap: Scalable and Portable Mocap Data Collection System for Dexterous Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07788","snapshot_observed_at":"2026-08-01T01:15:07.904750Z","title":"DexCap: Scalable and portable mocap data collection system for dexterous manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.904750Z"},"links":{"cited_paper":"/paper/2403.07788","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:9f5b7780c72d87f143fdccd8c4601230749d9b5c0c752aad3aefa2021a73927b","observation_id":"b8585936-bad7-4706-8088-9af61977cd07","resolution":{"observed_at":"2026-08-01T01:15:07.904750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:07.906926Z","title":"DexUMI: Using human hand as the universal manipulation interface for dexterous manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.906926Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:aa5f4d61ed40c8f9e849c95dfa81f802b9e220834320e798f1759a14631bf2d3","observation_id":"d193376a-1e00-4fe0-93b3-545ef6bb2a9e","resolution":{"observed_at":"2026-08-01T01:15:07.906926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:07.909567Z","title":"DexWild: Dexterous human interactions for in-the-wild robot policies.Robotics: Science and Systems (RSS), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.909567Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:99d60d6e02f95d11609e88f2513c4f5f20548d3ae841b37b061990f47eb78089","observation_id":"96b24f2b-8238-4b2a-949e-addd6878a1cb","resolution":{"observed_at":"2026-08-01T01:15:07.909567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08464","last_updated":"2024-10-11T02:30:46Z","snapshot_observed_at":"2026-08-16T13:10:29.394980Z","submitted_at":"2024-10-11T02:30:46Z","title":"ARCap: Collecting High-quality Human Demonstrations for Robot Learning with Augmented Reality Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08464","snapshot_observed_at":"2026-08-01T01:15:07.911830Z","title":"ARCap: Collecting high-quality human demonstrations for robot learning with augmented reality feedback","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.911830Z"},"links":{"cited_paper":"/paper/2410.08464","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:f918aec0e2ff4902085f9ae4525fa15f5426dce47ecf6a790dc50c3689099696","observation_id":"a65d6843-15a8-4548-9b56-3878c77c3b24","resolution":{"observed_at":"2026-08-01T01:15:07.911830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14975","last_updated":"2024-05-09T04:40:34Z","snapshot_observed_at":"2026-08-16T14:57:29.990457Z","submitted_at":"2023-09-26T14:48:29Z","title":"AirExo: Low-Cost Exoskeletons for Learning Whole-Arm Manipulation in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14975","snapshot_observed_at":"2026-08-01T01:15:07.914989Z","title":"AirExo: Low-cost exoskeletons for learning whole-arm manipulation in the wild","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.914989Z"},"links":{"cited_paper":"/paper/2309.14975","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:b5be99bc0f195107703683c27d60097eb0a6b2fd8375356a5973ad9a4aff8bf0","observation_id":"49a4a3bb-e427-46a3-8ce8-4eae216f2871","resolution":{"observed_at":"2026-08-01T01:15:07.914989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24221","last_updated":"2024-10-31T17:59:55Z","snapshot_observed_at":"2026-08-16T13:04:01.871508Z","submitted_at":"2024-10-31T17:59:55Z","title":"EgoMimic: Scaling Imitation Learning via Egocentric Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24221","snapshot_observed_at":"2026-08-01T01:15:07.917085Z","title":"EgoMimic: Scaling imitation learning via egocentric video","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.917085Z"},"links":{"cited_paper":"/paper/2410.24221","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:c2139cc6c22f2a514aa68131a54e633f229b596afab4182fd36e4c452aec7c8c","observation_id":"5815b737-2195-4193-96c6-cae032e081e4","resolution":{"observed_at":"2026-08-01T01:15:07.917085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-01T01:15:07.920021Z","title":"RT-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.920021Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:bdac83098d261a96ea70aee5a20acd584135d004bae042f986fe588de04e45d9","observation_id":"30ddacf8-d7ee-4b88-879c-c965b75954f4","resolution":{"observed_at":"2026-08-01T01:15:07.920021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-01T01:15:07.922128Z","title":"OpenVLA: An open-source vision-language-action model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.922128Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:bc520c88ce4c51bd1dab2a45ed4832ca0884c16566ad135b6547cfbf9ec81be1","observation_id":"38f3699b-b102-45f2-b4cd-aeb40d907186","resolution":{"observed_at":"2026-08-01T01:15:07.922128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-08-14T08:22:11.295012Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-01T01:15:07.924123Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.924123Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:89a7551eb3c11c8a33f29dd30ad57b275a38cd76beabcd1c7204bb1c45af552f","observation_id":"d9baf7a6-d52e-4c69-817e-dd3f3be8db15","resolution":{"observed_at":"2026-08-01T01:15:07.924123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-08-16T17:53:54.636855Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-01T01:15:07.926972Z","title":"arXiv preprint arXiv:2410.24164, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.926972Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:0e218e6063cd373c89cd9bc02c9077d09969bfbd220cfa261e545b8008716012","observation_id":"e74a2ee7-6405-4057-9062-26a35cb849ec","resolution":{"observed_at":"2026-08-01T01:15:07.926972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-01T01:15:07.930670Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.930670Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:fdbecea1d2427c58565d141deb54837317417c1dd418b19960de46e859722dfd","observation_id":"67144df1-0593-4214-b1ea-cc967f0a7428","resolution":{"observed_at":"2026-08-01T01:15:07.930670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15493","last_updated":"2025-07-22T15:04:37Z","snapshot_observed_at":"2026-08-06T13:23:03.968769Z","submitted_at":"2025-07-21T10:54:13Z","title":"GR-3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15493","snapshot_observed_at":"2026-08-01T01:15:07.933554Z","title":"GR-3 technical report.arXiv preprint arXiv:2507.15493, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.933554Z"},"links":{"cited_paper":"/paper/2507.15493","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:ffd74eac662f5cb8c4e6e59ed34c6e5e3246d5f30c66de0bfae176ffa2d6ca28","observation_id":"5ae5ab42-a1ff-483c-9906-505517c03b38","resolution":{"observed_at":"2026-08-01T01:15:07.933554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20020","last_updated":"2025-03-25T19:02:56Z","snapshot_observed_at":"2026-08-13T04:40:33.458745Z","submitted_at":"2025-03-25T19:02:56Z","title":"Gemini Robotics: Bringing AI into the Physical World","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20020","snapshot_observed_at":"2026-08-01T01:15:07.936121Z","title":"Gemini robotics: Bringing AI into the physical world.arXiv preprint arXiv:2503.20020, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.936121Z"},"links":{"cited_paper":"/paper/2503.20020","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:d67d31e9c629dbfe3496081c9a3f70070fc29c3d7e437a4e8d978fd919712bee","observation_id":"56b39639-8319-445a-a65c-14ad0020a69c","resolution":{"observed_at":"2026-08-01T01:15:07.936121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-08-18T04:25:30.115862Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-08-01T01:15:07.939059Z","title":"SmolVLA: A vision-language-action model for affordable and efficient robotics.arXiv preprint arXiv:2506.01844, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.939059Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:fbd404ef029ba4507896bcb254cb6351e4d096840138695c01f4c47c31328985","observation_id":"088e8c96-af70-488b-a483-af6c0433a75e","resolution":{"observed_at":"2026-08-01T01:15:07.939059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-01T01:15:07.941316Z","title":"FAST: Efficient action tokenization for vision-language-action models.arXiv preprint arXiv:2501.09747, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.941316Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:a019382fad38cb15aa9f174aef85f4f6439f7ceff5816d4b51571bee7b65afde","observation_id":"ed28d275-4394-45f9-acf0-12b20f40b23e","resolution":{"observed_at":"2026-08-01T01:15:07.941316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-08-15T09:35:08.116329Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-01T01:15:07.943496Z","title":"Fine-tuning vision-language-action models: Optimizing speed and success.Robotics: Science and Systems (RSS), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.943496Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:4057fe97712e959a0e998f26d56f68294c7b3a375c3c0f27705014f79b842a8f","observation_id":"d7ad9593-b41a-4079-a6ee-15b382734c49","resolution":{"observed_at":"2026-08-01T01:15:07.943496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18692","last_updated":"2026-02-26T03:30:01Z","snapshot_observed_at":"2026-08-11T08:52:29.230329Z","submitted_at":"2026-01-26T17:08:04Z","title":"A Pragmatic VLA Foundation Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.18692","snapshot_observed_at":"2026-08-01T01:15:07.945870Z","title":"A pragmatic VLA foundation model.arXiv preprint arXiv:2601.18692, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.945870Z"},"links":{"cited_paper":"/paper/2601.18692","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:9f1f8864edfbb80962a3010c83470a413e0c66a120acd0081650a7cb801b4842","observation_id":"59b63377-e4f4-4349-a74c-a63399492d06","resolution":{"observed_at":"2026-08-01T01:15:07.945870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30280","last_updated":"2026-06-01T13:48:35Z","snapshot_observed_at":"2026-08-18T14:09:54.189121Z","submitted_at":"2026-05-28T17:36:31Z","title":"Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30280","snapshot_observed_at":"2026-08-01T01:15:07.948972Z","title":"Qwen-VLA: Unifying vision-language-action modeling across tasks, environments, and robot embodiments.arXiv preprint arXiv:2605.30280, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.948972Z"},"links":{"cited_paper":"/paper/2605.30280","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:ce7bfba72b1da8ba849d359da9ba69967603e4f3b1080de566713ca08810e760","observation_id":"25f985fe-dfa6-4f5e-a05d-30e2e6cbfdda","resolution":{"observed_at":"2026-08-01T01:15:07.948972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.17846","last_updated":"2026-06-17T17:06:39Z","snapshot_observed_at":"2026-08-18T04:06:48.500842Z","submitted_at":"2026-06-16T12:14:39Z","title":"Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.17846","snapshot_observed_at":"2026-08-01T01:15:07.952361Z","title":"Qwen-RobotManip technical report: Alignment unlocks scale for robotic manipulation foundation models.arXiv preprint arXiv:2606.17846, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.952361Z"},"links":{"cited_paper":"/paper/2606.17846","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:511980cdd0f0bc84cf4ad6a9d6b838b350fed2024285b5b97d4b943e832dfa65","observation_id":"6b6e4223-43cf-4315-afdc-a7dad6cc1d00","resolution":{"observed_at":"2026-08-01T01:15:07.952361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13139","last_updated":"2023-12-21T05:34:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-20T16:00:43Z","title":"Unleashing Large-Scale Video Generative Pre-training for Visual Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13139","snapshot_observed_at":"2026-08-01T01:15:07.955936Z","title":"Unleashing large-scale video generative pre-training for visual robot manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.955936Z"},"links":{"cited_paper":"/paper/2312.13139","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:463fd8e0f2f027fa55b501c6283b44b6e31cc56f24a3d1dc0fae77e8837c6bf0","observation_id":"4adee39c-a9a6-4fec-b7e9-f6ac4c13d4e5","resolution":{"observed_at":"2026-08-01T01:15:07.955936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06158","last_updated":"2024-10-08T16:00:47Z","snapshot_observed_at":"2026-08-12T23:18:51.506083Z","submitted_at":"2024-10-08T16:00:47Z","title":"GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06158","snapshot_observed_at":"2026-08-01T01:15:07.959147Z","title":"GR-2: A generative video-language-action model with web-scale knowledge for robot manipulation.arXiv preprint arXiv:2410.06158, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.959147Z"},"links":{"cited_paper":"/paper/2410.06158","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:0f42de0069097a83d4cadee31c7c22535e1e5b2d44519a45d07463024086ad7d","observation_id":"e25a7d0b-8ea0-4e5f-aa72-88f322eec3c9","resolution":{"observed_at":"2026-08-01T01:15:07.959147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-16T15:58:41.194108Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-01T01:15:07.962162Z","title":"Learning universal policies via text-guided video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.962162Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:527cbb4597e2f62cc964dc471801267b14ee09fdbd6f90f639a9c02a0cd92730","observation_id":"b9d5f229-40a8-4cdc-bfc8-0a0827f763b4","resolution":{"observed_at":"2026-08-01T01:15:07.962162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14803","last_updated":"2025-05-04T04:28:53Z","snapshot_observed_at":"2026-08-13T21:27:22.538668Z","submitted_at":"2024-12-19T12:48:40Z","title":"Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14803","snapshot_observed_at":"2026-08-01T01:15:07.964827Z","title":"Video prediction policy: A generalist robot policy with predic- tive visual representations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.964827Z"},"links":{"cited_paper":"/paper/2412.14803","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:ad20ef0b3a2fee561dec80e0d86d3dd78907c9d358c3a7026a7c533775b42cff","observation_id":"516c59fd-800a-454f-99fc-d29546754d0c","resolution":{"observed_at":"2026-08-01T01:15:07.964827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15922","last_updated":"2026-02-17T15:04:02Z","snapshot_observed_at":"2026-08-09T12:54:21.149243Z","submitted_at":"2026-02-17T15:04:02Z","title":"World Action Models are Zero-shot Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15922","snapshot_observed_at":"2026-08-01T01:15:07.967585Z","title":"World action models are zero-shot policies.arXiv preprint arXiv:2602.15922, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.967585Z"},"links":{"cited_paper":"/paper/2602.15922","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:c3735a6750116cfc0f2242f45ab7488923710af551ee566fab8711f6f885c8cd","observation_id":"1d799c39-a199-4718-ad51-e6ac0467de3d","resolution":{"observed_at":"2026-08-01T01:15:07.967585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21539","last_updated":"2025-06-26T17:55:40Z","snapshot_observed_at":"2026-08-13T10:05:34.967093Z","submitted_at":"2025-06-26T17:55:40Z","title":"WorldVLA: Towards Autoregressive Action World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21539","snapshot_observed_at":"2026-08-01T01:15:07.970203Z","title":"WorldVLA: Towards autoregressive action world model.arXiv preprint arXiv:2506.21539, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.970203Z"},"links":{"cited_paper":"/paper/2506.21539","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:c3c4925b678b889ffc107127b83c07d8c2e1973d181795f5b7124957f6e863a3","observation_id":"2074a2cd-9842-45f5-aee4-a4097fe86891","resolution":{"observed_at":"2026-08-01T01:15:07.970203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21998","last_updated":"2026-03-22T15:37:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T17:07:43Z","title":"Causal World Modeling for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21998","snapshot_observed_at":"2026-08-01T01:15:07.972214Z","title":"Causal world modeling for robot control.arXiv preprint arXiv:2601.21998, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.972214Z"},"links":{"cited_paper":"/paper/2601.21998","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:60d5c61cdf88ac1e5c52cf318adb86da7ce4c008406676a93e8959d3efba51b2","observation_id":"ce9ae302-c28f-4fed-9c54-524a75b79db7","resolution":{"observed_at":"2026-08-01T01:15:07.972214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05014","last_updated":"2026-04-06T17:59:21Z","snapshot_observed_at":"2026-08-11T13:37:09.952888Z","submitted_at":"2026-04-06T17:59:21Z","title":"StarVLA: A Lego-like Codebase for Vision-Language-Action Model Developing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.05014","snapshot_observed_at":"2026-08-01T01:15:07.974934Z","title":"StarVLA: A lego-like codebase for vision-language-action model developing.arXiv preprint arXiv:2604.05014, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.974934Z"},"links":{"cited_paper":"/paper/2604.05014","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:90ef8c12ce18af35802c03a38e07122c0f4e6c5ab9496af58ab759a363091543","observation_id":"591bb4ff-12c0-45ac-a384-9244297150fb","resolution":{"observed_at":"2026-08-01T01:15:07.974934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:07.978401Z","title":"VINS-Mono: A robust and versatile monocular visual-inertial state estimator.IEEE Transactions on Robotics, 34(4):1004–1020, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.978401Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:598044fd34148ea549dcb5e918d3233a2dc1c483da255f71672bbe1316a05a3e","observation_id":"b1a134b5-f62d-4f1b-87be-fdca0542261d","resolution":{"observed_at":"2026-08-01T01:15:07.978401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.11898","last_updated":"2021-04-23T13:17:58Z","snapshot_observed_at":"2026-08-11T00:26:42.247102Z","submitted_at":"2020-07-23T10:09:54Z","title":"ORB-SLAM3: An Accurate Open-Source Library for Visual, Visual-Inertial and Multi-Map SLAM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.11898","snapshot_observed_at":"2026-08-01T01:15:07.980726Z","title":"Gómez Rodríguez, et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.980726Z"},"links":{"cited_paper":"/paper/2007.11898","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:029f1da26144c352e335adaaa90d5eadd03eda06e49ef1584033ace7aeb3cc25","observation_id":"bad92038-1fbc-4068-b969-0084137e6691","resolution":{"observed_at":"2026-08-01T01:15:07.980726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:07.982863Z","title":"AprilTag: A robust and flexible visual fiducial system","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.982863Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:6dad964df47700ce6fc483f975a1b634474a73c555b5a6b5db42b1c766e889dc","observation_id":"978a7d91-8f86-4280-9bec-a485e9d31743","resolution":{"observed_at":"2026-08-01T01:15:07.982863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02469","last_updated":"2019-12-05T10:05:52Z","snapshot_observed_at":"2026-08-12T08:08:48.137984Z","submitted_at":"2019-12-05T10:05:52Z","title":"VersaVIS: An Open Versatile Multi-Camera Visual-Inertial Sensor Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02469","snapshot_observed_at":"2026-08-01T01:15:07.985215Z","title":"VersaVIS—an open versatile multi-camera visual-inertial sensor suite.Sensors, 20(5):1439, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.985215Z"},"links":{"cited_paper":"/paper/1912.02469","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:31cd810419c80223442b0eab254e6b372a24cf199251745970c1b1a066511546","observation_id":"c96a28f6-be8b-4d46-a199-b9c6abd122d2","resolution":{"observed_at":"2026-08-01T01:15:07.985215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:07.988427Z","title":"DAS Fingers: A high-precision multimodal data-collection device for embodied AI.https: //www.genrobot.ai/products/finger, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.988427Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:f1e314cfa3aa6bbcc300d2a5a0f0a8df2bea66c4cb6c2a06161b0604d9b7748c","observation_id":"bb3d007a-cdcd-497f-839c-527d7b23d054","resolution":{"observed_at":"2026-08-01T01:15:07.988427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:07.990542Z","title":"TacUMI: A multi-modal universal manipulation interface for contact-rich tasks.arXiv preprint arXiv:2601.14550, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.990542Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:21c83ff212c5ee24f060ee6f42e04ffb8e2824809268d5df3bea55d1a259a10a","observation_id":"69bf5fc2-54fc-4e38-b605-466084a04a76","resolution":{"observed_at":"2026-08-01T01:15:07.990542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05620","last_updated":"2018-08-15T08:09:22Z","snapshot_observed_at":"2026-08-16T00:09:38.709813Z","submitted_at":"2018-06-14T15:52:07Z","title":"DynaSLAM: Tracking, Mapping and Inpainting in Dynamic Scenes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.05620","snapshot_observed_at":"2026-08-01T01:15:07.992313Z","title":"Fácil, Javier Civera, et al","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.992313Z"},"links":{"cited_paper":"/paper/1806.05620","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:588a9404ab5719d7bfde91e6d3fc7b00c370b94129c96a77f83843d85f42085b","observation_id":"236f8bf4-e2f2-4ba5-b28f-559660614910","resolution":{"observed_at":"2026-08-01T01:15:07.992313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10353","last_updated":"2024-07-14T23:03:23Z","snapshot_observed_at":"2026-08-19T14:30:33.501778Z","submitted_at":"2024-07-14T23:03:23Z","title":"UMI on Legs: Making Manipulation Policies Mobile with Manipulation-Centric Whole-body Controllers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10353","snapshot_observed_at":"2026-08-01T01:15:07.995654Z","title":"UMI on legs: Making manipulation policies mobile with manipulation- centric whole-body controllers.arXiv preprint arXiv:2407.10353, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.995654Z"},"links":{"cited_paper":"/paper/2407.10353","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:94f831ab10bafa9d14fc06f790311bcc60d7d6a7c2222abf8944cb0527c9f37f","observation_id":"275e6924-0abc-4817-9e5c-89193e7a18b6","resolution":{"observed_at":"2026-08-01T01:15:07.995654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00899","last_updated":"2023-11-01T23:40:07Z","snapshot_observed_at":"2026-08-16T14:46:42.725649Z","submitted_at":"2023-11-01T23:40:07Z","title":"RoboVQA: Multimodal Long-Horizon Reasoning for Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00899","snapshot_observed_at":"2026-08-01T01:15:07.999020Z","title":"RoboVQA: Multimodal long-horizon reasoning for robotics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.999020Z"},"links":{"cited_paper":"/paper/2311.00899","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:3175d61abd3928f41194a3b203672e49687376563e6f7a1e8ea11d987b7eec5a","observation_id":"0fa8150c-ae49-4866-aade-f4a9675ddd5b","resolution":{"observed_at":"2026-08-01T01:15:07.999020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.07035","last_updated":"2020-06-08T21:29:08Z","snapshot_observed_at":"2026-08-14T17:42:15.517193Z","submitted_at":"2018-12-17T20:13:17Z","title":"On the Continuity of Rotation Representations in Neural Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.07035","snapshot_observed_at":"2026-08-01T01:15:08.001712Z","title":"On the continuity of rotation representations in neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:08.001712Z"},"links":{"cited_paper":"/paper/1812.07035","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:d412d2ef8c8bf2b871ca8f8051abb4157b499a4f2b4e97662e6b39551385fad4","observation_id":"0a6cd157-ec62-4e7e-8ecb-e1199db56ee6","resolution":{"observed_at":"2026-08-01T01:15:08.001712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-01T01:15:08.003800Z","title":"Qwen3 Technical Report.arXiv preprint arXiv:2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:08.003800Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:a5ff084950f3e0df44180df562b1daf08458ebd836f1a1144278b38c0f948760","observation_id":"019fd61b-3910-4cf0-bd06-0edade591ee3","resolution":{"observed_at":"2026-08-01T01:15:08.003800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-16T02:30:42.660030Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-01T01:15:08.006939Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:08.006939Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:28ea7ed9e74993f9ffdfb3dd0a61712066f4249918ab7ae7f48254f1b2dd16fc","observation_id":"2bb3b13f-53a2-4b4f-9d87-c30234145da6","resolution":{"observed_at":"2026-08-01T01:15:08.006939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09748","last_updated":"2023-03-02T09:06:55Z","snapshot_observed_at":"2026-08-17T19:22:44.145403Z","submitted_at":"2022-12-19T18:59:58Z","title":"Scalable Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09748","snapshot_observed_at":"2026-08-01T01:15:08.009966Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:08.009966Z"},"links":{"cited_paper":"/paper/2212.09748","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:9d748ae38086ba69782fa9392043850d123d57e09674acf745bbc5a6ea70f469","observation_id":"db7e7c52-4076-4a3f-b2be-538915c83d31","resolution":{"observed_at":"2026-08-01T01:15:08.009966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:08.012207Z","title":"Zhao, Vikash Kumar, Sergey Levine, et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:08.012207Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:ec3bc2e6a19812abe31b3792b18c459ef0ba4bf17a9758a2857dd79c6a526cf2","observation_id":"30ae9065-0513-4b23-a167-08b6ce834775","resolution":{"observed_at":"2026-08-01T01:15:08.012207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:08.014056Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:08.014056Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:b28bca7a3eb5a090ec56b891c7121480b5f0f0cbbc75b504c5e93d37f7f17afc","observation_id":"641e5e1c-f00f-493e-91a4-37ace503c0a7","resolution":{"observed_at":"2026-08-01T01:15:08.014056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-08T07:16:45.596308Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-01T01:15:08.016418Z","title":"PaliGemma: A versatile 3b VLM for transfer.arXiv preprint arXiv:2407.07726, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:08.016418Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:f50b4fe0d28ce5135b870bbe39bd6413472a2eb0fa99a6f6f007dccca733d583","observation_id":"97b636d6-5d0e-4eda-b94e-1f510350e181","resolution":{"observed_at":"2026-08-01T01:15:08.016418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-01T01:15:08.019104Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:08.019104Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:475fd03f235dff051757749fb53286043251c8d8e281e0354f9219f85f746aef","observation_id":"5bd9ee1d-28fa-4af5-aac0-a1fe9e9839f4","resolution":{"observed_at":"2026-08-01T01:15:08.019104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:15:08.021366Z","title":"A careful examination of large behavior models for multitask dexterous manipulation.Science Robotics, 11(113):eaea6201, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:08.021366Z"},"links":{"citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:8b112919ba2e18916511fa54797364864f140092efec5ee98f58188b080b7424","observation_id":"146e38cd-4f6b-4456-8ee0-bef8b44e30e5","resolution":{"observed_at":"2026-08-01T01:15:08.021366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-12T22:43:18.757224Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2607.25895."}