{"as_of":"2026-08-04T15:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cbdd3cb3ee704106bc3b96a356d20761d7853c171f21cde21ea29c0e93cf5518","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:36:23.197843Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:54:20.104031Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.10677","snapshot_observed_at":"2026-08-01T11:54:20.104031Z","title":"LIDEA: Human-to-robot imitation learning via implicit feature distillation and explicit geometry alignment.arXivpreprintarXiv:2604.10677, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19745","last_updated":"2026-07-23T16:20:02Z","snapshot_observed_at":"2026-08-01T11:54:12.094219Z","submitted_at":"2026-07-22T04:44:26Z","title":"EgoRecovery: Acquiring Failure Recovery Ability Through Human Recovery Demonstration","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T11:54:20.104031Z"},"links":{"cited_paper":"/paper/2604.10677","citing_paper":"/paper/2607.19745"},"observation_digest":"sha256:31859f30bcfaff601b29b4e89222db0bc076dacb4166188a3b0bc327b443ea52","observation_id":"67af477c-5b1b-4692-b6b5-3501432580d5","resolution":{"observed_at":"2026-08-01T11:54:20.104031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.10677/citation-record","integrity":"/paper/2604.10677/integrity","json":"/paper/2604.10677/citation-record.json","paper":"/paper/2604.10677"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":"1613c566-f90b-4e09-877f-e0a9863ba1a5","year":2024},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:f2c4380653d08f7c7b9f436da87b08f6b3acdb5aa7e746eec5ed5f72900bf880","observation_id":"3941fef2-64f0-4bf0-998a-d21f116c088b","resolution":{"observed_at":"2026-05-17T19:42:05.480489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15597","last_updated":"2025-07-21T13:19:09Z","snapshot_observed_at":"2026-07-06T22:00:23.912390Z","submitted_at":"2025-07-21T13:19:09Z","title":"Being-H0: Vision-Language-Action Pretraining from Large-Scale Human Videos","version":1},"cited_work":{"arxiv_id":"2507.15597","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.15597","snapshot_observed_at":"2026-07-10T04:16:48.668605Z","title":"Being-h0: vision-language-action pretraining from large-scale human videos","venue":"cs.CV","work_id":"5aebd66f-99a4-4264-a778-dd17abb8d446","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"cited_paper":"/paper/2507.15597","citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:19ecf6959ff153a28b82b599c8ded9e81e5f37bf58bf030692dbeaf5d5015a25","observation_id":"792b1e76-3bab-4a37-bf0e-e6655d513d82","resolution":{"observed_at":"2026-05-11T10:11:03.890345Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Airexo-2: Scaling up generalizable robotic imitation learning with low-cost exoskeletons","venue":null,"work_id":"72a8b47b-74ae-44ee-9088-83a70eb25f34","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:86d8f3b4390f2391b0d757263639e9849d1a39eea2e216009e9f5f17f9bde39d","observation_id":"f755dbfb-8825-42cf-b91a-7be92c29781b","resolution":{"observed_at":"2026-05-17T19:42:05.512216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Data scaling laws in imitation learning for robotic manipulation","venue":null,"work_id":"29de3d33-9913-4af6-8896-0f979090dbc7","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:3cb85630581d4e708d29797670e845e3473a0136159b9974da5546de871b474c","observation_id":"5fe3b5b5-122b-44a9-8128-6e253026f817","resolution":{"observed_at":"2026-05-17T19:42:05.528984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"π 0: A vision-language-action flow model for general robot control","venue":null,"work_id":"77611f5b-4fac-469e-ad13-cf97f8fb0981","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:dec2049fee2d7ef43b8e30c8afd88dc604cc0b5a61656b957d61e0ee775d7e92","observation_id":"d9980239-9177-44d7-8fb3-20439cd7e729","resolution":{"observed_at":"2026-05-17T19:42:05.518325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rh20t: A comprehensive robotic dataset for learning diverse skills in one-shot","venue":null,"work_id":"ca3168e3-526f-4029-8de1-715831ab6c77","year":2024},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:4925c9fb9ce1a07944f2665b80d8d576ef845c088324b672721118910a8b8764","observation_id":"a7850250-86f2-4d2b-9f43-fd4148ace0c9","resolution":{"observed_at":"2026-05-17T19:42:05.546019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robomind: Benchmark on multi-embodiment intelli- gence normative data for robot manipulation","venue":null,"work_id":"32ecf0d7-0110-4603-9eb9-7c4a2f39b9f6","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:fa80831fe791c322210549b019546bdd99b43a3fe34165272d490a48c7d5b411","observation_id":"cb228280-0514-4add-83f1-c7a4f20ea4af","resolution":{"observed_at":"2026-05-17T19:42:05.506554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Droid: A large-scale in-the-wild robot manip- ulation dataset","venue":null,"work_id":"f16ff553-5a45-4376-9062-a24700ffe6f1","year":2024},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:bc3cbce39173f049a3be1835953398f214629432ce58b2fb2d3fd80846251458","observation_id":"94be8688-51ee-4e70-b8b6-688e3593ae44","resolution":{"observed_at":"2026-05-17T19:42:05.485256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Taco: Benchmarking generalizable bimanual tool- action-object understanding","venue":null,"work_id":"329466a7-b0ff-4fcb-a61f-438870350655","year":2024},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:1bf365dab632b3600b0e81a954ca6403332733ba4afe685a235332dfce2a1c4b","observation_id":"2bf4a8b2-11fa-4748-8ee9-c7a1ab4de918","resolution":{"observed_at":"2026-05-17T19:42:05.497184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Oakink2: A dataset of bimanual hands-object manipulation in complex task completion","venue":null,"work_id":"1b21403a-ea6b-4df7-bd49-6a55d6d0ed1d","year":2024},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:573be66471c99c735e3216b01b4f5aeab7f47f3d5506b015b2cc2478ca3f7480","observation_id":"4304229c-8689-4f65-8258-96579398830d","resolution":{"observed_at":"2026-05-17T19:42:05.475838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OakInk: A large-scale knowledge repository for understanding hand-object interaction","venue":null,"work_id":"0ca948e5-b135-41be-a7aa-31706840546a","year":2022},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:0d222b7dae3f872dd4e1deb9bdb56d387caa1cded8956d391ec66262be71403e","observation_id":"0171e4f3-3380-430e-b78a-ffa8205dccf9","resolution":{"observed_at":"2026-05-17T19:42:05.522463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DexYCB: A benchmark for capturing hand grasping of objects","venue":null,"work_id":"9c8c5f62-dd01-4620-9bdc-b9fd3b1a9f51","year":2021},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:2d1d8475a10b6bb5c57a6fa6c3cb5e826bd6dd3e6721329ab8a9e50216465a92","observation_id":"11eeed79-4e1b-413c-8e14-6bc0794f5365","resolution":{"observed_at":"2026-05-17T19:42:05.449811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ego4d: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":"83c3420a-0eae-4ef2-a2cd-a62a4fbfc1a1","year":2022},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:a10eb48a9efeeaf229baae7e719f66c5ed89c58eae31c0aff7e5396c7bedc520","observation_id":"8f8b08b9-855b-4629-8805-9cf77a4aa6d6","resolution":{"observed_at":"2026-05-17T19:42:05.514877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.11920","doi":"10.48550/arxiv.2505.11920","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T18:47:31.659611Z","title":"H2r: A human-to-robot data augmentation for robot pre- training from videos","venue":null,"work_id":"762e40ad-e06b-414a-8451-01b0079c0dd2","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:8150ebf9e67805795157229c4aa2840043733e32af9ec0c7313409d6b4ace8b6","observation_id":"a9a8b939-9bf8-483a-b04d-bdb494dfd229","resolution":{"observed_at":"2026-05-11T10:11:03.901752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09976","last_updated":"2025-08-13T17:43:34Z","snapshot_observed_at":"2026-07-06T22:12:31.023627Z","submitted_at":"2025-08-13T17:43:34Z","title":"Masquerade: Learning from In-the-wild Human Videos using Data-Editing","version":1},"cited_work":{"arxiv_id":"2508.09976","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.09976","snapshot_observed_at":"2026-07-11T00:07:42.541771Z","title":"Masquerade: Learning from in-the-wild human videos using data-editing","venue":"cs.RO","work_id":"2e8fbb08-d6b8-40c4-891b-1483ca4c471d","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"cited_paper":"/paper/2508.09976","citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:e0a82b1a59ba6344b559822feddbc6170b9cec166b7d5b7d47cb2d60dde9e5d3","observation_id":"416a1d5b-d243-4075-ad91-716ec8917329","resolution":{"observed_at":"2026-05-29T02:04:55.330788Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Phantom: Training robots without robots using only human videos","venue":null,"work_id":"66b68d0b-da64-4513-a1af-edde3fdf01e8","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:c81949473894af65ecd1d268350434140dcc4d9051a27ed3f174e7087960b81c","observation_id":"512a1e3b-bfe6-46eb-81da-fa7bf6f290e4","resolution":{"observed_at":"2026-05-17T19:42:05.500107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AR2-D2: training a robot without a robot","venue":null,"work_id":"836dc608-3428-44d1-bb9c-937c0d31b04f","year":2023},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:3758e1bc3eacb7532244021a41ec07ea7a50baa729b2f3227c2d38c7e0b565a5","observation_id":"a850c922-64b2-4363-9a20-9a86d2bb9819","resolution":{"observed_at":"2026-05-17T19:42:05.542656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.22414","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T18:47:31.689903Z","title":"Emergence of human to robot transfer in vision-language-action models.arXiv preprint arXiv:2512.22414","venue":null,"work_id":"88fc3778-faad-4626-887f-92a4c4e91800","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:cb674f94399faaf71375379d2f660639af5767eb202b9524ffeca0969ab878bf","observation_id":"5d0db213-e176-4815-95a0-571f29016792","resolution":{"observed_at":"2026-05-11T10:11:03.910466Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Egomimic: Scaling imitation learning via egocentric video","venue":null,"work_id":"9453e9a4-23ff-4d0f-838c-95b753b0f043","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:7dc656d94728724d8f160dc5db04c5e0cc99e8d18f7d7f732cb1997bb6589a4d","observation_id":"2aee3763-1a2e-42f2-9c15-65bfa3df68b8","resolution":{"observed_at":"2026-05-17T19:42:05.478992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Humanoid policy ˜ human policy","venue":null,"work_id":"76d3b5b5-3c9a-4e5a-9cc4-22431288932b","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:0fc5f93cdee35a0d0167f95b2f16972fdec3d53ed2f989c554be25cafd199164","observation_id":"256378bd-56c2-4e95-b54e-0812c74afaee","resolution":{"observed_at":"2026-05-17T19:42:05.443304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12440","last_updated":"2025-07-18T07:18:39Z","snapshot_observed_at":"2026-07-06T21:58:13.740929Z","submitted_at":"2025-07-16T17:27:44Z","title":"EgoVLA: Learning Vision-Language-Action Models from Egocentric Human Videos","version":3},"cited_work":{"arxiv_id":"2507.12440","doi":"10.48550/arxiv.2507.12440","metadata_source":"pith","pith_arxiv_id":"2507.12440","snapshot_observed_at":"2026-07-10T18:47:31.662408Z","title":"EgoVLA: Learning Vision-Language-Action Models from Egocentric Human Videos","venue":"cs.RO","work_id":"14ae45e8-e465-4230-99bf-0a2a191dabfd","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"cited_paper":"/paper/2507.12440","citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:24772bab65aa21562b2937b2b678b0874fc8fd8327ea7d7d8ca5e68febd21768","observation_id":"2f849ef2-1c7a-4974-be45-c6cf61e388d2","resolution":{"observed_at":"2026-05-21T04:32:58.962571Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Univla: Learning to act anywhere with task-centric latent actions","venue":null,"work_id":"c11e0578-9289-40c4-978e-8d9d81fb4983","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:c7273621ab750b59881e323acd1e788b6517a39aa2031a303bd59fdde1622819","observation_id":"d29a1cae-e256-4c61-bddd-c1cc9eec44c9","resolution":{"observed_at":"2026-05-17T19:42:05.456459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Latent action pretraining from videos","venue":null,"work_id":"ccfcb7ff-2f79-4ce8-95fc-ea09ade5f5d3","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:6fd85ca29c0457e6ecb931bf1b40ec6740d093f7346e3e373814f10dd78d880b","observation_id":"afa1b9c1-131f-4115-b3a1-a9e909790b3f","resolution":{"observed_at":"2026-05-17T19:42:05.494175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Moto: Latent motion token as the bridging language for learning robot manipulation from videos","venue":null,"work_id":"29333d64-9d1c-4670-a297-1d895d053274","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:d8d219e02dc9e12dd9ee832b1eb38bf3ffabc386e147e10d5449e96aab9b5b47","observation_id":"29ffa3af-ec0c-4ecb-82ea-0e6b8f377755","resolution":{"observed_at":"2026-05-17T19:42:05.531756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mimicplay: Long-horizon imitation learning by watching human play","venue":null,"work_id":"36185fef-f8f6-4431-bc06-b20dd62cc26a","year":2023},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:8f9c58f11c60303ed849645c2718c69c6c4cab806e059a54f76b63658a68245e","observation_id":"39e11551-b418-45cd-a60d-932d263b3fd9","resolution":{"observed_at":"2026-05-17T19:42:05.549326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ViViDex: Learning vision-based dexterous manipulation from human videos","venue":null,"work_id":"f2265b3f-cf41-45fc-9518-c8c6a310bde5","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:7bbcc579523afd85839aaa25a65cf94f7f0cfea122f6a6ea4d30ec30d86b304b","observation_id":"4a09ee17-e49a-4193-95b5-a16e33e2b548","resolution":{"observed_at":"2026-05-17T19:42:05.574822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vidbot: Learning generalizable 3d actions from in-the-wild 2d human videos for zero-shot robotic manipulation","venue":null,"work_id":"98b1f1a2-ed7a-4d59-a48c-c2d0d822af35","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:9afc43cff8436735d1feb914f2875cddfd0713af43dffa726393f955319c739f","observation_id":"3b079b06-8263-496f-86de-7eaa3a251f79","resolution":{"observed_at":"2026-05-17T19:42:05.463957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zeromimic: Distilling robotic manipulation skills from web videos","venue":null,"work_id":"6af4e1b6-6d75-4494-a49c-15ac90ca1ed5","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:554a1576a4b1103567d339f4125be8a76c096bb0bea11cd9065ab3ad2410c4c5","observation_id":"568091b5-4891-4ec5-8f4b-3b8733d678f2","resolution":{"observed_at":"2026-05-17T19:42:05.459542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Affordances from human videos as a versatile representation for robotics","venue":null,"work_id":"a55f83cf-3daa-4e3d-9238-7637061b1633","year":2023},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:c0d6da2babed8040edaa79753821974405c46fca0cc24c2e7d4e2b2e44bb38b9","observation_id":"8f02b45c-42bb-496e-a423-efab5307458a","resolution":{"observed_at":"2026-05-17T19:42:05.567498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":"2508.10104","doi":"10.1055/a-2487-1252","metadata_source":"pith","pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DINOv3","venue":"cs.CV","work_id":"c8b07deb-8fe7-4e18-9620-f3569d3529ce","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:9e5645733c68b9f4698418dff761c2e412cdb2dfd0265b6d29dd037f5761037e","observation_id":"80f1abf7-ec1b-4e46-a41d-9742046cee8c","resolution":{"observed_at":"2026-05-11T10:11:03.937349Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"X-diffusion: Training diffusion policies on cross- embodiment human demonstrations","venue":null,"work_id":"815881a4-913e-42cc-bf14-e1c15447bcbb","year":2026},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:647f2eb9c475752ae3d1e2ebdf8bd164b3d385d944ba4c1f0d61800152973691","observation_id":"56d46e99-0e1a-42bc-81f9-3f62040197bf","resolution":{"observed_at":"2026-05-17T19:42:05.477914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep imitation learning for complex manipulation tasks from virtual reality teleoperation","venue":null,"work_id":"4ab8cd7a-be21-488f-9b3b-19b438432086","year":2018},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:af3afd72d705854fe338ac336e23ab9bd06040e566a8bf05c561e6119e876106","observation_id":"6669ea4f-a141-4ff5-8fcc-876a461a2e87","resolution":{"observed_at":"2026-05-17T19:42:05.439811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The surprising effectiveness of representation learning for visual imitation","venue":null,"work_id":"8df8c9f1-ed02-41cd-ba61-3e50f19139e2","year":2022},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:7d01c6cc7c7b5f20999928fbe57018adeb23815df2b3c7d26d85ad370bbda216","observation_id":"45ace35f-cb12-457e-840d-f2c60307588d","resolution":{"observed_at":"2026-05-17T19:42:05.453909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"R3M: A universal visual representation for robot manipulation","venue":null,"work_id":"4794c32a-5b76-468a-8e46-88ef6bec1f37","year":2022},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:8214c78fbfe3fbf4bf67d4e45be3ca98ffcd2e23a66a98320d4ab5f32cbb9689","observation_id":"7da78a45-f978-4693-aca9-0fd5eac66617","resolution":{"observed_at":"2026-05-17T19:42:05.552058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LIV: language-image representations and rewards for robotic control","venue":null,"work_id":"fcd4fd6b-3fdc-432d-9286-d87a2bb3d2b5","year":2023},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:07772740a61f4043159c3dcb57eb12852d77a65dae827d8611067d00d79b02db","observation_id":"4472963e-0834-42ba-8379-8c938de6694e","resolution":{"observed_at":"2026-05-17T19:42:05.482309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"VIP: towards universal visual reward and representation via value-implicit pre-training","venue":null,"work_id":"7cb3eaa2-f999-47b4-a4a0-089a662d8ea5","year":2023},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:4b66d5c60ee82840a63a2c14ae4c1b744c4897237c848a11f10f00b71479e851","observation_id":"a0538adc-f5b6-46dd-87c3-663021737fe6","resolution":{"observed_at":"2026-05-17T19:42:05.557468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Real-world robot learning with masked visual pre-training","venue":null,"work_id":"69059a66-2f15-4b35-b1a4-ef0a503dbf25","year":2022},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:fcacfb9e6b7ba91c94d22d19c36220fb1022070ba3058e7985e9ee7616c463a2","observation_id":"1f353144-343e-4793-8e93-6a3ff7102fe8","resolution":{"observed_at":"2026-05-17T19:42:05.564248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"dc094ddf-36c5-4330-af17-a885caa3aef1","year":2021},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:8e662f97f785b9e0ea05ec4d6041ebeb1ad7f97e435471e493f6d833ac26d604","observation_id":"a9ed8a37-057d-4d90-9249-914e5b34661d","resolution":{"observed_at":"2026-05-17T19:42:05.538428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":"7eda3f40-b092-47ac-bed1-3816ed9d04b2","year":2024},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:ade3cd252cd6d700cad445283eb5d6e9310afced2fc0e6534408c764b9c710a0","observation_id":"1c059970-cac1-4566-865a-7de8613e92e3","resolution":{"observed_at":"2026-05-17T19:42:05.560976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"2db0940a-9c6f-4d05-86c2-ccc661b875da","year":2022},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:0ac6cdc404901dbb7e0fc9351b308bf3406ba5a0519734bc93caaec65caaf8d0","observation_id":"bf77b21c-ffbf-4a65-a6d0-e78aa8beff10","resolution":{"observed_at":"2026-05-17T19:42:05.488396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cage: Causal attention enables data-efficient generalizable robotic manipulation","venue":null,"work_id":"5e2ab60e-420a-4a9e-b8e0-92b8f8679b14","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:af1ba45b23befa4de79f655165e2867db45b62884b5063436a421efb80e7f8a1","observation_id":"09a69b01-ceae-4a76-8a2a-7ea62db034bb","resolution":{"observed_at":"2026-05-17T19:42:05.472057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":"7ef30464-ff8c-456e-96fa-e4a67e72e9b1","year":2024},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:8bbf15ff376508f136a3014540f8affe833dad174f470071728a9303a3568848","observation_id":"b9c69c93-7e6b-4b96-8598-eb8a880bf777","resolution":{"observed_at":"2026-05-17T19:42:05.491140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.11934","last_updated":"2026-06-08T09:01:34Z","snapshot_observed_at":"2026-08-04T13:02:28.723589Z","submitted_at":"2026-02-12T13:30:24Z","title":"Robot-DIFT: Correspondence-Sensitive Diffusion Features for Contact-Rich Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2602.11934","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.11934","snapshot_observed_at":"2026-06-09T03:07:11.470849Z","title":"Robot-dift: Distilling diffusion features for geometrically consistent visuomotor control","venue":null,"work_id":"17fa86af-5c3e-4233-9da0-f1c4871066b1","year":2026},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"cited_paper":"/paper/2602.11934","citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:ca72942f40343090122ebde4666a3a31215aea0b9aa0b528721fd06925b851f3","observation_id":"a5fcab8a-e620-4248-ab31-a0e9fc3df029","resolution":{"observed_at":"2026-06-09T03:07:11.470849Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gnfactor: Multi-task real robot learning with general- izable neural feature fields","venue":null,"work_id":"d2144d94-3ddd-434a-abb7-b238d6aa7a22","year":2023},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:907ced6fa72fb270e9e25fac49d52a96167291c4bc3ae539e5ff1f6f132836a4","observation_id":"d94e07cb-f2ed-4d53-a322-e97e882a07c1","resolution":{"observed_at":"2026-05-17T19:42:05.509537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SAM-E: leveraging visual foundation model with sequence imitation for embodied manipulation","venue":null,"work_id":"7161e3be-2634-429e-8734-b05cbd95d4ce","year":2024},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:49596faca461f7b1b354949822735f44b322860bf55c6b356161e0ce4de4ecd7","observation_id":"55c47b8f-f327-4d82-8dbd-4ff6f7d979c1","resolution":{"observed_at":"2026-05-17T19:42:05.453158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spawnnet: Learning generalizable visuomotor skills from pre-trained network","venue":null,"work_id":"cbe58a35-c1f9-460b-b994-aa4f9b7ca8b5","year":2024},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:eb4d0c30a39502f87a79be05b955fa7aa182ffe21fa2dfa197d643bb2f912bde","observation_id":"353280cd-a49c-4955-a82b-72ccf2ed27ba","resolution":{"observed_at":"2026-05-17T19:42:05.571372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recasting generic pretrained vision transformers as object-centric scene encoders for manipulation policies","venue":null,"work_id":"987a7605-a672-45f2-a51c-72ca9a1a37da","year":2024},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:714a9984a8ac9d4fe81fb07d2dd24f04d399b86d07bd03636bb913f19127f5fe","observation_id":"8ac2a8b8-7954-4970-899a-8655c09f5502","resolution":{"observed_at":"2026-05-17T19:42:05.462435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":"7b4178d9-5491-4564-a19e-8b7b0223e5de","year":2021},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:432a4d56bc465ddacbba563228bed9ad6516881deb12b811dc7e66ccdba0ee53","observation_id":"f283615d-bf94-49ff-9622-d4e4bbf12879","resolution":{"observed_at":"2026-05-17T19:42:05.526227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Propainter: Improving propagation and transformer for video inpainting","venue":null,"work_id":"b372843c-aa0a-400a-9eaf-cb623e4f9472","year":2023},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:b3e468ddb3c95d08878e439e5ad8dd7fb00489d1e5c3d709cc9ab40cc946a3e7","observation_id":"7d6bc277-e28e-48f5-b72b-4e0f35ddae03","resolution":{"observed_at":"2026-05-17T19:42:05.535049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":"2401.14159","doi":"10.48550/arxiv.2401.14159","metadata_source":"pith","pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-07-10T08:06:57.771425Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","venue":"cs.CV","work_id":"42c46ece-c4e8-4d5e-abae-f8d5b4208995","year":2024},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:8ea1227b277d367863a247f10fb342ec07797209920d141592ca6030c816e5b8","observation_id":"b5284360-4acd-42ed-ae5c-d73e26a84faf","resolution":{"observed_at":"2026-05-11T10:11:03.882518Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-view hand reconstruction with a point- embedded transformer","venue":null,"work_id":"3fd08c79-929d-47a4-acca-ffb5185fec86","year":2025},"citing_paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:23.197843Z"},"links":{"citing_paper":"/paper/2604.10677"},"observation_digest":"sha256:5d810325f8d5d22d799bc8eb033e38406bafeea878f89686f85aff9a7a6dbf2a","observation_id":"9d340648-6b4d-4af0-b528-e43b0d83f2e9","resolution":{"observed_at":"2026-05-17T19:42:05.503815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.10677","last_updated":"2026-04-12T15:02:34Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:02:34Z","title":"LIDEA: Human-to-Robot Imitation Learning via Implicit Feature Distillation and Explicit Geometry Alignment"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":7,"verified_fuzzy":43},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2604.10677."}