{"as_of":"2026-08-17T13:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:89d7612ec4240245adddcb789c7f3619be84bd4516e69511761fe66d281bcec7","coverage":[{"denominator":107,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:25:28.471501Z","state":"measured"},{"denominator":109,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":109,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-15T12:36:50.019492Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T06:49:38.593885Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"cited_work":{"arxiv_id":"2506.14198","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14198","snapshot_observed_at":"2026-07-04T06:49:38.593885Z","title":"Available: https://arxiv.org/abs/2506.14198","venue":null,"work_id":"48973c96-9e86-49e6-89c5-ed0b22846f94","year":2025},"citing_paper":{"arxiv_id":"2512.13030","last_updated":"2025-12-25T08:16:05Z","snapshot_observed_at":"2026-08-16T22:05:17.066613Z","submitted_at":"2025-12-15T06:58:40Z","title":"Motus: A Unified Latent Action World Model","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T18:44:36.636455Z"},"links":{"cited_paper":"/paper/2506.14198","citing_paper":"/paper/2512.13030"},"observation_digest":"sha256:4bf486487f7a8627c96aa03872a3ffe7115afcfe9e7c79755cbc6909c4d73f81","observation_id":"03073101-ad62-4ce1-881e-0d6019ae5e98","resolution":{"observed_at":"2026-05-12T18:44:36.752916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"cited_work":{"arxiv_id":"2506.14198","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14198","snapshot_observed_at":"2026-07-04T06:49:38.593885Z","title":"Available: https://arxiv.org/abs/2506.14198","venue":null,"work_id":"48973c96-9e86-49e6-89c5-ed0b22846f94","year":2025},"citing_paper":{"arxiv_id":"2602.20231","last_updated":"2026-04-09T04:26:01Z","snapshot_observed_at":"2026-08-15T02:14:17.838458Z","submitted_at":"2026-02-23T18:41:41Z","title":"UniLACT: Depth-Aware RGB Latent Action Learning for Vision-Language-Action Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T20:18:31.988002Z"},"links":{"cited_paper":"/paper/2506.14198","citing_paper":"/paper/2602.20231"},"observation_digest":"sha256:eea63d75685ab2c7b056fb4fa7f828fd5299fbad56536b3676e04b633bc03972","observation_id":"81a9085d-bddf-4715-8732-5984654e126c","resolution":{"observed_at":"2026-05-15T20:20:17.670635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14198","snapshot_observed_at":"2026-07-15T12:36:50.019492Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08485","last_updated":"2026-06-03T01:20:45Z","snapshot_observed_at":"2026-08-15T15:11:25.852898Z","submitted_at":"2026-03-09T15:20:26Z","title":"3PoinTr: 3D Point Tracks for Learning Manipulation from Unconstrained Human Videos","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-15T12:36:50.019492Z"},"links":{"cited_paper":"/paper/2506.14198","citing_paper":"/paper/2603.08485"},"observation_digest":"sha256:95ccd453d8c2f42bde22815276353b1b5cb28fb3e8b1e99c1e7ca4717a308475","observation_id":"2ac53cea-1375-4419-ad83-b290398fd322","resolution":{"observed_at":"2026-07-15T12:36:50.019492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"cited_work":{"arxiv_id":"2506.14198","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14198","snapshot_observed_at":"2026-07-04T06:49:38.593885Z","title":"Available: https://arxiv.org/abs/2506.14198","venue":null,"work_id":"48973c96-9e86-49e6-89c5-ed0b22846f94","year":2025},"citing_paper":{"arxiv_id":"2604.11737","last_updated":"2026-04-13T17:14:47Z","snapshot_observed_at":"2026-08-13T00:36:03.853913Z","submitted_at":"2026-04-13T17:14:47Z","title":"Learning Long-term Motion Embeddings for Efficient Kinematics Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T15:55:26.222900Z"},"links":{"cited_paper":"/paper/2506.14198","citing_paper":"/paper/2604.11737"},"observation_digest":"sha256:a16a0aa831ae5aa8ef2acb9679bb29e894b083e3b1171b876a83b1b4bdec11b6","observation_id":"1aeb539c-e694-48c9-91ee-29bf2a3e458f","resolution":{"observed_at":"2026-05-11T09:36:04.882205Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"cited_work":{"arxiv_id":"2506.14198","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14198","snapshot_observed_at":"2026-07-04T06:49:38.593885Z","title":"Available: https://arxiv.org/abs/2506.14198","venue":null,"work_id":"48973c96-9e86-49e6-89c5-ed0b22846f94","year":2025},"citing_paper":{"arxiv_id":"2605.12167","last_updated":"2026-05-12T14:15:16Z","snapshot_observed_at":"2026-08-11T13:33:40.884997Z","submitted_at":"2026-05-12T14:15:16Z","title":"From Imagined Futures to Executable Actions: Mixture of Latent Actions for Robot Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T04:44:03.661688Z"},"links":{"cited_paper":"/paper/2506.14198","citing_paper":"/paper/2605.12167"},"observation_digest":"sha256:b57b98dea9ba7cc28bd07b5aac8fcdedc41a08a4ac1aacf1a28e4272af8e7ec9","observation_id":"bec272ba-fdcd-48dd-b8ae-53062c9d06f6","resolution":{"observed_at":"2026-05-13T05:12:18.270681Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"cited_work":{"arxiv_id":"2506.14198","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14198","snapshot_observed_at":"2026-07-04T06:49:38.593885Z","title":"Available: https://arxiv.org/abs/2506.14198","venue":null,"work_id":"48973c96-9e86-49e6-89c5-ed0b22846f94","year":2025},"citing_paper":{"arxiv_id":"2606.10025","last_updated":"2026-06-08T18:08:01Z","snapshot_observed_at":"2026-08-06T17:31:29.409416Z","submitted_at":"2026-06-08T18:08:01Z","title":"GHOST: Hierarchical Sub-Goal Policies for Generalizing Robot Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T16:10:40.130366Z"},"links":{"cited_paper":"/paper/2506.14198","citing_paper":"/paper/2606.10025"},"observation_digest":"sha256:9aa04a934567bcd8c6650e6942800e456b360bbfa390c6112bd6f91a535b554f","observation_id":"189197f9-3f58-4b5d-82e8-cbf428f593ec","resolution":{"observed_at":"2026-07-03T02:07:33.581277Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"cited_work":{"arxiv_id":"2506.14198","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14198","snapshot_observed_at":"2026-07-04T06:49:38.593885Z","title":"Available: https://arxiv.org/abs/2506.14198","venue":null,"work_id":"48973c96-9e86-49e6-89c5-ed0b22846f94","year":2025},"citing_paper":{"arxiv_id":"2606.11628","last_updated":"2026-06-10T03:49:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-10T03:49:01Z","title":"LUCID: Learning Embodiment-Agnostic Intent Models from Unstructured Human Videos for Scalable Dexterous Robot Skill Acquisition","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-27T10:02:54.183839Z"},"links":{"cited_paper":"/paper/2506.14198","citing_paper":"/paper/2606.11628"},"observation_digest":"sha256:3663978ab08aec62371c54279218a128bb896281950c9541dbef44dbc5d7b127","observation_id":"ab62b0f5-ef91-4a9e-916b-b2ba9f9a284c","resolution":{"observed_at":"2026-07-03T10:27:56.241904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"cited_work":{"arxiv_id":"2506.14198","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14198","snapshot_observed_at":"2026-07-04T06:49:38.593885Z","title":"Available: https://arxiv.org/abs/2506.14198","venue":null,"work_id":"48973c96-9e86-49e6-89c5-ed0b22846f94","year":2025},"citing_paper":{"arxiv_id":"2606.21672","last_updated":"2026-06-19T18:23:24Z","snapshot_observed_at":"2026-08-13T18:27:49.945694Z","submitted_at":"2026-06-19T18:23:24Z","title":"Imitation from Heterogeneous Demonstrations using Grounded Latent-Action World Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T14:07:31.139419Z"},"links":{"cited_paper":"/paper/2506.14198","citing_paper":"/paper/2606.21672"},"observation_digest":"sha256:aa38aaccfce7f9ab23c2c433b1558c4a9df3a7167f7139b7fe7ca0f148dd8397","observation_id":"c4a58cc9-70a5-47d4-af95-cf0eabeb0258","resolution":{"observed_at":"2026-07-04T06:49:38.595394Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"cited_work":{"arxiv_id":"2506.14198","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14198","snapshot_observed_at":"2026-07-04T06:49:38.593885Z","title":"Available: https://arxiv.org/abs/2506.14198","venue":null,"work_id":"48973c96-9e86-49e6-89c5-ed0b22846f94","year":2025},"citing_paper":{"arxiv_id":"2606.30749","last_updated":"2026-06-29T18:00:22Z","snapshot_observed_at":"2026-08-14T11:31:05.346074Z","submitted_at":"2026-06-29T18:00:22Z","title":"From Grasps to Dexterity: Large-Scale Grasp Pretraining for Dexterous Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-01T01:59:30.986555Z"},"links":{"cited_paper":"/paper/2506.14198","citing_paper":"/paper/2606.30749"},"observation_digest":"sha256:1705d17d122fba2fef27b44bddee23245699b18efd72b5c6cd19cf86afdcd40a","observation_id":"32724300-c32f-40e6-aa7c-4384bade8bf7","resolution":{"observed_at":"2026-07-01T12:35:43.635328Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.14198/citation-record","integrity":"/paper/2506.14198/integrity","json":"/paper/2506.14198/citation-record.json","paper":"/paper/2506.14198"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:27.593968Z","title":"Radford, J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:27.593968Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:da723de4a150f953f40895edd847ad06cd729eb4d5ea1e49d46de9456e46b573","observation_id":"8b3aad6c-1d6e-46b0-96b0-76df9ac5fb44","resolution":{"observed_at":"2026-08-07T00:25:27.593968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:27.669934Z","title":"Brown, B","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:27.669934Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:f8bba611d28dac4c7c194d35a8a97aa0addeaa27adc3177320d10ce548713e65","observation_id":"39601ffb-ca5a-4885-b4f7-da99692e8132","resolution":{"observed_at":"2026-08-07T00:25:27.669934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T00:25:27.815991Z","title":"Achiam, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:27.815991Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:7572fe17c5cebc072e089daa91aedff2bfea73ad0308f22113fa857979ae0039","observation_id":"5442b651-0ed0-4fab-9784-633845d4ecad","resolution":{"observed_at":"2026-08-07T00:25:27.815991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-07T00:25:27.902920Z","title":"Radford, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:27.902920Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:61926c539d264f2a57aa91616738ff2215ce93701b1f48e4ffef07f73dac6b07","observation_id":"853e4ade-bb51-4f71-ab9d-7ff1c5a0a1e8","resolution":{"observed_at":"2026-08-07T00:25:27.902920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T00:25:28.018812Z","title":"Ramesh, P","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.018812Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:3d95d63b8896f1adfb9487e6d3f05b80c242498d23ee2332373d7cf7cf2959f9","observation_id":"02aa9f57-9fbd-479c-b7f4-dd83873e3ddc","resolution":{"observed_at":"2026-08-07T00:25:28.018812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.063056Z","title":"Rombach, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.063056Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:d31abe7e20c4cb6da1a5ca0a5e0934d7d529b03062e84d82c77df09a350ac677","observation_id":"c6fb3173-b396-4884-a01c-7e3f1c15e28a","resolution":{"observed_at":"2026-08-07T00:25:28.063056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.067300Z","title":"Brohan, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.067300Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:3200a627801f8fcd0a4167f7ac6f336ddec32bb7b77ea400585f67d848d32470","observation_id":"746525de-9a57-459d-af63-9e067ca0a54b","resolution":{"observed_at":"2026-08-07T00:25:28.067300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-07T00:25:28.072029Z","title":"Brohan, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.072029Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:0ed844df1780cb8b2915798d7ad85bad4222657592c57907703f6eb3d74424a2","observation_id":"d045f5c4-ccf9-4ee8-8cdb-2847663e5080","resolution":{"observed_at":"2026-08-07T00:25:28.072029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T00:25:28.076130Z","title":"Padalkar, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.076130Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:858d7652c4c8cf07970b4128bf494d7442b3b7db1b2a5690aca6c7e4fcba9286","observation_id":"5337d0bd-77d1-41ac-9fec-524467fbb5ed","resolution":{"observed_at":"2026-08-07T00:25:28.076130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-07T00:25:28.083937Z","title":"Pertsch, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.083937Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:feb302c165956b47d352a08c8ea97e24702c8e8a75a3ca5ce2bff026669232df","observation_id":"e4232af9-561a-4349-9520-40efa53bba07","resolution":{"observed_at":"2026-08-07T00:25:28.083937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19417","last_updated":"2025-07-15T17:44:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T18:58:41Z","title":"Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19417","snapshot_observed_at":"2026-08-07T00:25:28.088001Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.088001Z"},"links":{"cited_paper":"/paper/2502.19417","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:64933abbc7bb86debc44a3ace3c8007de0b006aa26ea94e6f76b0b452ff9205f","observation_id":"50fff49b-d856-493c-b8bc-365a27a9be6f","resolution":{"observed_at":"2026-08-07T00:25:28.088001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.092119Z","title":"Khazatsky, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.092119Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:2dae10e587feac911ba4a85b92d79b3e86e01989583704bd907c983dbad15dca","observation_id":"e2e275dc-7d78-48d9-8b5d-c70159892c67","resolution":{"observed_at":"2026-08-07T00:25:28.092119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.096080Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.096080Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:1cfcd4ae6fca92d77fcaeab334a134cf1b8e9fc01de6092a2a77475a2dccbc7b","observation_id":"0cfa4895-416c-4986-bf2e-5e44673e0129","resolution":{"observed_at":"2026-08-07T00:25:28.096080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-08-16T17:53:54.636855Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-07T00:25:28.105018Z","title":"Black, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.105018Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:682a0c7f526da1f0dbd0b5972a258bd1e7511d79b11abecbb6d9117e03c529d7","observation_id":"16b9decd-2744-4b7e-8905-544e4907414d","resolution":{"observed_at":"2026-08-07T00:25:28.105018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-16T15:58:41.194108Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-07T00:25:28.108940Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.108940Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:f85ef1ea30f429ea53d23c08ebe9198f36d56bac34db2c8549d893466edb94db","observation_id":"dafbd3bb-7d01-4076-9430-a23b7871403e","resolution":{"observed_at":"2026-08-07T00:25:28.108940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19664","last_updated":"2025-07-23T17:31:03Z","snapshot_observed_at":"2026-08-16T13:56:33.034814Z","submitted_at":"2024-04-30T15:57:41Z","title":"Towards Generalist Robot Learning from Internet Video: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19664","snapshot_observed_at":"2026-08-07T00:25:28.112861Z","title":"McCarthy, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.112861Z"},"links":{"cited_paper":"/paper/2404.19664","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:c89c90ab53ab6373424cfe6626d6384fd54ac931d7bff1f656d7dede958621de","observation_id":"8c9cedf9-8a99-467c-b880-c2c175e13c83","resolution":{"observed_at":"2026-08-07T00:25:28.112861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.09655","last_updated":"2019-02-12T18:53:33Z","snapshot_observed_at":"2026-08-14T18:59:26.062996Z","submitted_at":"2018-06-25T18:33:34Z","title":"Learning what you can do before doing anything","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.09655","snapshot_observed_at":"2026-08-07T00:25:28.117022Z","title":"Rybkin, K","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.117022Z"},"links":{"cited_paper":"/paper/1806.09655","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:255d8a117fc105df6cab7eb0160c2693e2d979437eda7d48154f0a235a54a8e6","observation_id":"044a86d5-a516-40e0-b037-e3f380d0c936","resolution":{"observed_at":"2026-08-07T00:25:28.117022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T00:25:28.121151Z","title":"Agarwal, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.121151Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:9866c9472277861a179d184c4d94d5fd6923d512da793a7b4fce82205b13c9a1","observation_id":"8a349e2f-cf44-4191-9e88-63c8540fcb83","resolution":{"observed_at":"2026-08-07T00:25:28.121151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-07T00:25:28.125457Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.125457Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:507a8097e47db17ed376f72f4b43d2de43dd63b16a39933f8ce2cc725a5c85b6","observation_id":"d796bb6b-cd85-4966-b74c-efca686e2f40","resolution":{"observed_at":"2026-08-07T00:25:28.125457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T00:25:28.129658Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.129658Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:476bf36a310c2dbb6489d1fa152b128155a732a3b9e7407fba4239d32bb556b0","observation_id":"b9ac875a-015a-4e05-ab9e-03f52e184a0a","resolution":{"observed_at":"2026-08-07T00:25:28.129658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.133369Z","title":"Gupta, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.133369Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:e5cedd8a0aed5ea5c8da5d3fe5e8a2c0d9f71f96373387ef4e4e2d369174ddcd","observation_id":"59604b75-c5dd-4f6c-9c5a-e5581b8a0817","resolution":{"observed_at":"2026-08-07T00:25:28.133369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.137478Z","title":"Bar-Tal, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.137478Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:47ceb71b3429f7ec26b42103d0b395aa40f3b6a20bad6b29a4f0b71114284407","observation_id":"f5d7a022-fa48-4961-b8b0-1e2e56423612","resolution":{"observed_at":"2026-08-07T00:25:28.137478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00030","last_updated":"2023-03-07T02:29:59Z","snapshot_observed_at":"2026-08-11T15:42:16.204049Z","submitted_at":"2022-09-30T18:14:07Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00030","snapshot_observed_at":"2026-08-07T00:25:28.141151Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.141151Z"},"links":{"cited_paper":"/paper/2210.00030","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:b11351f4f9cc84bd8ed708b7c27207872dc96657a536087d29ebdf6870ba51e1","observation_id":"fdd89846-b552-4e0b-9aff-a642fd0b888b","resolution":{"observed_at":"2026-08-07T00:25:28.141151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04782","last_updated":"2023-04-10T17:59:05Z","snapshot_observed_at":"2026-08-16T15:41:30.704517Z","submitted_at":"2023-04-10T17:59:05Z","title":"Reinforcement Learning from Passive Data via Latent Intentions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04782","snapshot_observed_at":"2026-08-07T00:25:28.144946Z","title":"Ghosh, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.144946Z"},"links":{"cited_paper":"/paper/2304.04782","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:0b092c00ded47d1d5f26792fc500b32509d2707e985d7e3c5514799196402b24","observation_id":"db31a9ec-8b6b-4ee6-b844-3eccaff92e3e","resolution":{"observed_at":"2026-08-07T00:25:28.144946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.149408Z","title":"Bhateja, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.149408Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:fb3ed97c2ceb685402840691f055785b1e496aeae7282ed51cebe37dc195a28d","observation_id":"99f37947-6aea-4362-b875-eee0fe866f1e","resolution":{"observed_at":"2026-08-07T00:25:28.149408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18210","last_updated":"2025-03-23T21:24:33Z","snapshot_observed_at":"2026-08-16T12:47:32.981203Z","submitted_at":"2025-03-23T21:24:33Z","title":"ViVa: Video-Trained Value Functions for Guiding Online RL from Diverse Data","version":1},"cited_work":{"arxiv_id":"2503.18210","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18210","snapshot_observed_at":"2026-08-07T00:25:29.369775Z","title":"ViVa: Video-Trained Value Functions for Guiding Online RL from Diverse Data","venue":"cs.LG","work_id":"f4e0b3c3-e08b-4937-bca9-342dd5738534","year":2025},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.157959Z"},"links":{"cited_paper":"/paper/2503.18210","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:865a01a708a42c7d857d7b5e4995652c9c6de3c69169b883af186e00fe70fda2","observation_id":"f6057d1f-ce9e-41ff-8251-9f82f43c3972","resolution":{"observed_at":"2026-08-07T00:25:29.374622Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.162396Z","title":"Sermanet, C","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.162396Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:1da9f536e0bfff2663f8bc7e67333f577394c683f611896b012ab8f577430b09","observation_id":"704e9cac-8109-4455-9c54-e5774e486e63","resolution":{"observed_at":"2026-08-07T00:25:28.162396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12601","last_updated":"2022-11-18T05:57:09Z","snapshot_observed_at":"2026-08-11T08:36:53.636356Z","submitted_at":"2022-03-23T17:55:09Z","title":"R3M: A Universal Visual Representation for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12601","snapshot_observed_at":"2026-08-07T00:25:28.166338Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.166338Z"},"links":{"cited_paper":"/paper/2203.12601","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:801e337bdfcf720556f3abb95ad247783d8ec9819bcc9b2dc6f82c206cd24ad1","observation_id":"316a6ef9-7c90-46f5-91f3-7ec51b7b3384","resolution":{"observed_at":"2026-08-07T00:25:28.166338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.170370Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.170370Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:5f4c7defa2b8a844cf8666af332df6830268627df8eada8af46374071df1bb73","observation_id":"a1c6d0ae-5b58-4a4f-b37a-6ab63ea7ebef","resolution":{"observed_at":"2026-08-07T00:25:28.170370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14803","last_updated":"2025-05-04T04:28:53Z","snapshot_observed_at":"2026-08-13T21:27:22.538668Z","submitted_at":"2024-12-19T12:48:40Z","title":"Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14803","snapshot_observed_at":"2026-08-07T00:25:28.174788Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.174788Z"},"links":{"cited_paper":"/paper/2412.14803","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:1f6f5cf6311f133f9a97d018e55bd7f180ecb2f6e5cd866c93f23e2424b01848","observation_id":"4d3fd4b6-f2e8-4117-912b-afd291408820","resolution":{"observed_at":"2026-08-07T00:25:28.174788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.179124Z","title":"Bruce, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.179124Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:a517d19ddca440c06b54004bdfc379173269d6f4349c0c156aa7e2d3b75795da","observation_id":"94c0abf3-1d0a-44f3-8d84-085d7f3d9dcf","resolution":{"observed_at":"2026-08-07T00:25:28.179124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11758","last_updated":"2025-05-15T12:13:37Z","snapshot_observed_at":"2026-08-12T08:06:42.236760Z","submitted_at":"2024-10-15T16:28:09Z","title":"Latent Action Pretraining from Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11758","snapshot_observed_at":"2026-08-07T00:25:28.182851Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.182851Z"},"links":{"cited_paper":"/paper/2410.11758","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:c140ebb03dacd44c66b9de5df3195c77a4dde8e7fedf47cd1000f20fffd8f7a9","observation_id":"def1bbb5-3b29-4d51-9ccf-90502c0349ec","resolution":{"observed_at":"2026-08-07T00:25:28.182851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.186738Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.186738Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:26106003eca43ab3a3eada798067f2397744666daacd51f336dbe1e6b0d2bc72","observation_id":"a0e706bf-2f99-4ad0-824f-a74ff6e9ab18","resolution":{"observed_at":"2026-08-07T00:25:28.186738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.191293Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.191293Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:d6bbaa1e7d2ee48b198a9b25aae56f900442d70ef9e9b2f6d6e2c4caa173333f","observation_id":"30068c9d-49de-4567-8a70-8d79cc034b8b","resolution":{"observed_at":"2026-08-07T00:25:28.191293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.195564Z","title":"Karaev, I","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.195564Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:a352ee6c9c5c1eac149a5ebcf01171a7670f2d8371440ce49b837ddfcec8e6e2","observation_id":"3c7ab8d9-8f77-4e8a-ae72-9ae7951ddd61","resolution":{"observed_at":"2026-08-07T00:25:28.195564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.199789Z","title":"Wang, Y .-Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.199789Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:bc0a2885b256ab8becd20ad365f643c7ab72ea8f310d0688203067ebf9481e45","observation_id":"ee1a3068-7cf8-4923-8449-b7a870d741b2","resolution":{"observed_at":"2026-08-07T00:25:28.199789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.203862Z","title":"Doersch, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.203862Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:e93e3cce471a7fb28c42fc3f5780fe9713467351ff24e8d35b558d92b504222e","observation_id":"d1a81d21-eb9b-4885-8294-b8afacb1bcb9","resolution":{"observed_at":"2026-08-07T00:25:28.203862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.207627Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.207627Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:89b98277a325b17634958512bc5a3d7aab3e98339e1a17297004216de8e061df","observation_id":"c594f2f1-19f5-4529-b714-9ee12bbe26fa","resolution":{"observed_at":"2026-08-07T00:25:28.207627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15975","last_updated":"2023-08-31T15:29:44Z","snapshot_observed_at":"2026-08-16T15:04:38.131135Z","submitted_at":"2023-08-30T11:57:04Z","title":"RoboTAP: Tracking Arbitrary Points for Few-Shot Visual Imitation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15975","snapshot_observed_at":"2026-08-07T00:25:28.211687Z","title":"Vecerik, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.211687Z"},"links":{"cited_paper":"/paper/2308.15975","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:4dd763fbab2a4a3be4e1181ff27bd9f0555510f6e12e4ae7f0212555eecce187","observation_id":"a8bf833e-cdb5-47fc-98b1-4760e0902da5","resolution":{"observed_at":"2026-08-07T00:25:28.211687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.215915Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.215915Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:75e9b70ad60acaca2d6d17989ccdae08e9e606ed3747bf0f285a43da0e116723","observation_id":"dc215e2b-1fd1-4433-9b69-6c248cc4d4c9","resolution":{"observed_at":"2026-08-07T00:25:28.215915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11439","last_updated":"2024-09-23T08:22:04Z","snapshot_observed_at":"2026-08-16T14:25:49.886675Z","submitted_at":"2024-01-21T09:39:11Z","title":"General Flow as Foundation Affordance for Scalable Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11439","snapshot_observed_at":"2026-08-07T00:25:28.219802Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.219802Z"},"links":{"cited_paper":"/paper/2401.11439","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:419f0e6c61e0fbb37bcde994edbac57fca1a9bddfef9119c9d9e421ea89f08ed","observation_id":"dcfbc43c-ef12-48e5-9bb6-41f1fab07940","resolution":{"observed_at":"2026-08-07T00:25:28.219802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16944","last_updated":"2024-10-11T07:17:42Z","snapshot_observed_at":"2026-08-16T13:22:47.094450Z","submitted_at":"2024-08-29T23:48:08Z","title":"FlowRetrieval: Flow-Guided Data Retrieval for Few-Shot Imitation Learning","version":2},"cited_work":{"arxiv_id":"2408.16944","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.16944","snapshot_observed_at":"2026-08-07T00:25:29.188413Z","title":"FlowRetrieval: Flow-Guided Data Retrieval for Few-Shot Imitation Learning","venue":"cs.RO","work_id":"d21bbcc1-c00f-4664-a19f-3d594ffa3f08","year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.223800Z"},"links":{"cited_paper":"/paper/2408.16944","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:14c1a77b5b35f7418a5792c3f155029c829cd96394b155d08361426695834afd","observation_id":"e15e356a-1f96-40b7-9fe2-ab8bfa4e96ce","resolution":{"observed_at":"2026-08-07T00:25:29.192888Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08576","last_updated":"2023-10-12T17:59:23Z","snapshot_observed_at":"2026-08-16T14:52:35.031233Z","submitted_at":"2023-10-12T17:59:23Z","title":"Learning to Act from Actionless Videos through Dense Correspondences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08576","snapshot_observed_at":"2026-08-07T00:25:28.228345Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.228345Z"},"links":{"cited_paper":"/paper/2310.08576","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:149c7986ca55b65ebca7557be477f6acccac6493e45868642cd230d2ab08e90a","observation_id":"a8b07aa3-b76d-49fb-8b1d-8c119778b33f","resolution":{"observed_at":"2026-08-07T00:25:28.228345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24221","last_updated":"2024-10-31T17:59:55Z","snapshot_observed_at":"2026-08-16T13:04:01.871508Z","submitted_at":"2024-10-31T17:59:55Z","title":"EgoMimic: Scaling Imitation Learning via Egocentric Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24221","snapshot_observed_at":"2026-08-07T00:25:28.232414Z","title":"Kareer, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.232414Z"},"links":{"cited_paper":"/paper/2410.24221","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:5cac45e7b5e562fdb46e25f32c0d7733957d43ff12de548db54639dcd1d8999d","observation_id":"91fbb09d-e7e0-4709-b66d-fdac782ee165","resolution":{"observed_at":"2026-08-07T00:25:28.232414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.236666Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.236666Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:a8e268e12590fe227623a1bc19ae9f8ec1bf629f04e2fa7bed7441a673734858","observation_id":"310b5131-3582-4b8e-92f2-5cd9e1f11929","resolution":{"observed_at":"2026-08-07T00:25:28.236666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23254","last_updated":"2024-10-30T17:37:31Z","snapshot_observed_at":"2026-08-16T23:21:08.456270Z","submitted_at":"2024-10-30T17:37:31Z","title":"Keypoint Abstraction using Large Models for Object-Relative Imitation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23254","snapshot_observed_at":"2026-08-07T00:25:28.240936Z","title":"Fang, B.-R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.240936Z"},"links":{"cited_paper":"/paper/2410.23254","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:bb839d2efd5a0d98f49e73f611864bd7726373301cffddc9a6c5af8e5b25af0f","observation_id":"5f853c00-cab7-49da-9555-d77a3ff80f97","resolution":{"observed_at":"2026-08-07T00:25:28.240936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.244741Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.244741Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:fcf0fd22791c05b4441a1078372e151dbcdc1f046a3205bfc437c7ea5d757a18","observation_id":"f7144044-b2fb-4113-86e1-67c3f13ec815","resolution":{"observed_at":"2026-08-07T00:25:28.244741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.248819Z","title":"Manuelli, W","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.248819Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:3b3178f69709927c2258a96db36c640ceda2d08dfe691b261cfee1a3b128b02c","observation_id":"ece63cb4-999a-404f-b59a-8599f20fbfbf","resolution":{"observed_at":"2026-08-07T00:25:28.248819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23289","last_updated":"2024-10-30T17:59:41Z","snapshot_observed_at":"2026-08-16T13:04:25.870717Z","submitted_at":"2024-10-30T17:59:41Z","title":"Bridging the Human to Robot Dexterity Gap through Object-Oriented Rewards","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23289","snapshot_observed_at":"2026-08-07T00:25:28.253013Z","title":"Guzey, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.253013Z"},"links":{"cited_paper":"/paper/2410.23289","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:0a3591f5d8688d6f8b1330fb9b6c7fdb7f1299038630cb244fb3a7fd0ebfa7eb","observation_id":"8939d3b9-4093-4639-ae8b-f4e21b82e6c5","resolution":{"observed_at":"2026-08-07T00:25:28.253013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15208","last_updated":"2024-10-04T04:05:27Z","snapshot_observed_at":"2026-08-16T13:32:21.178898Z","submitted_at":"2024-07-21T16:15:02Z","title":"Flow as the Cross-Domain Manipulation Interface","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15208","snapshot_observed_at":"2026-08-07T00:25:28.257580Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.257580Z"},"links":{"cited_paper":"/paper/2407.15208","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:023b90639fa3f40f52a80abc23eb4ea6b5275b4404fb33712cd8545f7f13d310","observation_id":"78198323-69ef-4a86-9444-c80fdea66d7c","resolution":{"observed_at":"2026-08-07T00:25:28.257580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.261514Z","title":"Bharadhwaj, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.261514Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:74a32d94828b5748815c33f3b11dcf623d76802f7f4846f28e1e8e965714c8f4","observation_id":"d51063cc-b432-4e4c-9e9f-aefaa3c56e49","resolution":{"observed_at":"2026-08-07T00:25:28.261514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01527","last_updated":"2024-08-08T23:18:08Z","snapshot_observed_at":"2026-08-16T13:55:52.111938Z","submitted_at":"2024-05-02T17:56:55Z","title":"Track2Act: Predicting Point Tracks from Internet Videos enables Generalizable Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01527","snapshot_observed_at":"2026-08-07T00:25:28.265492Z","title":"Bharadhwaj, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.265492Z"},"links":{"cited_paper":"/paper/2405.01527","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:83fa89ae710f04c547feaf43e602adb7abdfb5ece5ee6bf9d31fce7acfb349d3","observation_id":"3fa80b8f-6101-4a69-ad93-300ccb2033eb","resolution":{"observed_at":"2026-08-07T00:25:28.265492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00025","last_updated":"2024-07-12T12:51:00Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-12-28T23:34:43Z","title":"Any-point Trajectory Modeling for Policy Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00025","snapshot_observed_at":"2026-08-07T00:25:28.269810Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.269810Z"},"links":{"cited_paper":"/paper/2401.00025","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:367be67d536d13dde4c18e25f5590914b2116b0d6899202212d4466cdc1c9537","observation_id":"034fbaa4-c25e-4511-b998-a8e8e01c2b53","resolution":{"observed_at":"2026-08-07T00:25:28.269810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.273832Z","title":"Hansen, X","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.273832Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:1f5317f00196232bf406890e6e0ed0fcd4eca65feb8e737cc40e6166373df2c0","observation_id":"ec52b4d8-fe82-46f9-b0c7-0bde055097d6","resolution":{"observed_at":"2026-08-07T00:25:28.273832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16828","last_updated":"2024-03-21T17:56:19Z","snapshot_observed_at":"2026-07-31T05:32:29.431480Z","submitted_at":"2023-10-25T17:57:07Z","title":"TD-MPC2: Scalable, Robust World Models for Continuous Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16828","snapshot_observed_at":"2026-08-07T00:25:28.278008Z","title":"Hansen, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.278008Z"},"links":{"cited_paper":"/paper/2310.16828","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:d81131f25ee55a5374d15b8a10e26809b663327d02b15312067a92835476df01","observation_id":"77c1fa4b-324f-4126-a36d-37ce1bca30e7","resolution":{"observed_at":"2026-08-07T00:25:28.278008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00653","last_updated":"2025-03-01T22:58:44Z","snapshot_observed_at":"2026-08-16T12:53:57.381361Z","submitted_at":"2025-03-01T22:58:44Z","title":"Discrete Codebook World Models for Continuous Control","version":1},"cited_work":{"arxiv_id":"2503.00653","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.00653","snapshot_observed_at":"2026-08-07T00:25:28.932475Z","title":"Discrete Codebook World Models for Continuous Control","venue":"cs.LG","work_id":"e28b855b-fd15-4689-b3a4-839392a3b516","year":2025},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.282082Z"},"links":{"cited_paper":"/paper/2503.00653","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:d4e7040bb1bf4975a814dbaa91817cdf979c61d432d39b375110d28862a0a28a","observation_id":"e0de7632-f701-43cc-9c08-350fef99f169","resolution":{"observed_at":"2026-08-07T00:25:28.939003Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15505","last_updated":"2023-10-12T07:55:05Z","snapshot_observed_at":"2026-07-06T16:24:17.829828Z","submitted_at":"2023-09-27T09:13:40Z","title":"Finite Scalar Quantization: VQ-VAE Made Simple","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15505","snapshot_observed_at":"2026-08-07T00:25:28.286232Z","title":"Mentzer, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.286232Z"},"links":{"cited_paper":"/paper/2309.15505","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:ce3e5fb2ab5dcd3153753c7e7ac71282fc84c448b38d18f50887f50222ecb0de","observation_id":"4732e006-7962-45f8-bf39-40c9cd1f748e","resolution":{"observed_at":"2026-08-07T00:25:28.286232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00937","last_updated":"2018-05-30T14:58:27Z","snapshot_observed_at":"2026-08-14T20:17:29.355571Z","submitted_at":"2017-11-02T21:14:44Z","title":"Neural Discrete Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00937","snapshot_observed_at":"2026-08-07T00:25:28.290224Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.290224Z"},"links":{"cited_paper":"/paper/1711.00937","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:84a25785431300c2e9f0b9a78527a4d1ff4afb4339a3283d03bc4cfdc3e07bb6","observation_id":"3c0354a6-e390-424f-96ef-e98ea2f52c6d","resolution":{"observed_at":"2026-08-07T00:25:28.290224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.294695Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.294695Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:c507541a90b8d520695e7f28da54e800846ae289c33c7038d357bcc25b06681c","observation_id":"a0ad9177-62b7-4f50-a95c-0760cebf9166","resolution":{"observed_at":"2026-08-07T00:25:28.294695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.303544Z","title":"Raffel, N","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.303544Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:32c7ca5be3b22bc8735b5e3a019d3f8b00db2cf2b46d12a4b87117ef2b27fadc","observation_id":"a0185014-885e-40de-af68-c7c58fe72a50","resolution":{"observed_at":"2026-08-07T00:25:28.303544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07539","last_updated":"2024-07-16T20:20:07Z","snapshot_observed_at":"2026-08-16T13:44:03.409931Z","submitted_at":"2024-06-11T17:58:54Z","title":"BAKU: An Efficient Transformer for Multi-Task Policy Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07539","snapshot_observed_at":"2026-08-07T00:25:28.307250Z","title":"Haldar, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.307250Z"},"links":{"cited_paper":"/paper/2406.07539","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:d583d039350c875a7610642ca7786a2df465c314f5e4faf5d2c4132de81f1aa9","observation_id":"b92dd05c-cfe1-4814-a984-7b2b5f221b43","resolution":{"observed_at":"2026-08-07T00:25:28.307250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.311355Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.311355Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:821a70a47c513ec92a7aa58f1cf3f1e740767057c78eea93619f57aff8d69b5b","observation_id":"835f13a0-3639-4d14-a2f4-0d5805b88fae","resolution":{"observed_at":"2026-08-07T00:25:28.311355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.315141Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.315141Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:02343322add427ae908075f940726a13f31483797b5d82d98439af928c2fa938","observation_id":"6a83375c-d0de-47c8-806c-b63525dd174b","resolution":{"observed_at":"2026-08-07T00:25:28.315141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.863620Z","title":"something something","venue":null,"work_id":"a1350ab4-0c66-4bd6-bc80-53420853ee52","year":null},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.318863Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:4bc1bf9a83b69359fa930889afdd8793947e93b477fdb97d928919d6d5096e79","observation_id":"c35cc0d6-b830-4e1e-bcc3-ebf70b1719fc","resolution":{"observed_at":"2026-08-07T00:25:29.867751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03310","last_updated":"2023-10-14T15:52:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-05T23:32:26Z","title":"LIBERO: Benchmarking Knowledge Transfer for Lifelong Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03310","snapshot_observed_at":"2026-08-07T00:25:28.326612Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.326612Z"},"links":{"cited_paper":"/paper/2306.03310","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:fb58faf183a4e0a9dc4a89c35c98047a902471cbafcad235da4b4b7e44061183","observation_id":"1272071a-45b3-484d-a561-474054ea57c4","resolution":{"observed_at":"2026-08-07T00:25:28.326612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14897","last_updated":"2026-04-25T05:18:57Z","snapshot_observed_at":"2026-07-06T15:08:15.836938Z","submitted_at":"2023-03-27T03:12:24Z","title":"Seer: Language Instructed Video Prediction with Latent Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14897","snapshot_observed_at":"2026-08-07T00:25:28.330530Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.330530Z"},"links":{"cited_paper":"/paper/2303.14897","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:11a7d15a52125e569852ccea267ed061e7f0b0ac29cc9963d3333ad33ed29ee1","observation_id":"d3fb425d-f7c7-468a-891c-3cbc757d12c5","resolution":{"observed_at":"2026-08-07T00:25:28.330530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15840","last_updated":"2024-09-11T13:02:48Z","snapshot_observed_at":"2026-08-16T13:32:02.850065Z","submitted_at":"2024-07-22T17:57:59Z","title":"QueST: Self-Supervised Skill Abstractions for Learning Continuous Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15840","snapshot_observed_at":"2026-08-07T00:25:28.338494Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.338494Z"},"links":{"cited_paper":"/paper/2407.15840","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:333ee38f7dc7aee9f147978a210ce793c5f870abeca3f89fd51a6bf1ab8cf29b","observation_id":"7b34fcd4-a7b9-4d1c-b766-6f083ef5fd42","resolution":{"observed_at":"2026-08-07T00:25:28.338494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24211","last_updated":"2025-02-28T18:54:16Z","snapshot_observed_at":"2026-08-16T13:04:02.309830Z","submitted_at":"2024-10-31T17:59:01Z","title":"DELTA: Dense Efficient Long-range 3D Tracking for any video","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24211","snapshot_observed_at":"2026-08-07T00:25:28.342295Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.342295Z"},"links":{"cited_paper":"/paper/2410.24211","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:1557718265a1266e8e6b3d582438e4a4b60b4f828dd76cd127fcff80778eb7aa","observation_id":"3446c36d-6c31-4ab5-b5df-9fd4bd1bf586","resolution":{"observed_at":"2026-08-07T00:25:28.342295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13765","last_updated":"2024-03-20T17:28:17Z","snapshot_observed_at":"2026-08-16T14:07:57.176988Z","submitted_at":"2024-03-20T17:28:17Z","title":"Towards Principled Representation Learning from Videos for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13765","snapshot_observed_at":"2026-08-07T00:25:28.346026Z","title":"Misra, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.346026Z"},"links":{"cited_paper":"/paper/2403.13765","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:9d8a8db4757762d611c96d1cc278a1a67044fd9ee995f2b8307c4d8bbf0bf391","observation_id":"70194f46-9635-4e27-b6df-c272cbd325e1","resolution":{"observed_at":"2026-08-07T00:25:28.346026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13435","last_updated":"2022-10-24T17:49:56Z","snapshot_observed_at":"2026-08-16T17:39:00.376398Z","submitted_at":"2022-10-24T17:49:56Z","title":"Dichotomy of Control: Separating What You Can Control from What You Cannot","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13435","snapshot_observed_at":"2026-08-07T00:25:28.349896Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.349896Z"},"links":{"cited_paper":"/paper/2210.13435","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:428b378c4a746b8cbece627e23aa3f001a0f9224ed4e1be8c76f26d7d9b84ef7","observation_id":"071e1438-6dc0-4100-9895-fb4fd313ac20","resolution":{"observed_at":"2026-08-07T00:25:28.349896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.849137Z","title":null,"venue":null,"work_id":"8419bef7-7d1a-40f4-83cf-a2afbeef867a","year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.353685Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:04d91f57b95ed255bb7d56948e4595dd3846d8c19820346618e28f0f7a874f12","observation_id":"3a23dc8b-7168-4c98-8395-76353334d3d0","resolution":{"observed_at":"2026-08-07T00:25:29.853732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12422","last_updated":"2023-10-13T05:44:37Z","snapshot_observed_at":"2026-08-16T15:53:03.955730Z","submitted_at":"2023-02-24T02:54:15Z","title":"MimicPlay: Long-Horizon Imitation Learning by Watching Human Play","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12422","snapshot_observed_at":"2026-08-07T00:25:28.357429Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.357429Z"},"links":{"cited_paper":"/paper/2302.12422","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:9cab9afb9ae7cc57e43a723b75ee8ee7fed0797b3203789c7c0d9987bd6577e6","observation_id":"b9cc8039-2abb-47bb-a88f-c2ed5b80b7cb","resolution":{"observed_at":"2026-08-07T00:25:28.357429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.834773Z","title":null,"venue":null,"work_id":"70011001-49c8-49b2-bcc9-db35ff33e2dc","year":2012},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.361363Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:1c6c1a01b726092cd6ad9f6960812ddaa8a3faab879c7827f03a6ba0b97b5447","observation_id":"278a6f46-1b08-483a-9c03-fba4cc193a4d","resolution":{"observed_at":"2026-08-07T00:25:29.838789Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.821238Z","title":"Lynch, M","venue":null,"work_id":"7750cdf6-061f-4616-8b59-35978cd0f41d","year":2020},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.365279Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:13ead1e7f4591dc1606af9f1d10cefd7a8788829319ba8d2a52fed2ea6f57d48","observation_id":"c888c584-58b2-4f15-ae02-d5177b14a1f5","resolution":{"observed_at":"2026-08-07T00:25:29.825410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02011","last_updated":"2023-02-03T21:39:52Z","snapshot_observed_at":"2026-08-16T15:57:48.355760Z","submitted_at":"2023-02-03T21:39:52Z","title":"Zero-Shot Robot Manipulation from Passive Human Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02011","snapshot_observed_at":"2026-08-07T00:25:28.368916Z","title":"Bharadhwaj, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.368916Z"},"links":{"cited_paper":"/paper/2302.02011","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:6f7f5f44c30f46351e78dc7b14d95844921f1c1099cb3728d8e8f1beda6c19da","observation_id":"99a46d55-15d1-4cea-aa35-d011f501492d","resolution":{"observed_at":"2026-08-07T00:25:28.368916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.807738Z","title":"Xiong, Q","venue":null,"work_id":"27483b7a-31c7-454d-a326-4ee09eb035a9","year":2021},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.372727Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:44b5cc47d9aed8e819c8778e9a5e8cb7f870c88888063be0a86dcaf5f4703934","observation_id":"0d7b3d07-ed33-4500-a4f8-dbd53ef09436","resolution":{"observed_at":"2026-08-07T00:25:29.811851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.793543Z","title":null,"venue":null,"work_id":"59a7daf3-a00d-4dc2-b0ad-e79ac1ab471d","year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.376684Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:c762e0a4e2fba9a4301d7ddf658bdaea640987eaa472c03a968ce716d35c13cc","observation_id":"c5e0ef0f-fcf0-4450-87c0-4a449fc5cf99","resolution":{"observed_at":"2026-08-07T00:25:29.798457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.779370Z","title":"Mandikal and K","venue":null,"work_id":"b3d1d10a-8ceb-45bb-98e6-0dc3ca9a3ab7","year":2022},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.380654Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:7bac01de2d5e21a007b7b33dcf15e99ab321a54c462306cf7e68c4f9d37b4bdf","observation_id":"b19dbd88-5f05-4f20-9e03-87fb81d3dbb4","resolution":{"observed_at":"2026-08-07T00:25:29.783767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.09450","last_updated":"2022-07-19T17:59:59Z","snapshot_observed_at":"2026-08-16T16:44:46.627613Z","submitted_at":"2022-07-19T17:59:59Z","title":"Human-to-Robot Imitation in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.09450","snapshot_observed_at":"2026-08-07T00:25:28.384598Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.384598Z"},"links":{"cited_paper":"/paper/2207.09450","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:9909e1e544c07d93bb844680c3e2b59d74915b92b0dae50b7a5de7a4ec1b7dd0","observation_id":"80155123-6ac1-442e-aa2d-883a4cc9e3ca","resolution":{"observed_at":"2026-08-07T00:25:28.384598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:28.388738Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.388738Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:0f38ffd0e4062c9b6cfd31242317c7394de8b41931fee973d09fad4ab99e44c2","observation_id":"26e9db53-2194-4000-ab24-6bba51c09650","resolution":{"observed_at":"2026-08-07T00:25:28.388738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10901","last_updated":"2023-08-21T17:59:32Z","snapshot_observed_at":"2026-08-16T15:06:54.970053Z","submitted_at":"2023-08-21T17:59:32Z","title":"Structured World Models from Human Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10901","snapshot_observed_at":"2026-08-07T00:25:28.392477Z","title":"Mendonca, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.392477Z"},"links":{"cited_paper":"/paper/2308.10901","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:584df94774df100296864a2bf563e74290994a9d412ac4266dba907bd9001651","observation_id":"cca5490f-880e-4174-afcc-dfe68fd41a2a","resolution":{"observed_at":"2026-08-07T00:25:28.392477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.756259Z","title":null,"venue":null,"work_id":"bc04b3e0-1b4b-42d0-970c-3e872dae073f","year":2022},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.397204Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:80931f3eb299ddce69c61433f97746f2b257ea9aa46dfd81ade192c28f6dc362","observation_id":"34699a67-97cc-4ed9-a389-5ce37ae560c2","resolution":{"observed_at":"2026-08-07T00:25:29.760050Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.06507","last_updated":"2021-11-04T20:07:57Z","snapshot_observed_at":"2026-08-16T19:06:16.231226Z","submitted_at":"2020-11-12T17:15:48Z","title":"Reinforcement Learning with Videos: Combining Offline Observations with Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.06507","snapshot_observed_at":"2026-08-07T00:25:28.401214Z","title":"Schmeckpeper, O","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.401214Z"},"links":{"cited_paper":"/paper/2011.06507","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:099ce6a1925bcee592d3078a04ac0534e4e10157a7be0a5c9253c4cf4758eccc","observation_id":"df42e165-53d6-48f8-81fd-cad8a9b57618","resolution":{"observed_at":"2026-08-07T00:25:28.401214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.13041","last_updated":"2023-09-22T17:59:14Z","snapshot_observed_at":"2026-08-17T13:00:25.656258Z","submitted_at":"2023-09-22T17:59:14Z","title":"Robotic Offline RL from Internet Videos via Value-Function Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.13041","snapshot_observed_at":"2026-08-07T00:25:28.405387Z","title":"Bhateja, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.405387Z"},"links":{"cited_paper":"/paper/2309.13041","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:cc8f65d60c932924636643d2b63081e6af43b45434b96d07a9dfb18414611c03","observation_id":"ee060843-8dd3-43d7-9a17-196e0c31e7a9","resolution":{"observed_at":"2026-08-07T00:25:28.405387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.742287Z","title":"Ghosh, C","venue":null,"work_id":"659c3ffb-b108-49ae-aaf6-4a98a17b6e7e","year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.409013Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:633e0f8905156b094129da4873a09e2c062f82fab51babc712ae281cb5744fd7","observation_id":"94f52f5b-de56-45c7-8885-a6a5ba6a864e","resolution":{"observed_at":"2026-08-07T00:25:29.746685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15391","last_updated":"2024-02-23T15:47:26Z","snapshot_observed_at":"2026-08-16T14:15:52.387663Z","submitted_at":"2024-02-23T15:47:26Z","title":"Genie: Generative Interactive Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15391","snapshot_observed_at":"2026-08-07T00:25:28.412830Z","title":"Bruce, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.412830Z"},"links":{"cited_paper":"/paper/2402.15391","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:ccae1b3a07af27482cbbeeed6354dc5dbecbfd12a036845936ab0dc045879fae","observation_id":"7129ff38-3cd0-4067-b969-88022bba09b7","resolution":{"observed_at":"2026-08-07T00:25:28.412830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14343","last_updated":"2023-05-30T17:38:44Z","snapshot_observed_at":"2026-08-16T15:30:30.377825Z","submitted_at":"2023-05-23T17:59:33Z","title":"Video Prediction Models as Rewards for Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14343","snapshot_observed_at":"2026-08-07T00:25:28.417137Z","title":"Escontrela, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.417137Z"},"links":{"cited_paper":"/paper/2305.14343","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:c9ef512a0c67a30e9ef0ab268be8f3ae92f04e9d5cee5b05f0d0720f40c5bdc3","observation_id":"06b9e4bb-35f4-4098-ae1e-4ccbca6613f0","resolution":{"observed_at":"2026-08-07T00:25:28.417137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14134","last_updated":"2024-08-09T03:06:42Z","snapshot_observed_at":"2026-08-16T14:32:27.603486Z","submitted_at":"2023-12-21T18:55:05Z","title":"Diffusion Reward: Learning Rewards via Conditional Video Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14134","snapshot_observed_at":"2026-08-07T00:25:28.420945Z","title":"Huang, G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.420945Z"},"links":{"cited_paper":"/paper/2312.14134","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:f8f19be396071bbdd9c7e0d45ad33111256b3b73e3703a9a7bb2c582e3ef9b21","observation_id":"a36d6b59-c8e4-4c4f-a1b5-b149888f5027","resolution":{"observed_at":"2026-08-07T00:25:28.420945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.728170Z","title":"Schmidt and M","venue":null,"work_id":"2d87eb17-739c-498d-a542-0dfa6231352c","year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.425315Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:6059ad59cbcba365d7f50c110fe0393f2d27d9d3965e2424129dd974eba7e754","observation_id":"693cb861-a20f-40d8-9e0f-82e29f592343","resolution":{"observed_at":"2026-08-07T00:25:29.732169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09153","last_updated":"2024-11-14T03:13:26Z","snapshot_observed_at":"2026-08-16T16:05:49.532029Z","submitted_at":"2024-11-14T03:13:26Z","title":"VidMan: Exploiting Implicit Dynamics from Video Diffusion Model for Effective Robot Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09153","snapshot_observed_at":"2026-08-07T00:25:28.429544Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.429544Z"},"links":{"cited_paper":"/paper/2411.09153","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:53fc8c78f0b7472be8a14d87968d7c778daa114f1f6d243182452d36e7b227c4","observation_id":"3e504796-8b7b-49d1-ae66-4252b4beb498","resolution":{"observed_at":"2026-08-07T00:25:28.429544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-08-16T13:40:01.739609Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-08-07T00:25:28.433785Z","title":"Liang, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.433785Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:95bc85f20d59444465d1fe8d7f30422b54c1a30c5cf0f786a1f17dfdc4892a3f","observation_id":"334ba018-0cee-46fd-9851-a627f3f841ff","resolution":{"observed_at":"2026-08-07T00:25:28.433785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03206","last_updated":"2021-06-23T00:25:31Z","snapshot_observed_at":"2026-08-16T18:41:11.947734Z","submitted_at":"2021-03-04T18:20:50Z","title":"Perceiver: General Perception with Iterative Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03206","snapshot_observed_at":"2026-08-07T00:25:28.437698Z","title":"Jaegle, F","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.437698Z"},"links":{"cited_paper":"/paper/2103.03206","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:85ac09d324c21e278dd32d5060a657d1f1247f86460585cb2c83bb032233ffc2","observation_id":"dbee00d0-ae9b-4206-a2cf-15f072c67887","resolution":{"observed_at":"2026-08-07T00:25:28.437698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T00:25:28.441888Z","title":"Oquab, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.441888Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:4861b706eb2c7d0db3bee7debb43424f2ba0f06eab71d062c95be55c2625540b","observation_id":"0ad6e59e-858e-4f4b-b839-b70fe19d6407","resolution":{"observed_at":"2026-08-07T00:25:28.441888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T00:25:28.445824Z","title":"Dosovitskiy, L","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.445824Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:2289aaa7a4eaaf2a2ca48f45123766067d384a25468701b3acf041d93a7a19ec","observation_id":"3a625d1c-72a5-4590-bae8-c712e329a8ab","resolution":{"observed_at":"2026-08-07T00:25:28.445824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1605.06431","last_updated":"2016-10-27T00:43:58Z","snapshot_observed_at":"2026-08-14T21:56:28.089609Z","submitted_at":"2016-05-20T16:44:03Z","title":"Residual Networks Behave Like Ensembles of Relatively Shallow Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.06431","snapshot_observed_at":"2026-08-07T00:25:28.449709Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.449709Z"},"links":{"cited_paper":"/paper/1605.06431","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:51ffcf6cb5449b960919ae4b573e932ab70546fd880c306e50f029e9774db52c","observation_id":"80b6b85f-7c2d-4eaf-8e25-98df681e5119","resolution":{"observed_at":"2026-08-07T00:25:28.449709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-16T02:30:42.660030Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T00:25:28.453865Z","title":"Lipman, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.453865Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:4e14eab200037f86bbbbcb027cb2eb9ad4e628afd3af920390d129ff5d20bab6","observation_id":"6db03f2a-2622-40d1-a908-91cf19fba7ea","resolution":{"observed_at":"2026-08-07T00:25:28.453865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-07T00:25:28.458572Z","title":"Bjorck, F","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.458572Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:64dff7e1af47e6a604f20edd17b85047ead19899311ec0cb6432eeb61f6e7aa5","observation_id":"28ff5339-4649-4369-a3bc-49f06b88c5e7","resolution":{"observed_at":"2026-08-07T00:25:28.458572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04137","last_updated":"2024-03-14T04:36:31Z","snapshot_observed_at":"2026-08-08T17:26:38.829859Z","submitted_at":"2023-03-07T18:50:03Z","title":"Diffusion Policy: Visuomotor Policy Learning via Action Diffusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04137","snapshot_observed_at":"2026-08-07T00:25:28.462987Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.462987Z"},"links":{"cited_paper":"/paper/2303.04137","citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:ad249086e865647c53e446c76bfd67845bf302097f280cde813699eac1e78a48","observation_id":"d3e67c28-11e1-4468-9d05-809e95ce0b75","resolution":{"observed_at":"2026-08-07T00:25:28.462987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.712964Z","title":"Require:DatasetsV,R 1:Preprocess keypoint tracksκ t inV 2:Learn latent motion encoding to compressκ t into discrete tokensz t using Eq","venue":null,"work_id":"ec3ea557-4699-4b4c-b624-e286ed1f260d","year":null},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.467362Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:fc81de59d49f75708ab1e356c12d04e6e36df584a743dc53f925e8d7c66d202c","observation_id":"afc2e923-0000-4db0-bb08-e7356c3cf667","resolution":{"observed_at":"2026-08-07T00:25:29.717442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:25:29.698775Z","title":"Put the Rubik’s Cube on the Box","venue":null,"work_id":"f16b955d-a68b-419c-a44a-f601467573fc","year":null},"citing_paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:28.471501Z"},"links":{"citing_paper":"/paper/2506.14198"},"observation_digest":"sha256:2a9217e9473a7fb980c7fa7800853d47e821c29ea17729e6b6955468ec0a46e7","observation_id":"a4be4f32-a0bb-4266-b7a0-127c891a5f5d","resolution":{"observed_at":"2026-08-07T00:25:29.702859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.14198","last_updated":"2025-06-17T05:31:42Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-13T06:13:03.182338Z","submitted_at":"2025-06-17T05:31:42Z","title":"AMPLIFY: Actionless Motion Priors for Robot Learning from Videos"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":89,"verified_exact":3,"verified_fuzzy":8},"total_outbound_references":107},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 100 of 107 outbound references and 9 inbound Pith citation observations for arXiv:2506.14198."}