{"as_of":"2026-08-22T18:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:98da639d5874c48d88ecb5d2bb7ab71254bcf8dede4ad1e57697c071e647a91e","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:27:13.227811Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:29:25.352663Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T18:47:31.700933Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-08-05T15:29:25.352663Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19852","last_updated":"2025-08-28T07:08:03Z","snapshot_observed_at":"2026-08-21T01:41:52.318569Z","submitted_at":"2025-08-27T13:09:55Z","title":"Ego-centric Predictive Model Conditioned on Hand Trajectories","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T15:29:25.352663Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2508.19852"},"observation_digest":"sha256:48e0068c3757878ec04c7e40e732446da18efa0ff2458ae2b11c158a8c8d5eec","observation_id":"9e7f154c-7862-485d-9282-b47f227dd783","resolution":{"observed_at":"2026-08-05T15:29:25.352663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2509.24527","last_updated":"2025-09-29T09:42:27Z","snapshot_observed_at":"2026-08-13T03:00:49.988137Z","submitted_at":"2025-09-29T09:42:27Z","title":"Training Agents Inside of Scalable World Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T02:05:52.431747Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2509.24527"},"observation_digest":"sha256:9cacf8614d32ebe1555260ff28d42eb90908bb89b8a7275ea701a424f63fdb3c","observation_id":"a2a5a3d9-67dc-48b4-a7db-58943417a5ef","resolution":{"observed_at":"2026-05-15T02:05:52.509548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2511.04670","last_updated":"2025-11-06T18:55:17Z","snapshot_observed_at":"2026-07-06T22:35:07.844255Z","submitted_at":"2025-11-06T18:55:17Z","title":"Cambrian-S: Towards Spatial Supersensing in Video","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T03:46:04.363500Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2511.04670"},"observation_digest":"sha256:14cfcc2273a36e4099d9ba2ed86ac8d742586498953ace3e1ee2f4680fc77603","observation_id":"51eb6a5c-11e7-48d9-946f-3c39c0dd11ad","resolution":{"observed_at":"2026-05-18T03:46:04.702741Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2602.06949","last_updated":"2026-02-06T18:49:43Z","snapshot_observed_at":"2026-07-06T22:44:51.126114Z","submitted_at":"2026-02-06T18:49:43Z","title":"DreamDojo: A Generalist Robot World Model from Large-Scale Human Videos","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T17:02:33.997887Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2602.06949"},"observation_digest":"sha256:cf02e1aa1e7b3ea6b753cff79e53e648490b96d842da6f68527718987c751b9a","observation_id":"1c099d47-a879-4a80-b66d-3bc139321663","resolution":{"observed_at":"2026-05-16T17:02:34.361338Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2604.03208","last_updated":"2026-06-16T20:46:31Z","snapshot_observed_at":"2026-08-15T22:09:58.893475Z","submitted_at":"2026-04-03T17:32:36Z","title":"Hierarchical Planning with Latent World Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-13T20:13:58.991298Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2604.03208"},"observation_digest":"sha256:6ab2e40c56a12c991ab4822fd4f651a563d64a640c7e5e734223068cb4009fd8","observation_id":"5a371115-fd52-4133-8011-bd3ad2a7683e","resolution":{"observed_at":"2026-05-13T20:18:13.762552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2605.12090","last_updated":"2026-05-12T13:10:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T13:10:52Z","title":"World Action Models: The Next Frontier in Embodied AI","version":1},"reference_index":300,"source":"pdf_text","source_observed_at":"2026-05-13T05:01:16.802019Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2605.12090"},"observation_digest":"sha256:e4932f7b57cad0eddd59dc8f8b515deb4415751e48e375927f18a9509dc376ac","observation_id":"e802ba96-8ba9-47ee-ae45-26313e69a132","resolution":{"observed_at":"2026-05-13T05:07:18.018191Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2605.15477","last_updated":"2026-05-25T20:56:59Z","snapshot_observed_at":"2026-08-14T13:24:15.749730Z","submitted_at":"2026-05-14T23:35:54Z","title":"EgoExo-WM: Unlocking Exo Video for Ego World Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T14:32:27.920029Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2605.15477"},"observation_digest":"sha256:bf31da6b416c415c2e52accfe56fb9357acc653f9657a873f9d47a56cc89f91e","observation_id":"5c067818-9e0c-45ec-b000-d627ce0c159e","resolution":{"observed_at":"2026-05-19T14:32:36.077966Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2605.15477","last_updated":"2026-05-25T20:56:59Z","snapshot_observed_at":"2026-08-14T13:24:15.749730Z","submitted_at":"2026-05-14T23:35:54Z","title":"EgoExo-WM: Unlocking Exo Video for Ego World Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T20:26:11.104536Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2605.15477"},"observation_digest":"sha256:1d111d328a27f77ac9fd4018a8d946ee60ed32ff52aeaaf96f0572f6fbae63fd","observation_id":"9dc3e03d-1b1f-408a-b83b-363d38af7d1d","resolution":{"observed_at":"2026-07-01T14:35:47.479663Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2605.20388","last_updated":"2026-05-19T18:38:11Z","snapshot_observed_at":"2026-08-17T01:54:06.907397Z","submitted_at":"2026-05-19T18:38:11Z","title":"How You Move Tells What You'll Do: Trajectory-Conditioned Egocentric Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T07:14:59.175822Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2605.20388"},"observation_digest":"sha256:c52970d52f9f0ca055316293bfdb92d43c45e6cc672137d8d4ba143f3dc66222","observation_id":"b9e571cc-e60b-4281-bc8e-a31508011481","resolution":{"observed_at":"2026-05-21T07:19:46.985199Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2605.26316","last_updated":"2026-05-25T20:13:16Z","snapshot_observed_at":"2026-08-01T03:37:55.526828Z","submitted_at":"2026-05-25T20:13:16Z","title":"E$^3$C: Video Generation with 3D Environmental Memory and Ego-Exo Human Pose Control","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T22:24:38.389294Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2605.26316"},"observation_digest":"sha256:eb5a301a207edd56d58e905ddf1056b2433e006e429757594db87353906091eb","observation_id":"45fd258f-d984-406b-8bbf-6532390af410","resolution":{"observed_at":"2026-06-29T22:34:02.560741Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2606.04130","last_updated":"2026-06-02T18:40:24Z","snapshot_observed_at":"2026-08-15T18:58:35.055821Z","submitted_at":"2026-06-02T18:40:24Z","title":"CLAW: Learning Continuous Latent Action World Models via Adversarial Latent Regularization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T09:55:00.402411Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2606.04130"},"observation_digest":"sha256:6d1c10ee77d680ee0805f013b5074df4ee53045e74de8224e8b7c1977090fcd0","observation_id":"a4f55592-e55b-458a-98d8-25902e8ef79d","resolution":{"observed_at":"2026-07-02T03:36:29.572665Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2606.07326","last_updated":"2026-06-05T14:43:13Z","snapshot_observed_at":"2026-08-15T09:47:07.695030Z","submitted_at":"2026-06-05T14:43:13Z","title":"AnchorWorld: Embodied Egocentric World Simulation with View-based Evolution Customization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T22:25:18.152134Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2606.07326"},"observation_digest":"sha256:e488ecd5aeef7f88bae9885f9909c11b829fe8891e6407345fbb6c55e90ff747","observation_id":"93fc0582-b8d7-4c3b-9d27-72a89a4eadbb","resolution":{"observed_at":"2026-07-02T16:47:09.299610Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2606.27325","last_updated":"2026-06-25T17:36:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-25T17:36:35Z","title":"Not All Actions Are Equal: Rethinking Conditioning for Dexterous World Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T05:23:07.046527Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2606.27325"},"observation_digest":"sha256:0f4d193b1b04bf79d3eaf7720ab12d2f06c665f3c74671546dc3fb31ed527adc","observation_id":"42d224ca-3f03-43a3-8870-1b695b540c29","resolution":{"observed_at":"2026-07-04T13:19:50.355126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2607.02075","last_updated":"2026-08-14T13:15:06Z","snapshot_observed_at":"2026-08-19T23:09:21.524598Z","submitted_at":"2026-07-02T12:14:02Z","title":"HandsOnWorld: Unconstrained Egocentric Video Generation with Camera-Disentangled Hand Control","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-03T15:52:18.371702Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2607.02075"},"observation_digest":"sha256:5c1b20b09a13fdb911497157a774da3ae9038739cc926aadf5dd03b14683a0fa","observation_id":"5117f528-1d35-42b6-8b14-b88787da72ac","resolution":{"observed_at":"2026-07-03T15:58:37.527047Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":"2506.21552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-10T18:47:31.700933Z","title":"Whole- body conditioned egocentric video prediction","venue":"cs.CV","work_id":"16a86800-0171-422d-8be4-1732d118a0d4","year":2025},"citing_paper":{"arxiv_id":"2607.08436","last_updated":"2026-07-08T16:11:37Z","snapshot_observed_at":"2026-08-19T00:49:34.450588Z","submitted_at":"2026-07-08T16:11:37Z","title":"EgoWAM: World Action Models Beyond Pixels with In-the-Wild Egocentric Human Data","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-10T18:39:34.356696Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2607.08436"},"observation_digest":"sha256:00e239ca385d514b948458a9d7c02ab39c7e5b3223bec1202fb27b16a55306c4","observation_id":"78d01eb5-4f18-4086-b203-1655b3d18d73","resolution":{"observed_at":"2026-07-10T18:47:31.702368Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21552","snapshot_observed_at":"2026-07-30T20:31:37.693877Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23517","last_updated":"2026-07-26T07:34:14Z","snapshot_observed_at":"2026-08-10T00:06:45.195279Z","submitted_at":"2026-07-26T07:34:14Z","title":"Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-30T20:31:37.693877Z"},"links":{"cited_paper":"/paper/2506.21552","citing_paper":"/paper/2607.23517"},"observation_digest":"sha256:b9506227c69c221af9fa338078e8efdd79fc12989a18cafda38bf9c0743bff3d","observation_id":"eef0f0c6-302b-440c-ae7d-2229b709231e","resolution":{"observed_at":"2026-07-30T20:31:37.693877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.21552/citation-record","integrity":"/paper/2506.21552/integrity","json":"/paper/2506.21552/citation-record.json","paper":"/paper/2506.21552"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:27:13.977228Z","title":"Deep visual foresight for planning robot motion","venue":null,"work_id":"2b9b6e1f-2a81-44f5-be28-e1e04e1d9651","year":2017},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:11.494897Z"},"links":{"citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:9909a94fb13f1f42f5f4623bbbe99e13b25faf0f527776eedd8f6c2e92c3eff0","observation_id":"393691bc-526b-4870-bc2f-3207282bf956","resolution":{"observed_at":"2026-08-06T22:27:14.046490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-06T22:27:11.849733Z","title":"Dream to control: Learning behaviors by latent imagination","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:11.849733Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:856fd6ce9c2a0af070d5a2b8e740f0aa13e4b6619d54134b08d962bea4433723","observation_id":"0fb78cc0-9942-4b3d-930e-e1a2db55a87e","resolution":{"observed_at":"2026-08-06T22:27:11.849733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18418","last_updated":"2025-05-14T18:27:05Z","snapshot_observed_at":"2026-08-16T13:48:30.228926Z","submitted_at":"2024-05-28T17:57:23Z","title":"Hierarchical World Models as Visual Whole-Body Humanoid Controllers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18418","snapshot_observed_at":"2026-08-06T22:27:11.926930Z","title":"Hierarchical world models as visual whole-body humanoid controllers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:11.926930Z"},"links":{"cited_paper":"/paper/2405.18418","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:4db2a5a153fb23f9b825c39e46e870a7572a54a975a1febd36027cdbe51ad9c8","observation_id":"d019efbb-9f9f-4f95-aad1-19dd83471c9a","resolution":{"observed_at":"2026-08-06T22:27:11.926930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08858","last_updated":"2024-06-13T06:44:46Z","snapshot_observed_at":"2026-08-19T21:16:35.742198Z","submitted_at":"2024-06-13T06:44:46Z","title":"OmniH2O: Universal and Dexterous Human-to-Humanoid Whole-Body Teleoperation and Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08858","snapshot_observed_at":"2026-08-06T22:27:12.004162Z","title":"Omnih2o: Universal and dexterous human-to-humanoid whole-body teleoperation and learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.004162Z"},"links":{"cited_paper":"/paper/2406.08858","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:7b1e93eb7d051eb5e8cddba6c973248ddd2dcc4ef64276d510bddb7de42c63bb","observation_id":"e715259d-d68c-4630-91b2-7d99aaf95e69","resolution":{"observed_at":"2026-08-06T22:27:12.004162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17117","last_updated":"2024-06-13T06:37:20Z","snapshot_observed_at":"2026-08-17T07:05:18.024386Z","submitted_at":"2023-11-28T12:27:15Z","title":"Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17117","snapshot_observed_at":"2026-08-06T22:27:12.184080Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.184080Z"},"links":{"cited_paper":"/paper/2311.17117","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:8f717dc8e0e4a5f085a859483ab2a28a7fa8ccfca4031204182ed8a512b3884c","observation_id":"b7869997-4f81-435a-8dcc-c51eb8f77481","resolution":{"observed_at":"2026-08-06T22:27:12.184080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22689","last_updated":"2024-10-30T04:49:39Z","snapshot_observed_at":"2026-08-19T14:52:13.644265Z","submitted_at":"2024-10-30T04:49:39Z","title":"Multi-Task Interactive Robot Fleet Learning with Visual World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22689","snapshot_observed_at":"2026-08-06T22:27:12.337553Z","title":"Multi-task interactive robot fleet learning with visual world models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.337553Z"},"links":{"cited_paper":"/paper/2410.22689","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:984f7ec097221720d1ce4b83e30eb86602d9f8d46791e225589bf55ee0418d84","observation_id":"ab5d7d07-d49f-4209-8e4b-d0cb1696efac","resolution":{"observed_at":"2026-08-06T22:27:12.337553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09905","last_updated":"2024-09-20T01:18:11Z","snapshot_observed_at":"2026-08-16T13:43:01.336372Z","submitted_at":"2024-06-14T10:23:53Z","title":"Nymeria: A Massive Collection of Multimodal Egocentric Daily Motion in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09905","snapshot_observed_at":"2026-08-06T22:27:12.397806Z","title":"Nymeria: A massive collection of multimodal egocentric daily motion in the wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.397806Z"},"links":{"cited_paper":"/paper/2406.09905","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:c2fa5ce19d455e1d587c77288330a68826340d15754b936352c4ccff7ed2462f","observation_id":"915bace1-ba85-46ee-9cfa-83cf3a31a8aa","resolution":{"observed_at":"2026-08-06T22:27:12.397806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00030","last_updated":"2023-03-07T02:29:59Z","snapshot_observed_at":"2026-08-11T15:42:16.204049Z","submitted_at":"2022-09-30T18:14:07Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00030","snapshot_observed_at":"2026-08-06T22:27:12.476631Z","title":"Vip: Towards universal visual reward and representation via value-implicit pre-training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.476631Z"},"links":{"cited_paper":"/paper/2210.00030","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:5847fd158774f9cd46a8d03b2eba0367a610600e94797031f0368c3eb6766adf","observation_id":"64b91c75-3233-4983-82aa-ace6556784a2","resolution":{"observed_at":"2026-08-06T22:27:12.476631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03654","last_updated":"2024-10-04T17:57:09Z","snapshot_observed_at":"2026-08-19T19:55:06.338018Z","submitted_at":"2024-10-04T17:57:09Z","title":"Learning Humanoid Locomotion over Challenging Terrain","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03654","snapshot_observed_at":"2026-08-06T22:27:12.602480Z","title":"Learning humanoid locomotion over challenging terrain","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.602480Z"},"links":{"cited_paper":"/paper/2410.03654","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:837dbae18dc2d594e4b437cae55e9f751fac77d162f9793f273bc1ee6705415d","observation_id":"5cba8897-3c0e-4557-acbe-2b5a95af0cfa","resolution":{"observed_at":"2026-08-06T22:27:12.602480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:27:13.656198Z","title":"Nomad: Goal masked diffusion policies for navigation and exploration","venue":null,"work_id":"4a363af2-5a6e-495d-9630-993c9e440232","year":2024},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.788959Z"},"links":{"citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:38bb4feac4eb5023a1cc366717c3f70a883a081a0141d480ff6f6dc09e821867","observation_id":"adc807b2-64db-4a00-bd96-9fd8bf705197","resolution":{"observed_at":"2026-08-06T22:27:13.722675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14916","last_updated":"2022-10-03T09:17:41Z","snapshot_observed_at":"2026-08-12T18:48:37.916493Z","submitted_at":"2022-09-29T16:27:53Z","title":"Human Motion Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14916","snapshot_observed_at":"2026-08-06T22:27:12.868765Z","title":"Human motion diffusion model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.868765Z"},"links":{"cited_paper":"/paper/2209.14916","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:2265da961a76bb37009de1036d4bdaaa13366cc70b99f85665a24f7694500664","observation_id":"e50ac786-57b7-4762-87d5-d67127cf447d","resolution":{"observed_at":"2026-08-06T22:27:12.868765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16498","last_updated":"2023-11-27T18:32:31Z","snapshot_observed_at":"2026-08-19T11:17:23.556847Z","submitted_at":"2023-11-27T18:32:31Z","title":"MagicAnimate: Temporally Consistent Human Image Animation using Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16498","snapshot_observed_at":"2026-08-06T22:27:12.954656Z","title":"Magicanimate: Temporally consistent human image animation using diffusion model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.954656Z"},"links":{"cited_paper":"/paper/2311.16498","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:bc18e86a452930c557a72c6996eee741a9daccf355d3ca96a72a9d2089831ff4","observation_id":"832e5ab1-9a6c-4011-b6a3-69ab5208e81a","resolution":{"observed_at":"2026-08-06T22:27:12.954656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06114","last_updated":"2024-09-26T17:14:09Z","snapshot_observed_at":"2026-08-13T12:06:46.989903Z","submitted_at":"2023-10-09T19:42:22Z","title":"Learning Interactive Real-World Simulators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06114","snapshot_observed_at":"2026-08-06T22:27:13.014581Z","title":"Learning interactive real-world simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:13.014581Z"},"links":{"cited_paper":"/paper/2310.06114","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:a537f53d1ab78a6db73c4644180fc2acfb0182223cf5b922a35d00d68bb716bd","observation_id":"f7d3182c-fe5c-4eba-ac3b-7e296eab4fa4","resolution":{"observed_at":"2026-08-06T22:27:13.014581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17139","last_updated":"2024-02-27T02:05:29Z","snapshot_observed_at":"2026-08-16T14:15:04.911971Z","submitted_at":"2024-02-27T02:05:29Z","title":"Video as the New Language for Real-World Decision Making","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17139","snapshot_observed_at":"2026-08-06T22:27:13.090738Z","title":"Video as the new language for real-world decision making","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:13.090738Z"},"links":{"cited_paper":"/paper/2402.17139","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:66ab44dd787f179b9dfb7be1c48d7273f53b45003145397bd8f2b673f0f3e40f","observation_id":"ebdd81f7-2e05-4cc2-aa21-62ef55f20a77","resolution":{"observed_at":"2026-08-06T22:27:13.090738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06953","last_updated":"2024-03-17T15:05:24Z","snapshot_observed_at":"2026-08-16T17:06:56.154674Z","submitted_at":"2022-04-14T13:25:01Z","title":"Convex Hulls of Grassmannians and Combinatorics of Symmetric Hypermatrices","version":4},"cited_work":{"arxiv_id":"2204.06953","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.06953","snapshot_observed_at":"2026-08-06T22:27:13.343257Z","title":"Convex Hulls of Grassmannians and Combinatorics of Symmetric Hypermatrices","venue":"math.CO","work_id":"ea4898c5-74f0-4270-ad73-fe62b13d5b96","year":2022},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:13.156049Z"},"links":{"cited_paper":"/paper/2204.06953","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:495db7fa8ac18f729c8088cd44a5bdbe34467960c671b69882f4c318700249c1","observation_id":"5373c07f-768b-4151-abab-271ebcdbc489","resolution":{"observed_at":"2026-08-06T22:27:13.391569Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04983","last_updated":"2025-02-01T02:40:49Z","snapshot_observed_at":"2026-08-20T17:02:33.222284Z","submitted_at":"2024-11-07T18:54:37Z","title":"DINO-WM: World Models on Pre-trained Visual Features enable Zero-shot Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04983","snapshot_observed_at":"2026-08-06T22:27:13.227811Z","title":"Dino-wm: World models on pre-trained visual features enable zero-shot planning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:13.227811Z"},"links":{"cited_paper":"/paper/2411.04983","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:3b4f8320ffd4987d27bdd804f365791d5ae2f67444df6fea3316be89d382b435","observation_id":"768f1eeb-2b7a-4555-bc1c-fee5a6f052c9","resolution":{"observed_at":"2026-08-06T22:27:13.227811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:27:13.800549Z","title":"A path towards autonomous machine intelligence version 0.9","venue":null,"work_id":"c77dbd6e-1752-4fe5-8e60-4d4e31b8185b","year":2022},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":1987,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.265036Z"},"links":{"citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:7ac07df2d6b1e4124197453775b6a27ae53ff205bc8281b38b3a87aaafa19cd5","observation_id":"35731d29-61ed-44c7-b09b-560b6a38d80f","resolution":{"observed_at":"2026-08-06T22:27:13.888225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-06T22:27:12.709929Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.709929Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:aeac8a1d8f7fe562b1a65b0f35643d6ce177110fc5f507710672af36689c48ea","observation_id":"5b8e026e-dc9a-4d89-9482-bb9c55cd4179","resolution":{"observed_at":"2026-08-06T22:27:12.709929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09344","last_updated":"2023-12-08T21:02:07Z","snapshot_observed_at":"2026-08-17T00:52:15.316289Z","submitted_at":"2023-06-15T17:59:50Z","title":"DreamSim: Learning New Dimensions of Human Visual Similarity using Synthetic Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09344","snapshot_observed_at":"2026-08-06T22:27:11.682054Z","title":"Dreamsim: Learning new dimensions of human visual similarity using synthetic data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:11.682054Z"},"links":{"cited_paper":"/paper/2306.09344","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:75a20bb316a67f1e56dd748a9c8dc73f6e607d53d9bf83a5c674e6a5451d59fa","observation_id":"004f4093-0531-4065-849e-d9050c3edb5d","resolution":{"observed_at":"2026-08-06T22:27:11.682054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02644","last_updated":"2024-01-05T05:28:40Z","snapshot_observed_at":"2026-08-16T14:29:42.154695Z","submitted_at":"2024-01-05T05:28:40Z","title":"Simple Hierarchical Planning with Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02644","snapshot_observed_at":"2026-08-06T22:27:11.212891Z","title":"Diamond: Diffusion as a model of environment dreams","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:11.212891Z"},"links":{"cited_paper":"/paper/2401.02644","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:b7f8d61867eb8c22a22505375a7e5190cbcc013dca81c6aaaffeca634c955c5c","observation_id":"219a00de-6606-4948-9502-fab9e58c88bb","resolution":{"observed_at":"2026-08-06T22:27:11.212891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07404","last_updated":"2016-01-19T20:58:24Z","snapshot_observed_at":"2026-08-14T22:21:40.154901Z","submitted_at":"2015-11-23T20:27:48Z","title":"Learning Visual Predictive Models of Physics for Playing Billiards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.07404","snapshot_observed_at":"2026-08-06T22:27:11.580219Z","title":"Learning visual predictive models of physics for playing billiards","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:11.580219Z"},"links":{"cited_paper":"/paper/1511.07404","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:bc6aadb77a7ad6bc0d1d62ac9bcefdfebad2a8aa7bd36f01362cd71970221b4a","observation_id":"1b94070a-d19a-463d-983f-c14da82e2ce0","resolution":{"observed_at":"2026-08-06T22:27:11.580219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.00568","last_updated":"2018-12-03T06:06:25Z","snapshot_observed_at":"2026-08-21T02:01:36.833225Z","submitted_at":"2018-12-03T06:06:25Z","title":"Visual Foresight: Model-Based Deep Reinforcement Learning for Vision-Based Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.00568","snapshot_observed_at":"2026-08-06T22:27:11.416015Z","title":"Visual foresight: Model-based deep reinforcement learning for vision-based robotic control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:11.416015Z"},"links":{"cited_paper":"/paper/1812.00568","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:6f061df476e338a9af3229524a14a1d080fff2ed9c43369cbadf707a8d4584e6","observation_id":"bc956f90-1756-4a5b-a5f8-2cb2adba2b03","resolution":{"observed_at":"2026-08-06T22:27:11.416015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18127","last_updated":"2024-09-26T17:59:31Z","snapshot_observed_at":"2026-08-16T13:15:00.975116Z","submitted_at":"2024-09-26T17:59:31Z","title":"EgoLM: Multi-Modal Language Model of Egocentric Motions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18127","snapshot_observed_at":"2026-08-06T22:27:12.102704Z","title":"Egolm: Multi-modal language model of egocentric motions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.102704Z"},"links":{"cited_paper":"/paper/2409.18127","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:ac2add08b28b18343c62149888ba2808ee27fda1af168d0c735111e12ba236c8","observation_id":"8591e448-ab8e-4ecc-b689-ed5cf3c5cbe5","resolution":{"observed_at":"2026-08-06T22:27:12.102704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-06T22:27:12.535853Z","title":"Gr00t n1: An open foundation model for generalist humanoid robots","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:12.535853Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:5a42bb62421e3b1418a2f5267ce45ba2c9366f4c69ec9f7d5b8a43ebb38ce635","observation_id":"6aed15e0-d027-4614-af4a-3fb8df385096","resolution":{"observed_at":"2026-08-06T22:27:12.535853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-08-18T07:04:58.690133Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-06T22:27:11.797333Z","title":"World models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:11.797333Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:8f6abce2f7f8f46ce9877b6bc0bf3294e05b47862670f9c9fe79c400567cc1c0","observation_id":"7eafa9a0-5c93-4a96-a0c0-0027bbd632ce","resolution":{"observed_at":"2026-08-06T22:27:11.797333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-08-15T13:40:01.739055Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-06T22:27:11.283673Z","title":"V-jepa 2: Self-supervised video models enable under- standing, prediction and planning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:11.283673Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:2d532451a7ce08aeab5bbde0f903e2848a37e7e6f5e20e1e8ae6af90fd8f75f0","observation_id":"4a74896d-df46-446c-84ed-5a70cfcd57cf","resolution":{"observed_at":"2026-08-06T22:27:11.283673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16796","last_updated":"2024-03-06T02:19:38Z","snapshot_observed_at":"2026-08-19T20:14:54.650795Z","submitted_at":"2024-02-26T18:09:24Z","title":"Expressive Whole-Body Control for Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16796","snapshot_observed_at":"2026-08-06T22:27:11.348483Z","title":"Expressive whole-body control for humanoid robots","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T22:27:11.348483Z"},"links":{"cited_paper":"/paper/2402.16796","citing_paper":"/paper/2506.21552"},"observation_digest":"sha256:e5453fa0ea8852a24505686f8ded93b952832f563832314a75be4e8a97b95635","observation_id":"c97cd563-993e-4c87-984d-db604f4652a9","resolution":{"observed_at":"2026-08-06T22:27:11.348483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.21552","last_updated":"2025-06-26T17:59:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T15:59:58.591721Z","submitted_at":"2025-06-26T17:59:59Z","title":"Whole-Body Conditioned Egocentric Video Prediction"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 16 inbound Pith citation observations for arXiv:2506.21552."}