{"as_of":"2026-08-03T22:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:85f488679ee7d50f1ca4c8d936cbc2691c11fe5631b356c17c33f64d55399435","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T05:21:36.855439Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T02:04:26.253123Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2409.16283","last_updated":"2024-09-24T17:57:33Z","snapshot_observed_at":"2026-07-06T19:21:20.826877Z","submitted_at":"2024-09-24T17:57:33Z","title":"Gen2Act: Human Video Generation in Novel Scenarios enables Generalizable Robot Manipulation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-15T12:17:01.294466Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2409.16283"},"observation_digest":"sha256:1896333b200e63208d5a1c324213bb86f5f57470923afddd8cbd69efeb4284b6","observation_id":"7bf51a50-cdb3-450e-b276-1f093362f7a4","resolution":{"observed_at":"2026-05-15T12:17:01.445669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2503.22020","last_updated":"2025-03-27T22:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-27T22:23:04Z","title":"CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T05:21:44.903048Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2503.22020"},"observation_digest":"sha256:74ac908c0f1399ef0184a6cac4eebb033e9e7a36647b95b6708ba0787143fa3e","observation_id":"5528f362-71d3-4c40-b732-4bd10594960f","resolution":{"observed_at":"2026-05-16T05:21:45.195212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2506.14135","last_updated":"2026-05-22T16:05:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-17T02:55:20Z","title":"GAF: Gaussian Action Field as a 4D Representation for Dynamic World Modeling in Robotic Manipulation","version":5},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-25T07:48:33.832017Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2506.14135"},"observation_digest":"sha256:13d070f50d2619678953af9f45791d37af3b8d3a6fc94cf0a57959903dc59b8d","observation_id":"669975e1-3c9b-4f9f-aebc-ad7f8e47dfad","resolution":{"observed_at":"2026-05-25T07:50:29.253724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2507.00990","last_updated":"2026-05-13T01:35:48Z","snapshot_observed_at":"2026-07-06T21:50:35.488353Z","submitted_at":"2025-07-01T17:39:59Z","title":"Robotic Manipulation by Imitating Generated Videos Without Physical Demonstrations","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-19T06:36:13.144868Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2507.00990"},"observation_digest":"sha256:1eff6b43d3087640ce7bef24549a55671b721fb2755ee7685285f44aa04c7b9b","observation_id":"696934a0-dcad-425d-89f4-23c0347c66ab","resolution":{"observed_at":"2026-05-19T06:37:07.305473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2507.01099","last_updated":"2026-05-17T19:33:54Z","snapshot_observed_at":"2026-08-02T13:47:45.555967Z","submitted_at":"2025-07-01T18:01:41Z","title":"Geometry-aware 4D Video Generation for Robot Manipulation","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T00:12:39.787489Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2507.01099"},"observation_digest":"sha256:87c3cb97466cec2c5c84bf37767406bbbc586367ebb4d8ef9eb150f12a149bee","observation_id":"f79772b2-0054-4973-82f3-263257369076","resolution":{"observed_at":"2026-05-22T00:14:27.884033Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2512.15692","last_updated":"2025-12-19T18:30:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-17T18:47:31Z","title":"mimic-video: Video-Action Models for Generalizable Robot Control Beyond VLAs","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T10:41:00.142543Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2512.15692"},"observation_digest":"sha256:5507b58f0970718848e544ef804c44004e716cc23e9d1c726daa75b722fa1ae4","observation_id":"caa28f53-b6f4-4a3e-a39f-a025a7b12aa7","resolution":{"observed_at":"2026-05-15T10:41:00.342113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2512.15840","last_updated":"2026-05-08T06:37:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-17T18:35:54Z","title":"Large Video Planner Enables Generalizable Robot Control","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T21:26:32.048309Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2512.15840"},"observation_digest":"sha256:71954b211fb3e9efa32181c1b96e9f60a4dcc00cabeade850564a1f836c6088f","observation_id":"64bd6233-9932-4394-b58a-bce55cb9a266","resolution":{"observed_at":"2026-05-16T21:28:33.968348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-08-03T05:21:36.855439Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02762","last_updated":"2026-07-02T00:32:14Z","snapshot_observed_at":"2026-08-03T05:21:33.080764Z","submitted_at":"2026-02-02T20:13:43Z","title":"On the Sample Efficiency of Inverse Dynamics Models for Semi-Supervised Imitation Learning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-03T05:21:36.855439Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2602.02762"},"observation_digest":"sha256:17b8fc8bdc15e209ea33e3ab8eb0576aadf37cb0add68de5e444238ce7d2d6ef","observation_id":"6649c285-688d-4903-8454-803e12168c16","resolution":{"observed_at":"2026-08-03T05:21:36.855439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-08-03T02:45:07.166991Z","title":"Dreamitate: Real-world visuomotor policy learning via video genera- tion.arXiv preprint arXiv:2406.16862,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.09878","last_updated":"2026-05-26T17:06:15Z","snapshot_observed_at":"2026-08-03T02:45:05.244742Z","submitted_at":"2026-02-10T15:19:17Z","title":"MVISTA-4D: View-Consistent 4D World Model with Test-Time Action Inference for Robotic Manipulation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T02:45:07.166991Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2602.09878"},"observation_digest":"sha256:008735e480c6bf346f541add19f07b2ff8d755d602d4b7cbd7b1c3326737981f","observation_id":"2450f2a5-996f-4fc8-95f0-5f3313ae8295","resolution":{"observed_at":"2026-08-03T02:45:07.166991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2603.09030","last_updated":"2026-04-06T01:32:12Z","snapshot_observed_at":"2026-07-30T02:16:48.709523Z","submitted_at":"2026-03-09T23:58:07Z","title":"PlayWorld: Learning Robot World Models from Autonomous Play","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T14:05:32.112432Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2603.09030"},"observation_digest":"sha256:cb3548d9e268706b34308eb33ca8b901f1213b802877fc860dcc0726c3e514ab","observation_id":"9d3dcf4d-fad2-41f5-b0d4-a89fdda96f40","resolution":{"observed_at":"2026-05-15T14:05:54.587400Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2604.21914","last_updated":"2026-04-23T17:57:13Z","snapshot_observed_at":"2026-07-31T18:25:32.532748Z","submitted_at":"2026-04-23T17:57:13Z","title":"VistaBot: View-Robust Robot Manipulation via Spatiotemporal-Aware View Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-09T21:18:12.192842Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2604.21914"},"observation_digest":"sha256:f85e63ca180d98f30c0552fed60e6bc9a6ba628d7f8b9c2c6442e5a2d3690e00","observation_id":"6f6344db-7ba2-4cde-87ca-055415a5aca3","resolution":{"observed_at":"2026-05-11T14:41:15.698372Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2605.12090","last_updated":"2026-05-12T13:10:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T13:10:52Z","title":"World Action Models: The Next Frontier in Embodied AI","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-13T05:01:16.802019Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2605.12090"},"observation_digest":"sha256:710eb0b99557eb93e7ebe024236529f90000f9c6c2360d581bca2781006561e2","observation_id":"a7d0a91d-4bc0-4118-a456-d83e8cd36f80","resolution":{"observed_at":"2026-05-13T05:02:17.885588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2605.28816","last_updated":"2026-05-27T17:59:31Z","snapshot_observed_at":"2026-07-06T23:38:19.096349Z","submitted_at":"2026-05-27T17:59:31Z","title":"Gamma-World: Generative Multi-Agent World Modeling Beyond Two Players","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T13:34:03.020051Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2605.28816"},"observation_digest":"sha256:94e52d3652f27ffed650199a2a3ede33109e10bd0999070a4b6048f9685a7289","observation_id":"a410089f-a6ac-4699-9217-18dee161c133","resolution":{"observed_at":"2026-06-29T13:53:29.072890Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2606.04811","last_updated":"2026-06-04T10:52:20Z","snapshot_observed_at":"2026-08-02T17:55:30.069492Z","submitted_at":"2026-06-03T12:35:35Z","title":"Dream.exe: Can Video Generation Models Dream Executable Robot Manipulation?","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-28T06:33:03.192410Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2606.04811"},"observation_digest":"sha256:58a76551cd2a0ae5d3d2dbb0bb4dd6934cd46ef6e7b5200f2cd7915a2f34217c","observation_id":"1d208fd3-f883-41fd-866a-b7d63be24ec6","resolution":{"observed_at":"2026-07-02T07:56:47.496904Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2606.11187","last_updated":"2026-06-09T17:59:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-09T17:59:22Z","title":"Next Forcing: Causal World Modeling with Multi-Chunk Prediction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T13:31:53.905704Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2606.11187"},"observation_digest":"sha256:9197e418c305538798319f29bff6d0d680102855f4c23ce80d1699e3f835ece6","observation_id":"642dda2d-4f0b-415b-8500-f0b9a00f36c6","resolution":{"observed_at":"2026-07-03T04:57:38.465704Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2606.15032","last_updated":"2026-06-28T03:48:42Z","snapshot_observed_at":"2026-07-06T23:52:28.557859Z","submitted_at":"2026-06-13T00:21:21Z","title":"How Should World Models Be Evaluated for Embodied Decision-Making? A Decision-Making-Centric Position","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T10:31:37.108792Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2606.15032"},"observation_digest":"sha256:af56c0ea03ff3782bc9cacf67110463387449d6ffd1b24cda035f5c6643e75ae","observation_id":"dfbb8428-6a15-45cc-95f8-6bce5700922e","resolution":{"observed_at":"2026-06-30T10:34:36.513994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2606.19340","last_updated":"2026-06-19T13:42:23Z","snapshot_observed_at":"2026-08-02T05:06:10.398443Z","submitted_at":"2026-06-17T17:59:56Z","title":"ZeroDex: Zero-Shot Long-Horizon Dexterous Manipulation via Multi-View 3D-Grounded VLM Reasoning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T20:49:01.269513Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2606.19340"},"observation_digest":"sha256:b49aac18e2163d79a94c6319ce0129d1f2ccc5ed88ae60f84b9d6f17cd3d0912","observation_id":"157e930f-ef18-40cb-b0a5-bb97c8a34d6f","resolution":{"observed_at":"2026-07-04T00:59:20.283368Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2606.20781","last_updated":"2026-06-18T17:05:19Z","snapshot_observed_at":"2026-08-03T05:46:19.564000Z","submitted_at":"2026-06-18T17:05:19Z","title":"World Action Models: A Survey","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-06-26T17:11:12.686936Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2606.20781"},"observation_digest":"sha256:300877287e266916ec48bc177bf2d4bfc4174a86fbf2cd6dce3bfcbde961e62e","observation_id":"99f5512c-fe96-42b1-901b-e30795d594d7","resolution":{"observed_at":"2026-07-04T04:09:35.446108Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2606.22136","last_updated":"2026-06-23T09:28:18Z","snapshot_observed_at":"2026-07-06T23:57:04.096779Z","submitted_at":"2026-06-20T16:31:40Z","title":"Wh0: Generative World Models as Scalable Sources of Egocentric Human Hand Manipulation Data","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T11:47:54.951618Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2606.22136"},"observation_digest":"sha256:903e80d0f147971f3b214b5833b340ba0253e9b123252495898f74f2215608b0","observation_id":"d6719368-3924-4b30-9b62-086d573cc5f4","resolution":{"observed_at":"2026-07-04T08:19:44.723733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":"2406.16862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-07-08T02:04:26.253123Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation","venue":"cs.RO","work_id":"45d8eed6-8b6f-40b3-99c2-eb10a736919a","year":2024},"citing_paper":{"arxiv_id":"2607.06559","last_updated":"2026-07-07T17:58:15Z","snapshot_observed_at":"2026-07-10T23:18:28.634748Z","submitted_at":"2026-07-07T17:58:15Z","title":"RynnWorld-4D: 4D Embodied World Models for Robotic Manipulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-08T02:00:30.551638Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2607.06559"},"observation_digest":"sha256:4df20b403b54977469558b8ca24893fe5bbb512992178a956c8c2436fedf9252","observation_id":"a8320374-7948-4fc0-adbd-e24c6de68087","resolution":{"observed_at":"2026-07-08T02:04:26.255255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-08-02T00:04:04.293371Z","title":"Dreamitate: Real-world visuomotor policy learning via video generation.arXiv preprint arXiv:2406.16862, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15330","last_updated":"2026-07-22T11:38:14Z","snapshot_observed_at":"2026-08-02T00:03:57.503409Z","submitted_at":"2026-07-16T16:02:25Z","title":"Xiaomi-Robotics-1: Scaling Vision-Language-Action Models with over 100K Hours of Real-World Trajectories","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T00:04:04.293371Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2607.15330"},"observation_digest":"sha256:6dfa9f1c7cd2f73bc1ef8bad8648fbee7e92f258d1a7f7b0f814e65bf7873d5b","observation_id":"88dc05cd-c5fc-4fa2-9d21-a6d5acb375d6","resolution":{"observed_at":"2026-08-02T00:04:04.293371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-08-01T20:30:42.818011Z","title":"Dreamitate: Real-world visuomotor policy learning via video genera- tion.arXiv preprint arXiv:2406.16862,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16602","last_updated":"2026-07-21T07:58:44Z","snapshot_observed_at":"2026-08-01T20:30:39.973896Z","submitted_at":"2026-07-18T02:42:27Z","title":"PAVXploreRL: Physical-Action-Visual World Model Reinforcement Learning with Action Exploration","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T20:30:42.818011Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2607.16602"},"observation_digest":"sha256:1518ba742ab7092e43ea27fbd53be29fbcb134795bcd5385cf0aec0bdf2ceb51","observation_id":"f8351085-71b3-4046-b884-51628f00edf5","resolution":{"observed_at":"2026-08-01T20:30:42.818011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.16862/citation-record","integrity":"/paper/2406.16862/integrity","json":"/paper/2406.16862/citation-record.json","paper":"/paper/2406.16862"},"outbound":[],"paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 3 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2406.16862."}