{"as_of":"2026-08-05T21:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d88deaafba8e6fb567e2e5929cd4e9d1bb4dd6ea786aa211eeba82204674d55a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":37,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T19:45:29.112213Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":29,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2309.16797","last_updated":"2023-09-28T19:01:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T19:01:07Z","title":"Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-05-16T08:12:30.984870Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2309.16797"},"observation_digest":"sha256:3b4a5d82c120019fd983dce391ad35ea298bf42620638e88f42742331e31f5ba","observation_id":"4449c8c8-0794-4ced-94ca-c96fb1ec2f89","resolution":{"observed_at":"2026-05-16T08:12:31.451096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2310.02635","last_updated":"2026-04-23T15:06:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-04T07:56:42Z","title":"Reinforcement Learning with Foundation Priors: Let the Embodied Agent Efficiently Learn on Its Own","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-24T06:40:00.328012Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2310.02635"},"observation_digest":"sha256:b7adcf85c416dca56ddcbaaf51e52aec01385f1738b71863646cbfd8c21fa353","observation_id":"28f23de3-47b5-4868-8a91-12f589c0a723","resolution":{"observed_at":"2026-05-24T06:44:02.632413Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2310.06114","last_updated":"2024-09-26T17:14:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-09T19:42:22Z","title":"Learning Interactive Real-World Simulators","version":3},"reference_index":150,"source":"arxiv_source","source_observed_at":"2026-05-16T02:15:18.265190Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2310.06114"},"observation_digest":"sha256:359b2ba634752c5079078724f11ced84f09339166512d27ceac66434d16f8814","observation_id":"53d1ed87-c39f-4c81-ab91-6cbb333484c6","resolution":{"observed_at":"2026-05-16T02:15:18.438283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2310.10639","last_updated":"2023-10-16T17:57:23Z","snapshot_observed_at":"2026-07-06T16:34:04.003157Z","submitted_at":"2023-10-16T17:57:23Z","title":"Zero-Shot Robotic Manipulation with Pretrained Image-Editing Diffusion Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T05:54:58.940428Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2310.10639"},"observation_digest":"sha256:f5ff45afd1ff7a9a511989b3e888262276556cfb4a5dcc73797568f39a53da81","observation_id":"7aad9811-c1af-473d-a593-90f3f0c2b1fa","resolution":{"observed_at":"2026-05-16T05:54:59.186583Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2312.13139","last_updated":"2023-12-21T05:34:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-20T16:00:43Z","title":"Unleashing Large-Scale Video Generative Pre-training for Visual Robot Manipulation","version":2},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-05-13T16:32:05.538507Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2312.13139"},"observation_digest":"sha256:d65341331e34c3a385fe95191ac9ddb932fdab661eb64d3b3a614e7386643c05","observation_id":"dd2e3116-aded-4a26-9159-333620c740a1","resolution":{"observed_at":"2026-05-13T16:32:05.634609Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2402.10885","last_updated":"2024-07-25T14:30:22Z","snapshot_observed_at":"2026-07-06T17:31:17.058043Z","submitted_at":"2024-02-16T18:43:02Z","title":"3D Diffuser Actor: Policy Diffusion with 3D Scene Representations","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-17T22:00:04.812281Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2402.10885"},"observation_digest":"sha256:543b8e80bee23817a74e0b1e022f6b791692954ddc3293e8ad2420fe92612daa","observation_id":"16580b81-25e8-4297-af20-9168bc42f659","resolution":{"observed_at":"2026-05-17T22:00:04.980038Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2404.12377","last_updated":"2024-04-18T17:58:03Z","snapshot_observed_at":"2026-08-02T11:29:41.147175Z","submitted_at":"2024-04-18T17:58:03Z","title":"RoboDreamer: Learning Compositional World Models for Robot Imagination","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-15T20:47:30.225116Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2404.12377"},"observation_digest":"sha256:fcfd1d45d5182591d09a210636cfcd4bc3872b6cbe79e13e259ba68d8add0e85","observation_id":"3c377124-1f01-4941-8177-6e31729488ad","resolution":{"observed_at":"2026-05-15T20:47:30.291608Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2411.04983","last_updated":"2025-02-01T02:40:49Z","snapshot_observed_at":"2026-07-06T19:46:54.707852Z","submitted_at":"2024-11-07T18:54:37Z","title":"DINO-WM: World Models on Pre-trained Visual Features enable Zero-shot Planning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-17T16:06:09.448517Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2411.04983"},"observation_digest":"sha256:57053231d1bf3338a4af7caaf24e90b40b99f349595fd15d73a74eca990dde6f","observation_id":"051d6a03-3e00-40a5-b3f3-a9a87a078af3","resolution":{"observed_at":"2026-05-17T16:06:09.665289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2509.06951","last_updated":"2025-09-09T09:42:16Z","snapshot_observed_at":"2026-07-06T22:26:03.668339Z","submitted_at":"2025-09-08T17:58:30Z","title":"F1: A Vision-Language-Action Model Bridging Understanding and Generation to Actions","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T12:42:46.978148Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2509.06951"},"observation_digest":"sha256:1775eb5b307aa81458576ea0dbd63eed8c283f536163b85baf6de6decd002878","observation_id":"a34b8370-f2e1-48d5-aefc-cc1d85926d87","resolution":{"observed_at":"2026-05-16T12:42:47.028411Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2512.21898","last_updated":"2026-02-01T23:43:52Z","snapshot_observed_at":"2026-07-06T22:40:07.339525Z","submitted_at":"2025-12-26T07:11:47Z","title":"Flexible Multitask Learning with Factorized Diffusion Policy","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T19:21:52.191786Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2512.21898"},"observation_digest":"sha256:1de532ef2d72de63c6dbcd820615f30ba5252baad9b5dbaddd7bf174558c8283","observation_id":"893fbd03-dce9-4830-b37e-295459e3e9fd","resolution":{"observed_at":"2026-05-16T19:23:19.657891Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-03T03:25:12.114462Z","title":"org/CorpusID:270215984","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08236","last_updated":"2026-05-31T23:44:59Z","snapshot_observed_at":"2026-08-03T03:25:11.411186Z","submitted_at":"2026-02-09T03:21:48Z","title":"When and How Much to Imagine: Adaptive Test-Time Scaling with World Models for Visual Spatial Reasoning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T03:25:12.114462Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2602.08236"},"observation_digest":"sha256:6d1d61b395fce31fefa4f97a089e80b01999978f62333f992c588f2abd867403","observation_id":"5aea13e4-ca32-4d89-9b91-6c034cbbf98d","resolution":{"observed_at":"2026-08-03T03:25:12.114462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2603.16666","last_updated":"2026-03-23T05:41:14Z","snapshot_observed_at":"2026-07-06T22:49:23.750692Z","submitted_at":"2026-03-17T15:33:43Z","title":"Fast-WAM: Do World Action Models Need Test-time Future Imagination?","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-14T01:57:29.753735Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2603.16666"},"observation_digest":"sha256:8acc8325e6b3d36bc37417842b3b329a1ab8cc274c85e875f17ad67bb9256281","observation_id":"c4d5a03d-b1ec-4270-ba17-6d196b01d287","resolution":{"observed_at":"2026-05-14T01:57:30.021241Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2604.23278","last_updated":"2026-04-25T12:41:53Z","snapshot_observed_at":"2026-07-06T23:09:34.300163Z","submitted_at":"2026-04-25T12:41:53Z","title":"Active Inference: A method for Phenotyping Agency in AI systems?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T08:06:12.689488Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2604.23278"},"observation_digest":"sha256:d892a285bd8e5c18859ce97bebcab37e8dec5f1f2ab9e5c44dd1e4d29477d40a","observation_id":"48103c0b-efd5-4c0e-9aa1-ea394c2f5f58","resolution":{"observed_at":"2026-05-11T20:46:12.618350Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2604.25859","last_updated":"2026-05-02T20:40:07Z","snapshot_observed_at":"2026-07-31T08:21:54.444972Z","submitted_at":"2026-04-28T16:58:52Z","title":"Privileged Foresight Distillation: Zero-Cost Future Correction for World Action Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T15:42:10.954090Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2604.25859"},"observation_digest":"sha256:1244ccbe71a74b8a27d0e4ede830624466fca28c4b6760c7e33dcfc34ba8b51d","observation_id":"edf778e9-dacf-4518-9f91-4fdd5522b11f","resolution":{"observed_at":"2026-05-12T00:11:16.894537Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2605.01477","last_updated":"2026-05-02T14:52:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-02T14:52:03Z","title":"Action Agent: Agentic Video Generation Meets Flow-Constrained Diffusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-09T14:23:27.282627Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2605.01477"},"observation_digest":"sha256:36748eed707212160008c8494eeaae41eb6e4d0f5ddf9da58e90331432e850ab","observation_id":"738ef51e-2c2f-4bda-b3fc-d066122fba4e","resolution":{"observed_at":"2026-05-11T16:56:09.193044Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2605.06481","last_updated":"2026-05-07T16:06:08Z","snapshot_observed_at":"2026-08-03T04:45:05.402667Z","submitted_at":"2026-05-07T16:06:08Z","title":"OA-WAM: Object-Addressable World Action Model for Robust Robot Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T08:52:07.545191Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2605.06481"},"observation_digest":"sha256:0f3564bca822e9ab27252f54d197520d62a5429199207cfd941ef16c9756a63d","observation_id":"131f0481-cf10-4850-a7c2-00b789e90837","resolution":{"observed_at":"2026-05-11T20:31:11.206166Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2605.12090","last_updated":"2026-05-12T13:10:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T13:10:52Z","title":"World Action Models: The Next Frontier in Embodied AI","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T05:01:16.802019Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2605.12090"},"observation_digest":"sha256:d3b83b2cf82c60f7b2a7a18c6c090fced6b4d4509ab63cbad452b090bd498174","observation_id":"c20a33b8-6968-4825-b84f-1955a7f74b3f","resolution":{"observed_at":"2026-05-13T05:02:17.703667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2606.06155","last_updated":"2026-06-04T13:28:51Z","snapshot_observed_at":"2026-07-29T15:22:02.359291Z","submitted_at":"2026-06-04T13:28:51Z","title":"AffordanceVLA: A Vision-Language-Action Model Empowering Action Generation through Affordance-Aware Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T01:23:02.576098Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2606.06155"},"observation_digest":"sha256:d9b1be698d553715c4bf09cfad78696619c56a0aecbd7c7ef83e3cf20e89b5eb","observation_id":"22b9f2b5-d573-43dd-b6dd-22da6437a07b","resolution":{"observed_at":"2026-07-02T13:16:59.153547Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2606.07089","last_updated":"2026-06-05T09:35:48Z","snapshot_observed_at":"2026-08-03T20:55:19.434948Z","submitted_at":"2026-06-05T09:35:48Z","title":"Dreaming when Necessary: Advancing World Action Models with Adaptive Multi-Modal Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T21:59:35.783793Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2606.07089"},"observation_digest":"sha256:53b4850dcba95265426edc472e4691088de5a4c2737d584e616c96e63a3f08c8","observation_id":"1f163672-448a-4bdf-8bed-bfb8552baca5","resolution":{"observed_at":"2026-07-02T17:37:14.319737Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2606.13515","last_updated":"2026-06-11T16:02:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-11T16:02:42Z","title":"MaskWAM: Unifying Mask Prompting and Prediction for World-Action Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T06:55:53.760595Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2606.13515"},"observation_digest":"sha256:ae61100d5a4006817f7197c2f3a7267d9a4de3547c32fe7873526087cb2a0c44","observation_id":"3e5861dc-ecca-40a2-a6b2-008152697a0f","resolution":{"observed_at":"2026-07-03T14:48:32.861585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2606.20781","last_updated":"2026-06-18T17:05:19Z","snapshot_observed_at":"2026-08-03T05:46:19.564000Z","submitted_at":"2026-06-18T17:05:19Z","title":"World Action Models: A Survey","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T17:11:12.686936Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2606.20781"},"observation_digest":"sha256:73766f3ec8c5ccf0c2763c8761ffb20aa74cbbd6a7d7b7d0dd203cad8df241ce","observation_id":"3ed322c1-f6da-43ae-9481-493ae0f064c8","resolution":{"observed_at":"2026-07-04T04:09:35.545205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2606.26025","last_updated":"2026-07-03T15:34:07Z","snapshot_observed_at":"2026-07-12T12:05:57.041170Z","submitted_at":"2026-06-24T16:53:36Z","title":"In-Context World Modeling for Robotic Control","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-25T19:12:22.513577Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2606.26025"},"observation_digest":"sha256:fda943258be250ef2acef7011a0e9d8f2ce039e76d3a262578d564f60293cbf9","observation_id":"40a8ca26-79fa-457b-841c-b4bfa363426e","resolution":{"observed_at":"2026-07-04T21:00:09.595483Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2606.26025","last_updated":"2026-07-03T15:34:07Z","snapshot_observed_at":"2026-07-12T12:05:57.041170Z","submitted_at":"2026-06-24T16:53:36Z","title":"In-Context World Modeling for Robotic Control","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T05:11:07.089829Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2606.26025"},"observation_digest":"sha256:41e5e25d808303dcb088f941b9c83b3496ec4e677f4486016f5a21a43f7552c4","observation_id":"6b91501e-40bd-4457-8f19-a82fa350407b","resolution":{"observed_at":"2026-07-04T13:29:51.635613Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-07-12T12:05:57.682386Z","title":"Tenenbaum, Dale Schuurmans, and P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26025","last_updated":"2026-07-03T15:34:07Z","snapshot_observed_at":"2026-07-12T12:05:57.041170Z","submitted_at":"2026-06-24T16:53:36Z","title":"In-Context World Modeling for Robotic Control","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-12T12:05:57.682386Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2606.26025"},"observation_digest":"sha256:39df9f0938977d78af6d850585b8abbf6325b3d2bc66efea767faa8a1a083077","observation_id":"8510c816-092d-4cd2-8017-c403cec1f0a9","resolution":{"observed_at":"2026-07-12T12:05:57.682386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2606.27677","last_updated":"2026-07-12T12:46:30Z","snapshot_observed_at":"2026-08-02T12:54:53.370122Z","submitted_at":"2026-06-26T03:17:39Z","title":"DIM-WAM: World-Action Modeling with Diverse Historical Event Memory","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T04:58:47.490871Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2606.27677"},"observation_digest":"sha256:8cab940d0626ee922d96daa38ca4137828d847254acbd3b198b0a39028a13851","observation_id":"38293fa4-1028-4167-ad47-dd5f360510d3","resolution":{"observed_at":"2026-06-29T19:03:51.955502Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-07-14T17:14:54.438474Z","title":"Learning universal policies via text-guided video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27677","last_updated":"2026-07-12T12:46:30Z","snapshot_observed_at":"2026-08-02T12:54:53.370122Z","submitted_at":"2026-06-26T03:17:39Z","title":"DIM-WAM: World-Action Modeling with Diverse Historical Event Memory","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T17:14:54.438474Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2606.27677"},"observation_digest":"sha256:4d0a84475657eacdd87da6df820d7c3020a2a4c88e89e700bb662d9cb5400f7a","observation_id":"f863fee2-9264-4c2a-af57-aa599ac606e7","resolution":{"observed_at":"2026-07-14T17:14:54.438474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-07-25T08:02:03Z","snapshot_observed_at":"2026-08-02T09:17:59.992551Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-02T11:26:48.626947Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:8e80f7e4aa6cf29af4c0288112f1406d3a02c036c4cfbb4a581e9c50a120e72b","observation_id":"0224c08d-d671-475c-a8c3-458af97ce282","resolution":{"observed_at":"2026-07-02T11:26:53.637216Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-07-25T08:02:03Z","snapshot_observed_at":"2026-08-02T09:17:59.992551Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-03T20:35:21.512564Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:911e1d26a1d403803ad2cd5c785f71cc1df8ad87f343975e7633faba62b0f4be","observation_id":"aa3a32fa-9e77-411d-bd9f-7280c22ec27c","resolution":{"observed_at":"2026-07-03T20:38:55.101336Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-07-12T09:15:00.615740Z","title":"Feng, Y ., Tan, H., Mao, X., Xiang, C., Liu, G., Huang, S., Su, H., and Zhu, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-07-25T08:02:03Z","snapshot_observed_at":"2026-08-02T09:17:59.992551Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T09:15:00.615740Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:8824a201175b01858f5b031033ded858ee143c5b52509334c0c4468ec7230bd6","observation_id":"ba58773b-47bf-4341-885b-48563ee7a6a9","resolution":{"observed_at":"2026-07-12T09:15:00.615740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-02T09:18:00.899850Z","title":"Feng, Y ., Tan, H., Mao, X., Xiang, C., Liu, G., Huang, S., Su, H., and Zhu, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-07-25T08:02:03Z","snapshot_observed_at":"2026-08-02T09:17:59.992551Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T09:18:00.899850Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:0efbd72033d99ca77926adbce89c153dbf342a1c6f19a49179f8155199cfd77d","observation_id":"190fb4fd-ad78-4549-b79f-d95255377272","resolution":{"observed_at":"2026-08-02T09:18:00.899850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":"2302.00111","doi":"10.48550/arxiv.2302.00111","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"B., Schuurmans, D., and Abbeel, P","venue":"arXiv (Cornell University)","work_id":"d5eed546-aec4-42e8-8e69-fa3e41cc741a","year":2023},"citing_paper":{"arxiv_id":"2607.02501","last_updated":"2026-07-03T02:16:41Z","snapshot_observed_at":"2026-07-12T08:00:25.240507Z","submitted_at":"2026-07-02T17:58:28Z","title":"Embodied.cpp: A Portable Inference Runtime of Embodied AI Models on Heterogeneous Robots","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-03T10:37:31.925624Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2607.02501"},"observation_digest":"sha256:1f2fafe2edbee39e7fd222921529359e37a04415d1d1baa1c9afac219622e972","observation_id":"057bcb2c-1893-4ace-86f9-870b7f449b79","resolution":{"observed_at":"2026-07-03T10:37:56.091535Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-07-12T08:00:25.815355Z","title":"Du et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02501","last_updated":"2026-07-03T02:16:41Z","snapshot_observed_at":"2026-07-12T08:00:25.240507Z","submitted_at":"2026-07-02T17:58:28Z","title":"Embodied.cpp: A Portable Inference Runtime of Embodied AI Models on Heterogeneous Robots","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T08:00:25.815355Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2607.02501"},"observation_digest":"sha256:e4566d7fb1dfc57f6e00b4e6d68dc86ae5605cb79fa748b6df091adf1702d71d","observation_id":"cb64e93a-ac01-48f2-bd3a-7a5cb0eec469","resolution":{"observed_at":"2026-07-12T08:00:25.815355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-01T17:45:07.155259Z","title":"arXiv preprint arXiv:2302.00111 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17560","last_updated":"2026-07-20T05:09:36Z","snapshot_observed_at":"2026-08-05T13:38:45.921055Z","submitted_at":"2026-07-20T05:09:36Z","title":"Reinforcement Learning: From Algorithms To Foundation Models","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-08-01T17:45:07.155259Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2607.17560"},"observation_digest":"sha256:cab85fda57acccbac195228fa677521763964561088a152e2e5b4d0ba317f722","observation_id":"20f3d2d6-7db0-424c-85f4-4624ee8f01c4","resolution":{"observed_at":"2026-08-01T17:45:07.155259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-01T14:39:34.790951Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18709","last_updated":"2026-07-22T05:33:17Z","snapshot_observed_at":"2026-08-04T15:25:40.989347Z","submitted_at":"2026-07-21T05:05:01Z","title":"RoboInter1.5: A Holistic Intermediate Representation Suite for Embodied World Modeling and Robotic Manipulation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T14:39:34.790951Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2607.18709"},"observation_digest":"sha256:52dbba11866afeffd816f875d42fd203570620bbec8ffde38221aca8392fe5e0","observation_id":"3c4b1f47-2703-407d-80e6-6da9a6947cec","resolution":{"observed_at":"2026-08-01T14:39:34.790951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-07-31T06:18:55.446655Z","title":"Tenenbaum, Dale Schuurmans, and Pieter Abbeel","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.24744","last_updated":"2026-07-27T17:59:58Z","snapshot_observed_at":"2026-07-31T06:18:51.908689Z","submitted_at":"2026-07-27T17:59:58Z","title":"Data Pyramid for Embodied Manipulation","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-07-31T06:18:55.446655Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2607.24744"},"observation_digest":"sha256:9aa8142cef9d3c793e7202f051124cff6a55be772b652835e644c6113bb9c6c8","observation_id":"6023abad-79c6-4591-ad91-af29bd80cb8b","resolution":{"observed_at":"2026-07-31T06:18:55.446655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-01T01:15:07.962162Z","title":"Learning universal policies via text-guided video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25895","last_updated":"2026-07-28T15:52:02Z","snapshot_observed_at":"2026-08-01T01:15:06.941404Z","submitted_at":"2026-07-28T15:52:02Z","title":"HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T01:15:07.962162Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2607.25895"},"observation_digest":"sha256:5868b8c594e76ed4a7136272cb301dfa0a1007f637b6b1011dfa6c2b993b2a55","observation_id":"b9d5f229-40a8-4cdc-bfc8-0a0827f763b4","resolution":{"observed_at":"2026-08-01T01:15:07.962162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00111","snapshot_observed_at":"2026-08-04T19:45:29.112213Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-05T20:55:43.054652Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:29.112213Z"},"links":{"cited_paper":"/paper/2302.00111","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:58a03ea811608cb253eb836c1a806f6c1d98e9f1d81a4cbfa657296420a683c6","observation_id":"397e8d53-82db-438f-ae72-71e0583edebc","resolution":{"observed_at":"2026-08-04T19:45:29.112213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2302.00111/citation-record","integrity":"/paper/2302.00111/integrity","json":"/paper/2302.00111/citation-record.json","paper":"/paper/2302.00111"},"outbound":[],"paper":{"arxiv_id":"2302.00111","last_updated":"2023-11-20T05:38:13Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-05T19:35:53.885395Z","submitted_at":"2023-01-31T21:28:13Z","title":"Learning Universal Policies via Text-Guided Video Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 37 inbound Pith citation observations for arXiv:2302.00111."}