{"as_of":"2026-08-09T14:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:db600ddb8bb41bacafe0d7db985466142547f0b67e6328039f3c696d74f84001","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:56:12.204432Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:12:50.540589Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T04:09:35.073117Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-08-04T09:12:50.540589Z","title":"RoboScape: Physics-informed embodied world model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.16732","last_updated":"2026-06-25T19:54:02Z","snapshot_observed_at":"2026-08-07T10:54:05.573771Z","submitted_at":"2025-10-19T07:12:32Z","title":"A Comprehensive Survey on World Models for Embodied AI","version":3},"reference_index":180,"source":"pdf_text","source_observed_at":"2026-08-04T09:12:50.540589Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2510.16732"},"observation_digest":"sha256:b20822fba928d49c8de80f47258584da10b54b26e3a44c2130c8871f5083dcfc","observation_id":"9c88a007-1a15-4057-ade8-dede4d9cbb6a","resolution":{"observed_at":"2026-08-04T09:12:50.540589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-08-02T22:14:29.363273Z","title":"Roboscape: Physics-informed em- bodied world model.arXiv preprint arXiv:2506.23135, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.17659","last_updated":"2026-07-15T16:20:07Z","snapshot_observed_at":"2026-08-07T19:47:50.377420Z","submitted_at":"2026-02-19T18:59:20Z","title":"When Vision Overrides Language: Evaluating and Mitigating Counterfactual Failures in VLAs","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T22:14:29.363273Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2602.17659"},"observation_digest":"sha256:1d825697e9031cf738eff7682e0ee47f0c7543150f6f9930ad732a6ab014adc0","observation_id":"57637e3b-60f3-4d39-a542-0b88da57c286","resolution":{"observed_at":"2026-08-02T22:14:29.363273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2604.16592","last_updated":"2026-04-17T17:51:46Z","snapshot_observed_at":"2026-07-06T23:03:52.631613Z","submitted_at":"2026-04-17T17:51:46Z","title":"Human Cognition in Machines: A Unified Perspective of World Models","version":1},"reference_index":148,"source":"pdf_text","source_observed_at":"2026-05-10T08:12:15.663761Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2604.16592"},"observation_digest":"sha256:6e4e6a16646c60e511480a996b4aaa9fb67a7a11a1691cb09ccc99302ef0e0f8","observation_id":"f42f9a17-424f-4226-8e30-79d303f1653b","resolution":{"observed_at":"2026-05-10T08:12:26.216061Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2604.26509","last_updated":"2026-05-08T13:30:17Z","snapshot_observed_at":"2026-07-06T23:12:10.599132Z","submitted_at":"2026-04-29T10:17:55Z","title":"3D Generation for Embodied AI and Robotic Simulation: A Survey","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-07T13:16:44.508344Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2604.26509"},"observation_digest":"sha256:56fd5c669edf0b9af4407471f08996e1baee1137e7f0ee78b341cc2fc96ac1a4","observation_id":"d426032a-e27d-44ad-9cad-ff36a6bd7e82","resolution":{"observed_at":"2026-05-12T09:01:25.627188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2604.26509","last_updated":"2026-05-08T13:30:17Z","snapshot_observed_at":"2026-07-06T23:12:10.599132Z","submitted_at":"2026-04-29T10:17:55Z","title":"3D Generation for Embodied AI and Robotic Simulation: A Survey","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-08T03:31:05.311070Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2604.26509"},"observation_digest":"sha256:ba0e0f0e3b53f99533185e347e98962ac1eb4c1cf3f9db942de39f8f6704ad72","observation_id":"e47e6e6a-f702-4b75-8771-51336da2d470","resolution":{"observed_at":"2026-05-11T22:01:14.129353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2604.26509","last_updated":"2026-05-08T13:30:17Z","snapshot_observed_at":"2026-07-06T23:12:10.599132Z","submitted_at":"2026-04-29T10:17:55Z","title":"3D Generation for Embodied AI and Robotic Simulation: A Survey","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-11T01:56:24.510913Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2604.26509"},"observation_digest":"sha256:9e1e795997e790f677b008fcd948229c2ada9db83cc284060eddb0ba352414f9","observation_id":"1eaa3cbd-aa32-4ac2-8366-287f17431018","resolution":{"observed_at":"2026-05-11T04:05:58.445921Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2605.08279","last_updated":"2026-05-08T07:03:13Z","snapshot_observed_at":"2026-08-03T18:22:55.551744Z","submitted_at":"2026-05-08T07:03:13Z","title":"LaWM: Least Action World Models for Long-Horizon Physical Consistency from Visual Observations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T00:49:47.283703Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2605.08279"},"observation_digest":"sha256:4a9b9e675f0e920c576464d337e4123f9a6946c9faed233530495bc64e891e94","observation_id":"f2fad854-525a-4365-aa7c-85e6a9450b89","resolution":{"observed_at":"2026-05-12T00:51:15.618859Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2605.12090","last_updated":"2026-05-12T13:10:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T13:10:52Z","title":"World Action Models: The Next Frontier in Embodied AI","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T05:01:16.802019Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2605.12090"},"observation_digest":"sha256:56a07d659c7ea90bc10236621695a61b47c722138b3b9509f1e6665d168bdc88","observation_id":"a09438cd-c62c-42c2-b86e-b460a869c4f3","resolution":{"observed_at":"2026-05-13T05:07:18.367935Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2605.17912","last_updated":"2026-05-18T06:18:21Z","snapshot_observed_at":"2026-08-02T17:44:18.118027Z","submitted_at":"2026-05-18T06:18:21Z","title":"WorldArena 2.0: Extending Embodied World Model Benchmarking on Modality, Functionality and Platform","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T10:59:54.879907Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2605.17912"},"observation_digest":"sha256:946d663d999533735fb432752103111f1603c36519ce4496bbf627a4f841acff","observation_id":"6489af55-6b02-49aa-b278-02ec9e316297","resolution":{"observed_at":"2026-05-20T11:03:13.655266Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2605.18303","last_updated":"2026-05-18T12:20:54Z","snapshot_observed_at":"2026-08-02T12:26:28.647804Z","submitted_at":"2026-05-18T12:20:54Z","title":"PH-Dreamer: A Physics-Driven World Model via Port-Hamiltonian Generative Dynamics","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-20T12:27:13.931203Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2605.18303"},"observation_digest":"sha256:04ce76205792e79170b8c964ffcc15aa5e9e51598fbf65f5f7fc4d0abef561bc","observation_id":"da896781-fda5-4524-b0f7-815ccf9160ad","resolution":{"observed_at":"2026-05-20T12:28:16.642956Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2606.20781","last_updated":"2026-06-18T17:05:19Z","snapshot_observed_at":"2026-08-03T05:46:19.564000Z","submitted_at":"2026-06-18T17:05:19Z","title":"World Action Models: A Survey","version":1},"reference_index":139,"source":"pdf_text","source_observed_at":"2026-06-26T17:11:12.686936Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2606.20781"},"observation_digest":"sha256:46d5436d77995c6e563f384102ab8e69e7cec4c1dc5b6db2bbc5681551fd0930","observation_id":"79cc5bce-f565-448b-9c3d-acacc7555edd","resolution":{"observed_at":"2026-07-04T04:09:35.075140Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2606.28128","last_updated":"2026-06-26T14:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-26T14:30:18Z","title":"PhysisForcing: Physics Reinforced World Simulator for Robotic Manipulation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:38.286863Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2606.28128"},"observation_digest":"sha256:c8e481bd4a58ef310f8e218acd016acae2f1f0b20dfa47af07e667d94836003d","observation_id":"291c85bc-4e60-4dfb-9c64-43ad97278ae3","resolution":{"observed_at":"2026-06-29T20:03:56.944785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2607.00148","last_updated":"2026-06-30T20:27:22Z","snapshot_observed_at":"2026-07-31T09:30:04.953246Z","submitted_at":"2026-06-30T20:27:22Z","title":"3D Point World Models: Point Completion Enables More Accurate Dynamics Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-02T18:49:21.268436Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2607.00148"},"observation_digest":"sha256:1809d18a78ccb0d9482257eb07bcdddc8fb8d4751f75e1db31a81aa6f675d763","observation_id":"98c5f914-e528-439a-9b1d-6920cbb0c665","resolution":{"observed_at":"2026-07-02T18:57:16.312504Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-07-25T08:02:03Z","snapshot_observed_at":"2026-08-02T09:17:59.992551Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-02T11:26:48.626947Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:7b9115d920485460c493e8bfe94cf0fa6a74cc638afe8502617a84dfe6f14f6d","observation_id":"9bcd3fec-a7ff-4f7c-b461-5a65f73a6867","resolution":{"observed_at":"2026-07-02T11:26:53.598722Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":"2506.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-04T04:09:35.073117Z","title":"Roboscape: Physics-informed embodied world model","venue":null,"work_id":"a9ab7540-f2d0-4eb9-af1c-7c06b6b5cd13","year":2025},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-07-25T08:02:03Z","snapshot_observed_at":"2026-08-02T09:17:59.992551Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-03T20:35:21.512564Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:2e3e6a148fa2551903a6212fd04055186308cf5d8eff3eb28773bb3093aa716d","observation_id":"538961d0-f7ea-4f8e-a46e-f1815aa46964","resolution":{"observed_at":"2026-07-03T20:38:55.071831Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-07-12T09:15:00.615740Z","title":"Team, R., Gao, Z., Wang, Q., Zeng, Y ., Zhu, J., Cheng, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-07-25T08:02:03Z","snapshot_observed_at":"2026-08-02T09:17:59.992551Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T09:15:00.615740Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:da0642c27c185c43dbab0cde3b0f6a9321a3c9cd636657873841bfa9e63a3a27","observation_id":"67fe7133-97a8-4a3c-8f59-4de49a24ec89","resolution":{"observed_at":"2026-07-12T09:15:00.615740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23135","snapshot_observed_at":"2026-08-02T09:18:02.223470Z","title":"Team, R., Gao, Z., Wang, Q., Zeng, Y ., Zhu, J., Cheng, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-07-25T08:02:03Z","snapshot_observed_at":"2026-08-02T09:17:59.992551Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T09:18:02.223470Z"},"links":{"cited_paper":"/paper/2506.23135","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:f91bd6de78e81d5cad045fdd38c257e0ea0f4c45698b29f034688b5431342e25","observation_id":"34389e60-3875-4b15-816b-0f6f6a8ee6d4","resolution":{"observed_at":"2026-08-02T09:18:02.223470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.23135/citation-record","integrity":"/paper/2506.23135/integrity","json":"/paper/2506.23135/citation-record.json","paper":"/paper/2506.23135"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T21:56:06.958528Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:06.958528Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:2bcbbc9dc715fd5b0bdd0a702e6e36f21d89ed4efd044679199555b4d1351736","observation_id":"38930093-e900-414b-835b-7751ed3d240f","resolution":{"observed_at":"2026-08-06T21:56:06.958528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T21:56:06.986653Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:06.986653Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:7f25bb9493bf2f973d6e3ada073975aad11f0914f484c1d1a5108bb70bb7dbb8","observation_id":"2e303d10-5f94-4c31-a800-b353f9fb53a5","resolution":{"observed_at":"2026-08-06T21:56:06.986653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:07.026710Z","title":"Bridgedata v2: A dataset for robot learning at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.026710Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:679a1d97656ff26421fe1c2ac0f9ada3c59cd04f17c1f7bedec841664badc9f9","observation_id":"d47fb436-0856-4b39-b449-74b9b92ddd03","resolution":{"observed_at":"2026-08-06T21:56:07.026710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:14.929245Z","title":"Open x- embodiment: Robotic learning datasets and rt-x models: Open x-embodiment collaboration 0","venue":null,"work_id":"fc53be07-bf76-4826-ae11-acc7fa83b482","year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.071219Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:d95bef22daef1edb0a5dbb60c0bd5a54259d27951dba8947de765e929e068300","observation_id":"3be0d1c2-ef87-464a-abb7-4030a58c1160","resolution":{"observed_at":"2026-08-06T21:56:14.993377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-06T21:56:07.107996Z","title":"Droid: A large-scale in-the-wild robot manipulation dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.107996Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:448f9a02dbfe5e4d6f1ce5939fd4297d2e47569f6b7c43b07085a125b60c87cd","observation_id":"10480055-fd18-4966-8bac-b26ec3fe30a6","resolution":{"observed_at":"2026-08-06T21:56:07.107996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:07.203399Z","title":"Recurrent world models facilitate policy evolution","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.203399Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:b0630d182bac4f71f88193855d60d19a76f4a0cd6384545f77f30fe9d86ce8b7","observation_id":"f436cb02-c51c-4eab-bd03-ade6e1cfde89","resolution":{"observed_at":"2026-08-06T21:56:07.203399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06114","last_updated":"2024-09-26T17:14:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-09T19:42:22Z","title":"Learning Interactive Real-World Simulators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06114","snapshot_observed_at":"2026-08-06T21:56:07.249016Z","title":"Learning interactive real-world simulators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.249016Z"},"links":{"cited_paper":"/paper/2310.06114","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:047e1ff7d04e44a0ac3c8c691d0767146bae5c7904d2d9bcb6369147adf13d2f","observation_id":"c5fdb139-b76b-4091-8cf7-a790a14b5b24","resolution":{"observed_at":"2026-08-06T21:56:07.249016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:07.330002Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.330002Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:9c3c61a07b3c8250c4caf60e7c21d8b3a946b8f8ecb51dab130c8f38e0dad5c5","observation_id":"7d94741e-4de4-4bf5-9775-e26df3caed41","resolution":{"observed_at":"2026-08-06T21:56:07.330002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04296","last_updated":"2025-02-06T18:38:26Z","snapshot_observed_at":"2026-08-09T02:35:32.610331Z","submitted_at":"2025-02-06T18:38:26Z","title":"Learning Real-World Action-Video Dynamics with Heterogeneous Masked Autoregression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04296","snapshot_observed_at":"2026-08-06T21:56:07.377797Z","title":"Learning re al-world action-video dynamics with heterogeneous masked autoregression","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.377797Z"},"links":{"cited_paper":"/paper/2502.04296","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:3061760b3db37809bd903d93193b65ff7ea53dbd4229fadf8413e7126bf10173","observation_id":"ec0af1ce-0849-43d9-b8bc-48751245927f","resolution":{"observed_at":"2026-08-06T21:56:07.377797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:14.700492Z","title":"ivideogpt: Interactive videogpts are scalable world models","venue":null,"work_id":"406fdd52-72f4-4734-b5a9-83add73664a9","year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.427555Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:d571f4ef3cbf5c6f213b08d9362675fe2111aa8161e4118991c14cde274d15a9","observation_id":"bf904acc-7b61-439b-b3c8-65131c99846d","resolution":{"observed_at":"2026-08-06T21:56:14.765584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14540","last_updated":"2025-07-29T16:48:03Z","snapshot_observed_at":"2026-08-06T20:16:51.288291Z","submitted_at":"2024-06-20T17:50:16Z","title":"IRASim: A Fine-Grained World Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14540","snapshot_observed_at":"2026-08-06T21:56:07.466192Z","title":"Irasim: Learning interactive real-robot action simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.466192Z"},"links":{"cited_paper":"/paper/2406.14540","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:50dfd4f69acea60a18b3ef341e9cab25952361f67666efa637b43e5a0d4582ae","observation_id":"59802a9e-ac9d-4f1f-bb97-e1730548f2ea","resolution":{"observed_at":"2026-08-06T21:56:07.466192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T21:56:07.501402Z","title":"Cosmos world foundation model platform for physical ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.501402Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:60ba44777793c35cc733f10fc4a2de7a95ebcc6c126d9bf02410374b79059da5","observation_id":"2e4c45f8-31e5-4b5a-975f-31b039fcfc9a","resolution":{"observed_at":"2026-08-06T21:56:07.501402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02385","last_updated":"2025-06-22T03:30:55Z","snapshot_observed_at":"2026-08-02T22:45:54.982294Z","submitted_at":"2024-11-04T18:53:05Z","title":"How Far is Video Generation from World Model: A Physical Law Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02385","snapshot_observed_at":"2026-08-06T21:56:07.565879Z","title":"How far is video generation from world model: A physical law perspective","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.565879Z"},"links":{"cited_paper":"/paper/2411.02385","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:8648b29bb0bc2bb06fdc33251e13cac1902391eae07e66c54be27b5e08b3d0c6","observation_id":"f054bf13-fc0e-48e0-86e2-0be15f2f1ee4","resolution":{"observed_at":"2026-08-06T21:56:07.565879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21765","last_updated":"2025-03-27T17:58:33Z","snapshot_observed_at":"2026-08-09T11:35:56.151869Z","submitted_at":"2025-03-27T17:58:33Z","title":"Exploring the Evolution of Physics Cognition in Video Generation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21765","snapshot_observed_at":"2026-08-06T21:56:07.644668Z","title":"Exploring the evolution of physics cognition in video generation: A survey","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.644668Z"},"links":{"cited_paper":"/paper/2503.21765","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:ac3933e318947ffceec33eac2e2a4d3d8cd523225be0a39720c8905de5b2e1ab","observation_id":"3c3a4515-d0cb-4339-af5e-a68e731f2e1e","resolution":{"observed_at":"2026-08-06T21:56:07.644668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-08-06T21:56:07.727890Z","title":"T2vphysbench: A first-principles benchmark for physical consistency in text-to-video gen- eration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.727890Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:a0051686b27d4d111b69175e16dbed2e0559e762b0b7da280f167856af773b18","observation_id":"4e1360c3-4a96-4455-9b03-44228dfbfd3a","resolution":{"observed_at":"2026-08-06T21:56:07.727890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05363","last_updated":"2024-10-07T17:56:04Z","snapshot_observed_at":"2026-08-08T09:48:34.424815Z","submitted_at":"2024-10-07T17:56:04Z","title":"Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05363","snapshot_observed_at":"2026-08-06T21:56:07.821112Z","title":"Towards world simulator: Crafting physical commonsense- based benchmark for video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.821112Z"},"links":{"cited_paper":"/paper/2410.05363","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:675d800fffdcc18ec65ed10d8d63da97fb16da486d816d900dd2504e0006a0ec","observation_id":"5460f98f-f4f8-4e6c-8c7c-cb9989583a64","resolution":{"observed_at":"2026-08-06T21:56:07.821112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:07.914964Z","title":"Towards physical understanding in video generation: A 3d point regularization approach","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.914964Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:42a1a5f10c7491571655a91f0db4efecf06087b1d8987b1dcdc63e1bf94bab15","observation_id":"9db8673e-38d0-4ceb-8157-a53aa974c35e","resolution":{"observed_at":"2026-08-06T21:56:07.914964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:07.978138Z","title":"Enhancing sketch animation: Text-to-video diffusion models with temporal consistency and rigidity constraints","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.978138Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:c6de4b92ae3560eb7b27c9875a5120c7209b3b78b035fe652fa4463abef97a4c","observation_id":"b78daa0b-2159-404a-93e0-cca00ca4d0fa","resolution":{"observed_at":"2026-08-06T21:56:07.978138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:08.094281Z","title":"Dynamic 3d gaussians: Tracking by persistent dynamic view synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:08.094281Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:8bbc17b4348417735678c81428ddfa5d77c5b6c1d6db5ee6f50fbb76543ba045","observation_id":"0788611f-475c-415f-a0ac-1c665c83cb77","resolution":{"observed_at":"2026-08-06T21:56:08.094281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16550","last_updated":"2025-03-26T17:59:18Z","snapshot_observed_at":"2026-07-06T20:27:04.664873Z","submitted_at":"2025-01-27T22:48:36Z","title":"PhysAnimator: Physics-Guided Generative Cartoon Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16550","snapshot_observed_at":"2026-08-06T21:56:08.214089Z","title":"Physanimator: Physics-guided generative cartoon animation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:08.214089Z"},"links":{"cited_paper":"/paper/2501.16550","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:648f8304bb4e323a8b21d4500d985ba9887a723394e6778f9adff50ceafed98e","observation_id":"5946e152-ca8b-4cb6-975b-4e71f24d4aa9","resolution":{"observed_at":"2026-08-06T21:56:08.214089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:14.436479Z","title":"Gpt4motion: Scripting physical motions in text-to-video generation via blender-oriented gpt planning","venue":null,"work_id":"207d0f29-b882-439b-bb08-07e261547740","year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:08.337225Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:ce42470fb5a9b0871c335573dce4e110875df5c18556f26d55c5f49246e772a9","observation_id":"06cc2792-25ab-49b5-9ded-9723e705f757","resolution":{"observed_at":"2026-08-06T21:56:14.566603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:14.238526Z","title":"Physgen: Rigid-body physics-grounded image-to-video generation","venue":null,"work_id":"143c711e-a915-4902-a3d6-19f7ec72c645","year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:08.555877Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:39f5f815c5f0fad900ab952cd5df7f692176670afe1b38f43344b7d11555d5c5","observation_id":"2e18e9ed-41d3-4ef0-8157-9f526113eced","resolution":{"observed_at":"2026-08-06T21:56:14.329751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17189","last_updated":"2024-11-28T05:49:59Z","snapshot_observed_at":"2026-07-06T19:57:06.097199Z","submitted_at":"2024-11-26T07:59:11Z","title":"PhysMotion: Physics-Grounded Dynamics From a Single Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17189","snapshot_observed_at":"2026-08-06T21:56:08.696435Z","title":"Physmotion: Physics-grounded dynamics from a single image.arXiv preprint arXiv:2411.17189, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:08.696435Z"},"links":{"cited_paper":"/paper/2411.17189","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:1b5ded1aa3cb5baaeb5ed9ba7dd8bb336581fa385051a58f0eef561cd0dddfa6","observation_id":"58962108-fb24-42b8-9e23-d0df415aab19","resolution":{"observed_at":"2026-08-06T21:56:08.696435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:08.788277Z","title":"Physdreamer: Physics-based interaction with 3d objects via video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:08.788277Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:26576aba54a4d0f4b055bc6080998703434734657fd434cf73718a67e21ee5b9","observation_id":"ce43a6c4-03da-45fd-af79-2176a0d5f9c7","resolution":{"observed_at":"2026-08-06T21:56:08.788277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04338","last_updated":"2024-06-11T03:36:09Z","snapshot_observed_at":"2026-08-05T06:55:16.693643Z","submitted_at":"2024-06-06T17:59:47Z","title":"Physics3D: Learning Physical Properties of 3D Gaussians via Video Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04338","snapshot_observed_at":"2026-08-06T21:56:08.873390Z","title":"Physics3d: Learning physical properties of 3d gaussians via video diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:08.873390Z"},"links":{"cited_paper":"/paper/2406.04338","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:63acfd152e4aee260e00224a6b3e988f32ef96dfbd2795173e0e8b3564bd0322","observation_id":"a223f87d-b986-43e8-9e83-03237484d2e8","resolution":{"observed_at":"2026-08-06T21:56:08.873390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18945","last_updated":"2025-07-28T15:42:31Z","snapshot_observed_at":"2026-08-07T16:40:26.916364Z","submitted_at":"2025-03-24T17:59:51Z","title":"Aether: Geometric-Aware Unified World Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18945","snapshot_observed_at":"2026-08-06T21:56:08.961309Z","title":"Aether: Geometric-aware unified world modeling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:08.961309Z"},"links":{"cited_paper":"/paper/2503.18945","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:154d76cca49e0472719314b61c7ac402ece515f660f9171f5a09fa695e76c550","observation_id":"4ffffeba-f3ef-4403-9fde-e191382adbfd","resolution":{"observed_at":"2026-08-06T21:56:08.961309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20995","last_updated":"2025-04-29T17:59:30Z","snapshot_observed_at":"2026-08-07T15:58:07.214768Z","submitted_at":"2025-04-29T17:59:30Z","title":"TesserAct: Learning 4D Embodied World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20995","snapshot_observed_at":"2026-08-06T21:56:09.046260Z","title":"Tesseract: Learning 4d embodied world models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:09.046260Z"},"links":{"cited_paper":"/paper/2504.20995","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:fdda4d582cd77b531eb5aa59cb132b89a06423557496a7d27192528e1d7ea456","observation_id":"b018b080-f0af-4bf8-a2ad-e54a5136b2ab","resolution":{"observed_at":"2026-08-06T21:56:09.046260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:09.172708Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:09.172708Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:559abeda6c957750f65b8850f0ada06754b6f9883ce1b4cf4b4a51a6d710f216","observation_id":"733886c6-ac3b-4665-86be-1e50bb808e95","resolution":{"observed_at":"2026-08-06T21:56:09.172708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-06T21:56:09.328609Z","title":"π0: A vision-language-action flow model for general robot control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:09.328609Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:819f62b1b478b36dbc437a98cbdf4d306da139ac9abc73cf243c51ba63085a0c","observation_id":"2b2a1caa-447f-4d81-bbe8-bce695c732be","resolution":{"observed_at":"2026-08-06T21:56:09.328609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12375","last_updated":"2025-06-15T03:50:49Z","snapshot_observed_at":"2026-07-06T20:24:03.105038Z","submitted_at":"2025-01-21T18:53:30Z","title":"Video Depth Anything: Consistent Depth Estimation for Super-Long Videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12375","snapshot_observed_at":"2026-08-06T21:56:09.428813Z","title":"Video depth anything: Consistent depth estimation for super-long videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:09.428813Z"},"links":{"cited_paper":"/paper/2501.12375","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:ce60ec278ff5108ce14327d24f8da4329ddb1de6481f95c01c8740f70a00dbc6","observation_id":"ddf523f2-5879-4fe0-9116-f32619e7454c","resolution":{"observed_at":"2026-08-06T21:56:09.428813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:13.967231Z","title":"Spatialtracker: Tracking any 2d pixels in 3d space","venue":null,"work_id":"bedeba44-51d1-4547-aab6-9a7e6113b9d0","year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:09.558510Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:90bb7a7a857f0bb8f37b886074c6e93449af0cc5f9a0ed1e731346b833e904a3","observation_id":"79f4b0f2-414a-4492-a8d1-20fd09c838f8","resolution":{"observed_at":"2026-08-06T21:56:14.096846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:13.718756Z","title":"Transnet v2: An effective deep network architecture for fast shot transition detection","venue":null,"work_id":"b4cd3a2c-6b97-4d17-a635-428983efbc28","year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:09.689012Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:54ffd903fa0e73be94f0ded4ec073e45f6b3800338c5f4190f5ec5328f011c0e","observation_id":"6f3cd3ec-8c72-431b-b358-607b843d4c24","resolution":{"observed_at":"2026-08-06T21:56:13.864004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:09.778354Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:09.778354Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:b02f16a6ecc36b7775b5f1b511a8e89d812a5c31a9125ca6d1bea65047b79d18","observation_id":"56ae5ccc-a901-4170-80d9-f1f8c373656d","resolution":{"observed_at":"2026-08-06T21:56:09.778354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:09.890983Z","title":"Flownet: Learning optical flow with convolutional networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:09.890983Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:d25908593be5633c36c4735831ab7500ade95e903a5cae8923a38544e6e6c9cc","observation_id":"d62178f5-29a6-4262-9999-f1842054b8fa","resolution":{"observed_at":"2026-08-06T21:56:09.890983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:10.047923Z","title":"A survey on curriculum learning.IEEE transactions on pattern analysis and machine intelligence, 44(9):4555–4576, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:10.047923Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:9f54e4b95f6c7bf913584dc77e429d717a56a062abb9243c6f9452ba34068db1","observation_id":"8b8ef04c-b948-4502-849b-0ab30aa44fde","resolution":{"observed_at":"2026-08-06T21:56:10.047923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05737","snapshot_observed_at":"2026-08-06T21:56:10.194317Z","title":"Language model beats diffusion–tokenizer is key to visual generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:10.194317Z"},"links":{"cited_paper":"/paper/2310.05737","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:0bf5cd1303dcd4c1c7de9903ad31681fee04086d6d6e9622eb7416858ab65157","observation_id":"33eeaa47-4a17-44c6-97c9-0afe8d5c81e5","resolution":{"observed_at":"2026-08-06T21:56:10.194317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06669","last_updated":"2025-08-04T04:50:21Z","snapshot_observed_at":"2026-08-04T23:08:22.516431Z","submitted_at":"2025-03-09T15:40:29Z","title":"AgiBot World Colosseo: A Large-scale Manipulation Platform for Scalable and Intelligent Embodied Systems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06669","snapshot_observed_at":"2026-08-06T21:56:10.257299Z","title":"Agibot world colosseo: A large-scale manipulation platform for scalable and intelligent embodied systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:10.257299Z"},"links":{"cited_paper":"/paper/2503.06669","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:1e8346c2e43fa355ec4fdb74df2192720da95696445902b16b59ceea9d2f549d","observation_id":"cde2b557-8802-455a-aa35-641689226b4a","resolution":{"observed_at":"2026-08-06T21:56:10.257299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:10.366690Z","title":"Genie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:10.366690Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:1823630190243b2ec446b011b5b8177bd0fb27865931a96b2d6d0c7d7aa8b538","observation_id":"3249801c-cb57-4687-a3c2-ead22e373d20","resolution":{"observed_at":"2026-08-06T21:56:10.366690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T21:56:10.485620Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:10.485620Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:d0b214ff7d1586ef80374fc63e8ff1fc487c36b37b39fbe7bcaff0f102859b32","observation_id":"166aaeeb-a43f-4eb5-a161-d577051e123d","resolution":{"observed_at":"2026-08-06T21:56:10.485620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.03298","last_updated":"2021-09-25T00:37:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-08-06T20:48:30Z","title":"What Matters in Learning from Offline Human Demonstrations for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.03298","snapshot_observed_at":"2026-08-06T21:56:10.544121Z","title":"What matters in learning from offline human demonstrations for robot manipulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:10.544121Z"},"links":{"cited_paper":"/paper/2108.03298","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:180a259e40f5586d98b42d10278524494ff529fb243fdc7864f4e9cee870969d","observation_id":"c03deaa9-8c44-418d-b138-5a1ed326071e","resolution":{"observed_at":"2026-08-06T21:56:10.544121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:10.657866Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:10.657866Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:34ffa1161375c937c172d4f86ae422225a9f07c62297540f5229f52fa6c36a66","observation_id":"7e93b563-f507-42fa-925f-327650e791b3","resolution":{"observed_at":"2026-08-06T21:56:10.657866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-06T21:56:10.750879Z","title":"World models","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:10.750879Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:922c5e9ef3517a3a807486ef78282892926a48eaaab6875214bbf24ebc432b0b","observation_id":"bf57973f-f9cc-428e-bf4a-5702ea1abdf9","resolution":{"observed_at":"2026-08-06T21:56:10.750879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:10.853082Z","title":"Drive- dreamer: Towards real-world-drive world models for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:10.853082Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:21e2090fc2686ffbd60e29a7adbea42fd893f38ada33706390f215071fa0ec93","observation_id":"4680ebf9-87d4-48c2-8b3c-8259a0c3acd7","resolution":{"observed_at":"2026-08-06T21:56:10.853082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:13.431549Z","title":"Genad: Gen- erative end-to-end autonomous driving","venue":null,"work_id":"804458ba-db37-4261-9c9e-442199e5b2aa","year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:10.978828Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:e417791da717137e1d4af229c6d31b8b459242b37f8d5185dbe2a7fb795be4f3","observation_id":"9389d659-01db-47b2-9180-293db985965d","resolution":{"observed_at":"2026-08-06T21:56:13.509700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00769","last_updated":"2024-12-06T13:09:43Z","snapshot_observed_at":"2026-07-06T19:43:42.287026Z","submitted_at":"2024-11-01T17:59:17Z","title":"GameGen-X: Interactive Open-world Game Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00769","snapshot_observed_at":"2026-08-06T21:56:11.097012Z","title":"Gamegen-x: Interactive open-world game video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:11.097012Z"},"links":{"cited_paper":"/paper/2411.00769","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:0fd69a038a44ecb961104dacb3dc023510faf701bdab761d5a66229657a838f0","observation_id":"062e3e20-8ae8-4740-801f-1f3fb1c053ed","resolution":{"observed_at":"2026-08-06T21:56:11.097012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11663","last_updated":"2025-02-17T10:53:56Z","snapshot_observed_at":"2026-08-07T18:12:57.488623Z","submitted_at":"2025-02-17T10:53:56Z","title":"MaskGWM: A Generalizable Driving World Model with Video Mask Reconstruction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11663","snapshot_observed_at":"2026-08-06T21:56:11.257053Z","title":"Maskgwm: A generalizable driving world model with video mask reconstruction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:11.257053Z"},"links":{"cited_paper":"/paper/2502.11663","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:bf2fd93f834abc77f4a315fbedbd1cda67aa7065bc5bb849c145a07e7957cd05","observation_id":"aba15f34-34c5-412d-9c21-e1055e448667","resolution":{"observed_at":"2026-08-06T21:56:11.257053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:11.354123Z","title":"Driving into the future: Multiview visual forecasting and planning with world model for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:11.354123Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:c23cd4bf8a20f16cccf1de94f64cd1bdf2f003e1ea7a162165c78fd3afbbcb61","observation_id":"219f113c-544e-4e6e-b6a0-208840d454f5","resolution":{"observed_at":"2026-08-06T21:56:11.354123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17398","last_updated":"2024-10-28T05:53:17Z","snapshot_observed_at":"2026-08-07T02:31:28.236732Z","submitted_at":"2024-05-27T17:49:15Z","title":"Vista: A Generalizable Driving World Model with High Fidelity and Versatile Controllability","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17398","snapshot_observed_at":"2026-08-06T21:56:11.450513Z","title":"Vista: A generalizable driving world model with high fidelity and versatile controllability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:11.450513Z"},"links":{"cited_paper":"/paper/2405.17398","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:8aa4e3273a33e85fbc8a9db42084f24718bee6c1d26cd3f098185efbeb683613","observation_id":"94446495-7dff-4001-bc02-c8d88d388072","resolution":{"observed_at":"2026-08-06T21:56:11.450513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20523","last_updated":"2025-03-26T13:11:35Z","snapshot_observed_at":"2026-07-06T20:59:00.415760Z","submitted_at":"2025-03-26T13:11:35Z","title":"GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20523","snapshot_observed_at":"2026-08-06T21:56:11.522836Z","title":"Gaia-2: A controllable multi-view generative world model for autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:11.522836Z"},"links":{"cited_paper":"/paper/2503.20523","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:734a192b82dbf8be439ec735242205dc93d5e030aa6c3a770518d8c10fd70f4b","observation_id":"add09686-cef4-4127-9abd-0581207968e3","resolution":{"observed_at":"2026-08-06T21:56:11.522836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:13.231855Z","title":"Learning robotic video dynamics with heterogeneous masked autoregression","venue":null,"work_id":"355e7b29-a5ef-4dbb-b474-71c8072d1e34","year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:11.648173Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:2a90fe04769c6fb24c763dfa9f4a20ed601f753d08e160c4f055ca596a20d381","observation_id":"f118ccb3-4716-4904-95a7-ccbcbb9994b1","resolution":{"observed_at":"2026-08-06T21:56:13.313289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:11.733771Z","title":"Gamefactory: Creating new games with generative interactive videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:11.733771Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:f3ff3f34c395e071ca16a71e9bfc51b8a08c746acfb967032589472713cb29ec","observation_id":"fa01d825-8aaa-4e91-8e27-0529267464fc","resolution":{"observed_at":"2026-08-06T21:56:11.733771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-09T01:46:25.522034Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-06T21:56:11.850755Z","title":"Pre-trained video generative models as world simulators","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:11.850755Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:dc26c50be41d33d33365b1c2b36c9e34c8947804fd0a6514be0131f8607f1a9a","observation_id":"44bf1fbe-ec70-4b5e-9f81-f11d1edc7221","resolution":{"observed_at":"2026-08-06T21:56:11.850755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:11.947234Z","title":"Worldmem: Long-term consistent world simulation with memory","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:11.947234Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:f240bc9ba62dc21b963e51d110e852791a8730f5e1a9c53719ccede3e8280338","observation_id":"5abedf24-2e1e-4d5f-ac89-0cf3d423dc06","resolution":{"observed_at":"2026-08-06T21:56:11.947234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:12.072637Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:12.072637Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:f05c492bc198708fcd47fa6c88ec61a2cf8b2d8a37e2100e3504a3ad56af61e1","observation_id":"99d9b239-e276-42e8-8525-9e4a5729cc4f","resolution":{"observed_at":"2026-08-06T21:56:12.072637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:56:12.204432Z","title":"Seeing the future, perceiving the future: A uni- fied driving world model for future generation and perception.arXiv preprint arXiv:2503.13587, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:12.204432Z"},"links":{"citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:abb1819f4e065177802b726c6ac08fb255074ebc6dcfa41170fc9a13c6ca66a8","observation_id":"966fd9c5-57ce-4322-b82d-302c9f40664e","resolution":{"observed_at":"2026-08-06T21:56:12.204432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 17 inbound Pith citation observations for arXiv:2506.23135."}