{"as_of":"2026-08-07T19:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:92dcb4951660f1487c83718faa0f1e9e0f688717ea010096d9a05fe5097b5bc3","coverage":[{"denominator":226,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:14:06.027717Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.02713/citation-record","integrity":"/paper/2608.02713/integrity","json":"/paper/2608.02713/citation-record.json","paper":"/paper/2608.02713"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T00:13:49.587839Z","title":"Cosmos world foundation model platform for physical AI.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:49.587839Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:9d723ebe74bb3ec407d9ccbf7b4f719202c0dcfb4a8fb52a3bc6ec827c2d641b","observation_id":"fe06bb2f-8668-4ec2-9c7d-c1df1cba663b","resolution":{"observed_at":"2026-08-07T00:13:49.587839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-07T00:13:49.686475Z","title":"Do as i can, not as i say: Grounding language in robotic affordances","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:49.686475Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:1bcc0d63ddc40bdf01d7ee0afe340cef6da0d7bd98dc81f856d6d2aab1dd98af","observation_id":"71c52b45-a4d6-4d70-b9ea-63b596394e04","resolution":{"observed_at":"2026-08-07T00:13:49.686475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.13239","last_updated":"2026-06-30T03:31:20Z","snapshot_observed_at":"2026-07-06T23:51:59.619032Z","submitted_at":"2026-06-11T11:53:32Z","title":"ComAct: Reframing Professional Software Manipulation via COM-as-Action Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.13239","snapshot_observed_at":"2026-08-07T00:13:49.834198Z","title":"ComAct: Reframing professional software manipulation via COM-as- Action paradigm.arXiv preprint arXiv:2606.13239, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:49.834198Z"},"links":{"cited_paper":"/paper/2606.13239","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:8733dbf8b91c7c5b195fc702df1f0377db7370282aa133b4027db62c6643c1ae","observation_id":"8c13d61a-61ff-4ba9-a13b-779c632b882e","resolution":{"observed_at":"2026-08-07T00:13:49.834198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12399","last_updated":"2024-10-30T14:34:49Z","snapshot_observed_at":"2026-07-06T18:16:59.602510Z","submitted_at":"2024-05-20T22:51:05Z","title":"Diffusion for World Modeling: Visual Details Matter in Atari","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12399","snapshot_observed_at":"2026-08-07T00:13:49.987059Z","title":"Diffusion for world modeling: Visual details matter in Atari","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:49.987059Z"},"links":{"cited_paper":"/paper/2405.12399","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:70841b722feaef61c7a2c281c5f97e96851cecdbace4caae560c523730c933a1","observation_id":"8e1b97f3-a099-476a-b3c3-aec553c1c5f4","resolution":{"observed_at":"2026-08-07T00:13:49.987059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:50.157423Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:50.157423Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:0e03018e7a83bfaae626c47e26e21ddd663063d560f18c3a05fd2f120bc8d55e","observation_id":"2784b585-cc16-46a8-915b-2c1800f17dbb","resolution":{"observed_at":"2026-08-07T00:13:50.157423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-07T00:13:50.301988Z","title":"V-JEPA2: Self-supervisedvideomodelsenableunderstanding, prediction and planning.arXiv preprint arXiv:2506.09985, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:50.301988Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:7d21ece187b36dd7e3fff3cc2381238efb511a777a9365934012b1d3d1158062","observation_id":"321cbfb0-ef44-49f2-a162-855d738dfe9d","resolution":{"observed_at":"2026-08-07T00:13:50.301988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12036","last_updated":"2023-11-22T00:02:49Z","snapshot_observed_at":"2026-07-06T16:35:07.121479Z","submitted_at":"2023-10-18T15:21:28Z","title":"A General Theoretical Paradigm to Understand Learning from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12036","snapshot_observed_at":"2026-08-07T00:13:50.414984Z","title":"A general theoretical paradigm to understand learning from human preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:50.414984Z"},"links":{"cited_paper":"/paper/2310.12036","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:2968901177a493ce83f81d8f643c97bb21bd7bfaebb895f58c50e98435b1b397","observation_id":"a51d4882-beae-4871-b73f-73d1a086b0f0","resolution":{"observed_at":"2026-08-07T00:13:50.414984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-06T21:03:57.261338Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-08-07T00:13:50.539483Z","title":"FitVid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:50.539483Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:5e498ec1b15d85c6351126c1c702d8a8a57490202147ce478e21bdbb3c83c716","observation_id":"e47c69d9-50e8-4966-9a5c-3e5cf2c231d8","resolution":{"observed_at":"2026-08-07T00:13:50.539483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11647","last_updated":"2025-07-09T08:09:06Z","snapshot_observed_at":"2026-08-07T17:03:10.859634Z","submitted_at":"2025-03-14T17:59:31Z","title":"ReCamMaster: Camera-Controlled Generative Rendering from A Single Video","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11647","snapshot_observed_at":"2026-08-07T00:13:50.675534Z","title":"ReCamMaster: Camera-controlled generative rendering from a single video.arXiv preprint arXiv:2503.11647, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:50.675534Z"},"links":{"cited_paper":"/paper/2503.11647","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:c433545de2805549a2447fffa265846cfc7ad5251b6de282358845dabbc45f99","observation_id":"03b5c839-cf51-4bb6-9d78-3a44f6326dc2","resolution":{"observed_at":"2026-08-07T00:13:50.675534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T00:13:50.834290Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:50.834290Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:c35748950f6e31d6d9185031b79f465e0802823ec494d09fde772d7a22a6eda4","observation_id":"6d9d45f6-674c-4dd4-9b6e-bdc5dbbc1004","resolution":{"observed_at":"2026-08-07T00:13:50.834290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T00:13:50.955072Z","title":"Constitutional AI: Harmlessness from AI feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:50.955072Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:9d2916f637c2fbc47513519226af4a891b4ed8e58217a4dd526f7c96a11b5677","observation_id":"748ef4ab-9583-4f8a-bc9b-b2732a72a914","resolution":{"observed_at":"2026-08-07T00:13:50.955072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03572","last_updated":"2025-04-11T19:20:22Z","snapshot_observed_at":"2026-08-06T18:01:55.599924Z","submitted_at":"2024-12-04T18:59:45Z","title":"Navigation World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03572","snapshot_observed_at":"2026-08-07T00:13:51.077230Z","title":"Navigation world models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:51.077230Z"},"links":{"cited_paper":"/paper/2412.03572","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:e30a741d9094833f43e9048bc2bc1a90b75922a93e93861b80dec60e532a2789","observation_id":"508ae3bf-eb95-49c0-a289-bff691dcbdfe","resolution":{"observed_at":"2026-08-07T00:13:51.077230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13415","last_updated":"2021-08-14T00:15:45Z","snapshot_observed_at":"2026-08-03T19:38:13.423842Z","submitted_at":"2021-03-24T18:02:11Z","title":"Mip-NeRF: A Multiscale Representation for Anti-Aliasing Neural Radiance Fields","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13415","snapshot_observed_at":"2026-08-07T00:13:51.201058Z","title":"Barron, Ben Mildenhall, Matthew Tancik, Peter Hedman, Ricardo Martin-Brualla, and Pratul P","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:51.201058Z"},"links":{"cited_paper":"/paper/2103.13415","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:8aa893c4b49ff21f900bd0018c3f7deda3817ff3e1a72bb26cddd90bcfd574b9","observation_id":"ac8282a6-2005-4c64-9702-dda3abf165bd","resolution":{"observed_at":"2026-08-07T00:13:51.201058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.12077","last_updated":"2022-03-25T23:05:20Z","snapshot_observed_at":"2026-07-06T12:11:31.206230Z","submitted_at":"2021-11-23T18:51:18Z","title":"Mip-NeRF 360: Unbounded Anti-Aliased Neural Radiance Fields","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.12077","snapshot_observed_at":"2026-08-07T00:13:51.320912Z","title":"Barron, Ben Mildenhall, Dor Verbin, Pratul P","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:51.320912Z"},"links":{"cited_paper":"/paper/2111.12077","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:6f2548e7cd4bc348d26ac9f3d17d5a2cb107af72cf0c72f506b6fc3b38666c8b","observation_id":"29cfcdcb-9b36-4fa3-9be4-144e872fff0d","resolution":{"observed_at":"2026-08-07T00:13:51.320912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:51.435828Z","title":"DynamicCity: Large- scale 4D occupancy generation from dynamic scenes","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:51.435828Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:10485910fe79673b51005bce9cb5d917d63a2df2b76ae9f887b46ba114069d17","observation_id":"1e94b0b1-688e-4e6d-abcb-a91806832ec9","resolution":{"observed_at":"2026-08-07T00:13:51.435828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-07T00:13:51.560626Z","title":"RT-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:51.560626Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:0250a5440f10acded81cda8135f2196b85dec7e34d3cd3155ff772f0b5e80774","observation_id":"7f563bf8-dae0-4dd3-b95d-ce7c97e4d6c9","resolution":{"observed_at":"2026-08-07T00:13:51.560626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-07T00:13:51.707629Z","title":"RT-1: Robotics transformer for real-world control at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:51.707629Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:7746cc756f763255404723b2a73b62fc0e17202388978afcf436beecf8f3976d","observation_id":"36bfc42d-664a-498a-ad48-c2f7642d6c2d","resolution":{"observed_at":"2026-08-07T00:13:51.707629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:51.833770Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:51.833770Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:b3f8ccd413ee756cee4a895e15876d3d7052d2733e0658748a6a9b124ff5482b","observation_id":"7512ea7b-20bb-46b3-9816-083e1fb3ad60","resolution":{"observed_at":"2026-08-07T00:13:51.833770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15391","last_updated":"2024-02-23T15:47:26Z","snapshot_observed_at":"2026-08-03T22:04:23.465893Z","submitted_at":"2024-02-23T15:47:26Z","title":"Genie: Generative Interactive Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15391","snapshot_observed_at":"2026-08-07T00:13:51.924814Z","title":"Genie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:51.924814Z"},"links":{"cited_paper":"/paper/2402.15391","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:8236cad681995d1dac3556cfdc26fadd4058d67420b151c99e769395c7bab87f","observation_id":"7094edf3-679f-4659-accc-3d5bf6f73a49","resolution":{"observed_at":"2026-08-07T00:13:51.924814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04858","last_updated":"2024-07-01T10:03:33Z","snapshot_observed_at":"2026-08-01T18:57:10.721822Z","submitted_at":"2024-02-07T13:55:27Z","title":"CodeIt: Self-Improving Language Models with Prioritized Hindsight Replay","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04858","snapshot_observed_at":"2026-08-07T00:13:52.062994Z","title":"Zhang, Michaël Defferrard, and Taco Cohen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:52.062994Z"},"links":{"cited_paper":"/paper/2402.04858","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:8c310b8684945761f73470068f8ba3bf0ce3586236684eb3791c6d7dd7822d7f","observation_id":"6b461ce1-74bb-4e67-8a35-bee68b317370","resolution":{"observed_at":"2026-08-07T00:13:52.062994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:52.226848Z","title":"MobileDreamer: Generative sketch world model for GUI agent","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:52.226848Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:9c72232a8bb5c44f2223c11836bcbde081429578c9742f1ad9be59c28552206f","observation_id":"8ffdbf7f-6689-412f-98f4-6b2e2f64cc6d","resolution":{"observed_at":"2026-08-07T00:13:52.226848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:52.321093Z","title":"PhysX-Anything: Simulation-ready physical3Dassetsfromsingleimage","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:52.321093Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:d9555569ffcce48c49cbd1f43b16162d192a6481191fd43de38e1192b10c3690","observation_id":"9ebd3acd-756d-49fb-b537-70f0b3ec0170","resolution":{"observed_at":"2026-08-07T00:13:52.321093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13232","last_updated":"2025-03-29T08:59:09Z","snapshot_observed_at":"2026-08-05T09:13:49.732299Z","submitted_at":"2024-10-17T05:37:00Z","title":"Web Agents with World Models: Learning and Leveraging Environment Dynamics in Web Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13232","snapshot_observed_at":"2026-08-07T00:13:52.440004Z","title":"Web agents with world models: Learning and leverag- ing environment dynamics in web navigation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:52.440004Z"},"links":{"cited_paper":"/paper/2410.13232","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:80f0da86146d3721185f3b1c3226d78aa7de15cec4378d36ad4675a9f2b14cf8","observation_id":"52b3c5e5-ab91-436e-9101-cfbb74d8ea34","resolution":{"observed_at":"2026-08-07T00:13:52.440004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14135","last_updated":"2026-05-22T16:05:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-17T02:55:20Z","title":"GAF: Gaussian Action Field as a 4D Representation for Dynamic World Modeling in Robotic Manipulation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14135","snapshot_observed_at":"2026-08-07T00:13:52.595783Z","title":"GAF: Gaussian action field as a 4D representation for dynamic world modeling in robotic manipulation.arXiv preprint arXiv:2506.14135, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:52.595783Z"},"links":{"cited_paper":"/paper/2506.14135","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:4178e19855430e12b123a79c1202b742118a143462856a78943d31fe061295c4","observation_id":"dda265d7-307a-40d1-9387-e6fdc4c95237","resolution":{"observed_at":"2026-08-07T00:13:52.595783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:52.734852Z","title":"GameGen-X: Interactive open- world game video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:52.734852Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:c7f91dd8275289831d87b9c9e85c6721e3fe79f91d089077367c999d77f94d48","observation_id":"086343b7-17ac-485f-a52d-5495c9db7828","resolution":{"observed_at":"2026-08-07T00:13:52.734852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09517","last_updated":"2022-11-29T06:21:21Z","snapshot_observed_at":"2026-08-03T09:08:18.658001Z","submitted_at":"2022-03-17T17:59:59Z","title":"TensoRF: Tensorial Radiance Fields","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.09517","snapshot_observed_at":"2026-08-07T00:13:52.885271Z","title":"TensoRF: Tensorial radiance fields","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:52.885271Z"},"links":{"cited_paper":"/paper/2203.09517","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:125336d13c649f70ef71ca8c335587825aba626d3eee95ccf3abfe45d651492a","observation_id":"db2ffd98-c901-40b0-a940-66e3131eabfc","resolution":{"observed_at":"2026-08-07T00:13:52.885271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03890","last_updated":"2026-04-09T05:33:48Z","snapshot_observed_at":"2026-08-02T14:35:25.400234Z","submitted_at":"2024-01-08T13:42:59Z","title":"A Survey on 3D Gaussian Splatting","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03890","snapshot_observed_at":"2026-08-07T00:13:53.019531Z","title":"A survey on 3D gaussian splatting.ACM Comput","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:53.019531Z"},"links":{"cited_paper":"/paper/2401.03890","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:e19c06a01c03429cc759f3d369fd9272d26adfda2cc0d16adb6d86e7850e9bc5","observation_id":"51f7b6c9-35b1-4430-8fce-24406a81878c","resolution":{"observed_at":"2026-08-07T00:13:53.019531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:53.145395Z","title":"Scaling agent learning via experience synthesis.arXiv preprint arXiv:2511.03773, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:53.145395Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:bc3da867f6591cc8e0b0428ae7966ef621116c1a622f7ab4ed083a90f37f20fb","observation_id":"da3c2674-0e62-4e4c-b4ed-cf675f32c849","resolution":{"observed_at":"2026-08-07T00:13:53.145395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:53.297694Z","title":"SceneDreamer: Unbounded 3D scene generation from 2D imagecollections.IEEE Trans.PatternAnal.Mach","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:53.297694Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:22183291969a916a34be91253256c6c17de99b099c48033ee32b706de8219861","observation_id":"7039893b-f068-46a2-b7cd-73de856c0000","resolution":{"observed_at":"2026-08-07T00:13:53.297694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03741","last_updated":"2023-02-17T17:00:34Z","snapshot_observed_at":"2026-08-03T14:31:51.401500Z","submitted_at":"2017-06-12T17:23:59Z","title":"Deep reinforcement learning from human preferences","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03741","snapshot_observed_at":"2026-08-07T00:13:53.462156Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:53.462156Z"},"links":{"cited_paper":"/paper/1706.03741","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:0c449635409cd1d1fa84878ef972b0759260a7d5c2eea3938da0e6d97a59bf7a","observation_id":"aea601ac-fb63-4e72-8572-413c29c6b113","resolution":{"observed_at":"2026-08-07T00:13:53.462156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.22748","last_updated":"2026-06-08T04:24:27Z","snapshot_observed_at":"2026-08-02T10:58:24.119885Z","submitted_at":"2026-04-24T17:48:47Z","title":"Agentic World Modeling: Foundations, Capabilities, Laws, and Beyond","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.22748","snapshot_observed_at":"2026-08-07T00:13:53.624247Z","title":"Agentic world modeling: Foundations, capabilities, laws, and beyond.arXiv preprint arXiv:2604.22748, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:53.624247Z"},"links":{"cited_paper":"/paper/2604.22748","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:073de3ba17bed0847c251d0dbcd2e03c64e927fa44c26a7e7111a5535413f688","observation_id":"9b7cf10d-0b48-4890-9096-ba5d1b5a34f2","resolution":{"observed_at":"2026-08-07T00:13:53.624247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T00:13:53.804764Z","title":"URL https://arxiv","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:53.804764Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:6e4226ef9a6c5acaeb7d792b5b54db94d4bb901c6febb90438e5ed5e64e4b0d9","observation_id":"aa87339b-625f-43ae-9da5-71d8b808c448","resolution":{"observed_at":"2026-08-07T00:13:53.804764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:53.926357Z","title":"CWM: An open-weights LLM for research on code generation with world models.arXiv preprint arXiv:2510.02387, 2025","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:53.926357Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:ab8b891f59251b90c8c98888223422a5581fea5f64e908c4ff2b3493d02c4026","observation_id":"cee0417b-b835-4455-9894-34f2cd53be17","resolution":{"observed_at":"2026-08-07T00:13:53.926357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15383","last_updated":"2024-10-30T14:19:57Z","snapshot_observed_at":"2026-08-04T20:30:04.010619Z","submitted_at":"2024-05-24T09:31:26Z","title":"Generating Code World Models with Large Language Models Guided by Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15383","snapshot_observed_at":"2026-08-07T00:13:54.041095Z","title":"Generating code world mod- els with large language models guided by Monte Carlo tree search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:54.041095Z"},"links":{"cited_paper":"/paper/2405.15383","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:537fc808f36936aa5c3ff24d164840bc4813b119fd30764fa558b558a289e652","observation_id":"5b08ad98-f316-4d93-8a2a-099b3a1078de","resolution":{"observed_at":"2026-08-07T00:13:54.041095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:54.177067Z","title":"Oasis: A universe in a transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:54.177067Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:ab512da4ec8515ea34b45c3bcbb7585168af761cb349a5451ea2d315980b9f0d","observation_id":"f6827a40-602d-47fa-868f-c32f1722dac4","resolution":{"observed_at":"2026-08-07T00:13:54.177067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:54.337946Z","title":"Understanding world or predicting future? A comprehensive survey of world models.ACM Comput","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:54.337946Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:653b73b2150f427a41e124b74d292c3684239b26c59468e3eb13b212596c1c2c","observation_id":"943e186f-94e1-401d-b95e-dd0f9260979d","resolution":{"observed_at":"2026-08-07T00:13:54.337946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-07T00:13:55.006976Z","title":"Length-controlledAlpacaEval: A simple way to debias automatic evaluators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:55.006976Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:912b101faa2e1a84ac9217689e5e4b446305064fd4f167a0a4472fa649a5ed03","observation_id":"4965846b-3e70-406c-a806-ec27286decd4","resolution":{"observed_at":"2026-08-07T00:13:55.006976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-07T00:13:55.166044Z","title":"KTO: Model align- ment as prospect theoretic optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:55.166044Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:64c30073919113d103b6f5ad6065eb642e78b688df26b7adf0da723bbc066037","observation_id":"4427cf14-a13f-4d17-a117-e47c248e3626","resolution":{"observed_at":"2026-08-07T00:13:55.166044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21024","last_updated":"2025-08-21T05:55:43Z","snapshot_observed_at":"2026-08-07T16:00:02.644896Z","submitted_at":"2025-04-23T02:54:31Z","title":"WebEvolver: Enhancing Web Agent Self-Improvement with Coevolving World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21024","snapshot_observed_at":"2026-08-07T00:13:55.289440Z","title":"WebEvolver: Enhancing web agent self-improvement with coevolving world model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:55.289440Z"},"links":{"cited_paper":"/paper/2504.21024","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:f8a51ef969c8a012828f8afe0f6048ff89d1b0fbb32f14abdcad256aeda8e791","observation_id":"8cf72f59-a5d0-48e7-afe9-830c8e57cd4c","resolution":{"observed_at":"2026-08-07T00:13:55.289440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07181","last_updated":"2024-07-10T02:48:08Z","snapshot_observed_at":"2026-08-07T12:51:44.769956Z","submitted_at":"2024-02-11T12:33:08Z","title":"3D Gaussian as a New Era: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07181","snapshot_observed_at":"2026-08-07T00:13:55.401762Z","title":"3D gaussian as a new era: A survey.IEEE Trans","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:55.401762Z"},"links":{"cited_paper":"/paper/2402.07181","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:e8930baa6cb5a6bdcb264cb0be73ad4997fc095c94de08e520cc75cfcf14ce5f","observation_id":"283c86f9-d860-4b58-89d9-a847228fa92c","resolution":{"observed_at":"2026-08-07T00:13:55.401762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:55.561998Z","title":"Webworldmodels","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:55.561998Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:e5cdc91a388b051432f2b7abc099c81788f6509a253a370e8a7d7e9b765b5ad4","observation_id":"5eece61d-2ccd-46b0-a0bb-803a8ee3998c","resolution":{"observed_at":"2026-08-07T00:13:55.561998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11260","last_updated":"2025-09-10T14:02:23Z","snapshot_observed_at":"2026-08-07T05:28:26.048880Z","submitted_at":"2025-01-20T04:00:02Z","title":"A Survey of World Models for Autonomous Driving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11260","snapshot_observed_at":"2026-08-07T00:13:55.682103Z","title":"Asurveyofworldmodelsforautonomousdriving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:55.682103Z"},"links":{"cited_paper":"/paper/2501.11260","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:3f242e500a37acf07ae45eb355f08d76b69775469539c7ac9fa3a995661a6d01","observation_id":"3c5c2615-9836-4fe2-b7ad-7e26d3d23025","resolution":{"observed_at":"2026-08-07T00:13:55.682103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01133","last_updated":"2023-05-30T08:52:45Z","snapshot_observed_at":"2026-08-06T09:54:34.260823Z","submitted_at":"2023-02-02T14:47:19Z","title":"SceneScape: Text-Driven Consistent Scene Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01133","snapshot_observed_at":"2026-08-07T00:13:55.883984Z","title":"SceneScape: Text-driven consistent scene generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:55.883984Z"},"links":{"cited_paper":"/paper/2302.01133","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:e466d513bfa63651ba2127613c75258947c2a039a61af11e22eb2117f6dbc45d","observation_id":"5b5b011b-80f3-456b-b9fa-69557b9c675d","resolution":{"observed_at":"2026-08-07T00:13:55.883984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.09131","last_updated":"2026-05-09T19:25:56Z","snapshot_observed_at":"2026-07-06T23:21:16.454273Z","submitted_at":"2026-05-09T19:25:56Z","title":"MCP-Cosmos: World Model-Augmented Agents for Complex Task Execution in MCP Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.09131","snapshot_observed_at":"2026-08-07T00:13:56.042890Z","title":"MCP-Cosmos: World model-augmented agents for complex taskexecutioninMCPenvironments","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:56.042890Z"},"links":{"cited_paper":"/paper/2605.09131","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:a2709cc28024496189554a3cecea7c7cdca56d574d251af18e57eeb89d9dc911","observation_id":"76c2a1bc-65e2-4b64-8165-019d5155e6d8","resolution":{"observed_at":"2026-08-07T00:13:56.042890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17398","last_updated":"2024-10-28T05:53:17Z","snapshot_observed_at":"2026-08-07T02:31:28.236732Z","submitted_at":"2024-05-27T17:49:15Z","title":"Vista: A Generalizable Driving World Model with High Fidelity and Versatile Controllability","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17398","snapshot_observed_at":"2026-08-07T00:13:56.152212Z","title":"Vista: A generalizable driving world model with high fidelity and versatile controllability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:56.152212Z"},"links":{"cited_paper":"/paper/2405.17398","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:c37836d90c6719c0c5d7788b7dc3c843a72f7d9dec7b7a0da0c3a019cb52d792","observation_id":"cbe2d4c9-8749-4664-b871-20b35e68a187","resolution":{"observed_at":"2026-08-07T00:13:56.152212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04370","last_updated":"2025-07-06T12:31:10Z","snapshot_observed_at":"2026-08-06T19:46:58.998645Z","submitted_at":"2025-07-06T12:31:10Z","title":"WebSynthesis: World-Model-Guided MCTS for Efficient WebUI-Trajectory Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.04370","snapshot_observed_at":"2026-08-07T00:13:56.263410Z","title":"WebSynthesis: World-model-guided MCTS for ef- ficient WebUI-trajectory synthesis.arXiv preprint arXiv:2507.04370, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:56.263410Z"},"links":{"cited_paper":"/paper/2507.04370","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:05150ff2f837d23b5a5a0ec53cadaa3324b6e4a0bc26d4385e95f42dd4ce311c","observation_id":"5ecb62e6-1028-412d-929f-8f84362d3192","resolution":{"observed_at":"2026-08-07T00:13:56.263410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20540","last_updated":"2026-01-28T12:37:01Z","snapshot_observed_at":"2026-08-03T01:29:14.204066Z","submitted_at":"2026-01-28T12:37:01Z","title":"Advancing Open-source World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.20540","snapshot_observed_at":"2026-08-07T00:13:56.398606Z","title":"Advancing open-source world models.arXiv preprint arXiv:2601.20540, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:56.398606Z"},"links":{"cited_paper":"/paper/2601.20540","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:52deafdf6eaae3a09e37d43f45340e22c15f9878c9feb265347dc774c3a2791f","observation_id":"7d0f899a-43a8-416a-86b6-5ae5e013c063","resolution":{"observed_at":"2026-08-07T00:13:56.398606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:56.530049Z","title":"Genie 3: A new frontier for world models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:56.530049Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:c939b920d58653c2252b9ce46127c5ce83bbe307110e377cfa0372df71fc563f","observation_id":"ac1ba2bb-3350-4567-896f-2dc5e94d0f00","resolution":{"observed_at":"2026-08-07T00:13:56.530049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T00:13:56.677160Z","title":"A survey on LLM-as-a-judge.arXiv preprint arXiv:2411.15594, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:56.677160Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:bfe93a501eb13bdc938bba1ce310560aa06b3d8f986bce2e630883a4b66713bb","observation_id":"0a7cc045-8361-467e-8fc7-19dd55692a46","resolution":{"observed_at":"2026-08-07T00:13:56.677160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:56.779041Z","title":"Is your LLM secretly a world model of the internet? Model- based planning for web agents.Trans","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:56.779041Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:407670ac3e230f442897ef594cce1dc003bdacbf090e2267cbe0471acde82ccf","observation_id":"0ab6e9b9-3414-469c-8240-21394253aeb4","resolution":{"observed_at":"2026-08-07T00:13:56.779041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:56.857036Z","title":"Computer- using world model.arXiv preprint arXiv:2602.17365, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:56.857036Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:0acae01d60589ff2578905f0e4327382d64d5fe90506c806f1edbff11c437379","observation_id":"44f3c16b-744d-4134-8bf4-f29b125ea627","resolution":{"observed_at":"2026-08-07T00:13:56.857036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08388","last_updated":"2025-04-11T09:41:04Z","snapshot_observed_at":"2026-08-07T16:06:34.954758Z","submitted_at":"2025-04-11T09:41:04Z","title":"MineWorld: a Real-Time and Open-Source Interactive World Model on Minecraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08388","snapshot_observed_at":"2026-08-07T00:13:56.935119Z","title":"MineWorld: a real-timeand open-sourceinteractiveworldmodelonminecraft","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:56.935119Z"},"links":{"cited_paper":"/paper/2504.08388","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:7589e866bcc2a2745d8a3896310c1f78ddadd72d81d955964a2159353d29bb92","observation_id":"e6912a83-f201-4feb-80c2-2f0cee7a6168","resolution":{"observed_at":"2026-08-07T00:13:56.935119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:57.036751Z","title":"World modelling improves language model agents.arXiv preprint arXiv:2506.02918, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:57.036751Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:e7ea8f6cda0fc3dc312ab9c570b9775954fefbf0b5e522f4536d4e0990d00d39","observation_id":"23b3a057-a2a2-4d71-9d70-b52bf2c72cb3","resolution":{"observed_at":"2026-08-07T00:13:57.036751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:57.120049Z","title":"When world models dream wrong: Physical-conditioned adversarial attacks against world models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:57.120049Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:b43229b32d7ddc4ca3e61581e276c0f09096fc8e98eeb194c2d644207ac2549b","observation_id":"ad6789f8-6c5b-4f1b-b98f-7010abbd5870","resolution":{"observed_at":"2026-08-07T00:13:57.120049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-07T00:13:57.230297Z","title":"Recurrent world models facilitate policy evolution","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:57.230297Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:650b50d2fec570e0504d3e9ec4c66cf3e3c3067172f76e9c2cbd345b1c872758","observation_id":"3d6785de-fb56-4ea0-8e46-06f187c03e81","resolution":{"observed_at":"2026-08-07T00:13:57.230297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:57.353195Z","title":"Learning latent dynamics for planning from pixels","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:57.353195Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:5112595fe772746bbb0c0d627df2408ff8d87dca3b064108da2fc153bb507260","observation_id":"e60719bb-c553-40ba-9b4f-606fa5e8282d","resolution":{"observed_at":"2026-08-07T00:13:57.353195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-03T15:20:23.515607Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-07T00:13:57.565203Z","title":"Dream to control: Learning behaviors by latent imagination","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:57.565203Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:8f0951e73e5c09f4c9ba0a29b8520e4f64cdda0ba2018f68fbae694764f101bb","observation_id":"9892611f-b34b-46fe-966f-00692b7a6f39","resolution":{"observed_at":"2026-08-07T00:13:57.565203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-07T00:13:57.661235Z","title":"Mastering diverse control tasks through world models.Nature, 640(8059):647–653, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:57.661235Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:96ec65ed0fe769dfe91d981b5c8940260fb2bcf5f21fbfd000302f8f29f46fdc","observation_id":"41d0c5b7-0269-47f0-a67f-9a7d4939157e","resolution":{"observed_at":"2026-08-07T00:13:57.661235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16828","last_updated":"2024-03-21T17:56:19Z","snapshot_observed_at":"2026-07-31T05:32:29.431480Z","submitted_at":"2023-10-25T17:57:07Z","title":"TD-MPC2: Scalable, Robust World Models for Continuous Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16828","snapshot_observed_at":"2026-08-07T00:13:57.855379Z","title":"TD-MPC2: Scalable, robust world models for continuous control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:57.855379Z"},"links":{"cited_paper":"/paper/2310.16828","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:930f19758df70719961b8f6d4480b8db0e9952557745955bf7b11e72947af90e","observation_id":"cf79d3c0-6abf-45d3-8229-59cca444bad6","resolution":{"observed_at":"2026-08-07T00:13:57.855379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14992","last_updated":"2023-10-23T07:24:28Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T10:28:28Z","title":"Reasoning with Language Model is Planning with World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14992","snapshot_observed_at":"2026-08-07T00:13:57.978737Z","title":"Rea- soning with language model is planning with world model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:57.978737Z"},"links":{"cited_paper":"/paper/2305.14992","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:74320bef41578e98405b34efde7bcdc8b61a80e7e37edef0e7281f54536f1767","observation_id":"0e5f66ef-f470-4afb-8980-d640b52fb9a5","resolution":{"observed_at":"2026-08-07T00:13:57.978737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03458","last_updated":"2022-06-22T20:22:29Z","snapshot_observed_at":"2026-07-06T12:57:51.108636Z","submitted_at":"2022-04-07T14:08:02Z","title":"Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03458","snapshot_observed_at":"2026-08-07T00:13:58.121367Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:58.121367Z"},"links":{"cited_paper":"/paper/2204.03458","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:efccdcc2a280debed92cbc15a841129aa929772ef31151c2658edad0b9784306","observation_id":"a10104c6-9a34-4155-9d75-f93fb2c24703","resolution":{"observed_at":"2026-08-07T00:13:58.121367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11989","last_updated":"2023-09-10T15:18:03Z","snapshot_observed_at":"2026-07-06T15:06:15.576863Z","submitted_at":"2023-03-21T16:21:02Z","title":"Text2Room: Extracting Textured 3D Meshes from 2D Text-to-Image Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11989","snapshot_observed_at":"2026-08-07T00:13:58.278339Z","title":"Text2Room: Extracting textured 3D meshes from 2D text-to-image models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:58.278339Z"},"links":{"cited_paper":"/paper/2303.11989","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:569426fee80978246c9383d04904b84a09648069b9b89c9a020fdfc467925b4e","observation_id":"b8702038-2fd6-454b-9343-41c44823ddef","resolution":{"observed_at":"2026-08-07T00:13:58.278339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:58.378031Z","title":"ORPO:Monolithicpreferenceoptimizationwithoutreference model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:58.378031Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:50da88a98fbe27d21f1eb27e258b7eded4a690a7d9b2b419e27e8b6e2f0f1851","observation_id":"99dc891f-cc62-4db8-aedc-47a9190b41fa","resolution":{"observed_at":"2026-08-07T00:13:58.378031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:58.538077Z","title":"Diffusion models for video prediction and infilling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:58.538077Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:2e49cfb2e7588e11a41094c9851c31707c8df9d8307c878332c56aefef4ab49b","observation_id":"f28a44f7-48de-4b66-8894-aa4b2637aa39","resolution":{"observed_at":"2026-08-07T00:13:58.538077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-07T00:13:58.673228Z","title":"GAIA-1: A generative world model for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:58.673228Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:086f0fa51514df82dcac6aae26afdb87eb3d89793109719d469ee80f8f45f4ff","observation_id":"a38e7dc7-91d9-46aa-b94b-c0e214704c6a","resolution":{"observed_at":"2026-08-07T00:13:58.673228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.13368","last_updated":"2026-06-30T07:06:53Z","snapshot_observed_at":"2026-08-02T02:14:11.218178Z","submitted_at":"2026-06-11T13:53:21Z","title":"IterCAD: An Iterative Multimodal Agent for Visually-Grounded CAD Generation and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.13368","snapshot_observed_at":"2026-08-07T00:13:58.827947Z","title":"IterCAD: An iterative multimodal agent for visually-grounded CAD generation and editing","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:58.827947Z"},"links":{"cited_paper":"/paper/2606.13368","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:f04b5135ffc1ac2dc28beb765b1f4a9506a44f96a9b1dce2c88d2451de6e63cb","observation_id":"e478cc8c-653f-4e57-bd1b-b316e0db01b5","resolution":{"observed_at":"2026-08-07T00:13:58.827947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:58.957744Z","title":"NavThinker: Action-conditioned world models for coupled prediction and planning in social navigation.arXiv preprint arXiv:2603.15359, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:58.957744Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:0e9d70684e3ea20fb70b6523f8f7064e5045429b59edbc8f2876257cb1a51f8d","observation_id":"d7ee1342-5516-4e36-83ea-c5fbf59668d1","resolution":{"observed_at":"2026-08-07T00:13:58.957744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.10866","last_updated":"2026-04-16T16:00:33Z","snapshot_observed_at":"2026-08-07T11:42:08.308728Z","submitted_at":"2026-04-13T00:27:32Z","title":"OccuBench: Evaluating AI Agents on Real-World Professional Tasks via Language Environment Simulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.10866","snapshot_observed_at":"2026-08-07T00:13:59.086704Z","title":"OccuBench: Evaluating AI agents on real-world professional tasks via language world models.arXiv preprint arXiv:2604.10866, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:59.086704Z"},"links":{"cited_paper":"/paper/2604.10866","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:fa03ffd2cecbddaec9eff418f27d599a13bd81dbe5e2babf262f1bd196c9d038","observation_id":"ad3f85ea-6b51-4094-a9a1-7b753821c9f5","resolution":{"observed_at":"2026-08-07T00:13:59.086704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23126","last_updated":"2025-08-25T18:24:56Z","snapshot_observed_at":"2026-08-06T21:46:06.816659Z","submitted_at":"2025-06-29T07:23:56Z","title":"ParticleFormer: A 3D Point Cloud World Model for Multi-Object, Multi-Material Robotic Manipulation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23126","snapshot_observed_at":"2026-08-07T00:13:59.247101Z","title":"ParticleFormer: A 3D point cloud world model for multi-object, multi-material robotic manipulation.arXiv preprint arXiv:2506.23126, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:59.247101Z"},"links":{"cited_paper":"/paper/2506.23126","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:d5f2a37551afc481e1e9e0cfe7b96c27e0d115fa73c58124691d7eef23473ea3","observation_id":"30260450-9407-4e33-a27f-29354ecfe553","resolution":{"observed_at":"2026-08-07T00:13:59.247101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05608","last_updated":"2022-07-12T15:20:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-12T15:20:48Z","title":"Inner Monologue: Embodied Reasoning through Planning with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05608","snapshot_observed_at":"2026-08-07T00:13:59.377959Z","title":"Inner monologue: Embodied reasoning through planning with language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:59.377959Z"},"links":{"cited_paper":"/paper/2207.05608","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:54e06e9f99ab30ee66230922887ea8ed77a3308f8451baf960839ecb5de35163","observation_id":"18be73f1-8390-4889-bcac-ed64b1e9148a","resolution":{"observed_at":"2026-08-07T00:13:59.377959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05973","last_updated":"2023-11-02T06:53:37Z","snapshot_observed_at":"2026-08-05T01:03:23.456778Z","submitted_at":"2023-07-12T07:40:48Z","title":"VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05973","snapshot_observed_at":"2026-08-07T00:13:59.493135Z","title":"VoxPoser: Compos- able 3D value maps for robotic manipulation with language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:59.493135Z"},"links":{"cited_paper":"/paper/2307.05973","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:70b4e47cdba7be243ef7f80b82a804b943ae0bfcee85ea996b80ddde050d11ad","observation_id":"3cbf99e3-39fa-4cc0-909f-0dd308e218ae","resolution":{"observed_at":"2026-08-07T00:13:59.493135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:59.620782Z","title":"PointWorld: Scaling 3D world models for in-the-wild robotic manipulation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:59.620782Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:d64d7ac1506d92c7fa439d2ee2834dd511b6e05e1bae7419eba9000dd2a21681","observation_id":"015ba495-3392-4137-8f53-ab103ce1461f","resolution":{"observed_at":"2026-08-07T00:13:59.620782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:13:59.732134Z","title":"CAS- CADE: Cumulative agentic skill creation through autonomous development and evolution.arXiv preprint arXiv:2512.23880, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:59.732134Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:cadb17aa2d2b512f2b977cc37b697e8520a920e2a8df76346372025901668cb0","observation_id":"736469fd-6f6b-4947-b83b-592cf352e673","resolution":{"observed_at":"2026-08-07T00:13:59.732134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08253","last_updated":"2021-11-29T00:49:49Z","snapshot_observed_at":"2026-08-05T14:59:13.622635Z","submitted_at":"2019-06-19T17:54:53Z","title":"When to Trust Your Model: Model-Based Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08253","snapshot_observed_at":"2026-08-07T00:13:59.863471Z","title":"When to trust your model: Model-based policy optimization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:59.863471Z"},"links":{"cited_paper":"/paper/1906.08253","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:5e1da008a20d2d59ac560f6b25d50572d283422d2c8b4cfdc8b2b61dcd41b63e","observation_id":"b19ba749-5d32-4ce3-9e9d-fe3272aec4e7","resolution":{"observed_at":"2026-08-07T00:13:59.863471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-07T00:14:00.028987Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:00.028987Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:2a83b4d65d0acc39dd7a8f30eff760c50aac90e4cbd933f3a607dfebcfb02d12","observation_id":"acfdb82d-33b9-4012-b811-93d6d9296bb6","resolution":{"observed_at":"2026-08-07T00:14:00.028987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:00.359713Z","title":"Campbell, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:00.359713Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:03cdc540d14701116489b370743e1586137d9625ecc923555ac918ff6ce357c9","observation_id":"fb6490ae-058f-4dcc-928a-c6dd86ac2b3c","resolution":{"observed_at":"2026-08-07T00:14:00.359713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02385","last_updated":"2025-06-22T03:30:55Z","snapshot_observed_at":"2026-08-02T22:45:54.982294Z","submitted_at":"2024-11-04T18:53:05Z","title":"How Far is Video Generation from World Model: A Physical Law Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02385","snapshot_observed_at":"2026-08-07T00:14:00.561971Z","title":"How far is video generation from world model: A physical law perspective","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:00.561971Z"},"links":{"cited_paper":"/paper/2411.02385","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:2b79005953ddf51f09002b83f9329ab4fc7485862329c177757fde23892dc2b6","observation_id":"1869e172-5ccf-4251-a77e-6c13ba01f8d6","resolution":{"observed_at":"2026-08-07T00:14:00.561971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04079","last_updated":"2023-08-08T06:37:06Z","snapshot_observed_at":"2026-08-06T16:14:01.420404Z","submitted_at":"2023-08-08T06:37:06Z","title":"3D Gaussian Splatting for Real-Time Radiance Field Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04079","snapshot_observed_at":"2026-08-07T00:14:00.691150Z","title":"3D Gaussian splatting for real-time radiance field rendering.ACM Trans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:00.691150Z"},"links":{"cited_paper":"/paper/2308.04079","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:988ed5c6b72c00986adff1955f832aa56b5c0369f9fd35e971c5d5385682dc30","observation_id":"270d5609-91cd-4f56-a308-037df564de9b","resolution":{"observed_at":"2026-08-07T00:14:00.691150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:00.227718Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:00.227718Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:1774b64750645b40dcb90f88ae6946601805c9f1dea2d3e77ccec90e21febec9","observation_id":"92f07825-7f06-4a40-9a2d-0c02d353c3cc","resolution":{"observed_at":"2026-08-07T00:14:00.227718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.08756","last_updated":"2021-08-16T19:00:16Z","snapshot_observed_at":"2026-07-06T11:10:37.017160Z","submitted_at":"2021-05-18T18:13:53Z","title":"Pathdreamer: A World Model for Indoor Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.08756","snapshot_observed_at":"2026-08-07T00:14:00.967892Z","title":"PathDreamer: A world model for indoor navigation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:00.967892Z"},"links":{"cited_paper":"/paper/2105.08756","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:44e8c84a56b67d91af8d8bc8cedfd9c059b030ec2a55837529dfe22044b79b74","observation_id":"69912466-b51f-40b4-9385-4310e9cdd587","resolution":{"observed_at":"2026-08-07T00:14:00.967892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01576","last_updated":"2026-05-23T02:41:44Z","snapshot_observed_at":"2026-08-03T05:41:42.857114Z","submitted_at":"2026-02-02T03:12:16Z","title":"Generative Visual Code Mobile World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01576","snapshot_observed_at":"2026-08-07T00:14:01.084068Z","title":"Generative visual code mobile world models.arXiv preprint arXiv:2602.01576, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:01.084068Z"},"links":{"cited_paper":"/paper/2602.01576","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:c15bbabee5084a2ac576c0ce9f3470a7b6dfc6f9a1999abdb2062af54ad359a6","observation_id":"9deec7c2-5ffa-47c8-8e31-d1a3d9a123bc","resolution":{"observed_at":"2026-08-07T00:14:01.084068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11916","last_updated":"2023-01-29T05:14:17Z","snapshot_observed_at":"2026-08-07T04:02:08.445660Z","submitted_at":"2022-05-24T09:22:26Z","title":"Large Language Models are Zero-Shot Reasoners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11916","snapshot_observed_at":"2026-08-07T00:14:01.202114Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:01.202114Z"},"links":{"cited_paper":"/paper/2205.11916","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:abe4f3b5a32a42fcd64210490316d68a24cd19c1a98c9b79ae666c08ab0f914c","observation_id":"1ad1115b-e7f9-4aed-a6c2-41b49d5c7bfd","resolution":{"observed_at":"2026-08-07T00:14:01.202114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07996","last_updated":"2026-07-20T17:34:32Z","snapshot_observed_at":"2026-08-07T09:38:31.708978Z","submitted_at":"2025-09-04T17:59:58Z","title":"3D and 4D World Modeling: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.07996","snapshot_observed_at":"2026-08-07T00:14:01.335145Z","title":"3D and 4D world modeling: A survey","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:01.335145Z"},"links":{"cited_paper":"/paper/2509.07996","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:9e519f4dc30165ddb92c8e03278c2ce838a6855645e750c9feb8fb8154b0080f","observation_id":"47ad3b83-c549-4f1a-bc4e-9a9f1afbded0","resolution":{"observed_at":"2026-08-07T00:14:01.335145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08491","last_updated":"2024-03-09T10:44:58Z","snapshot_observed_at":"2026-07-06T16:32:00.957275Z","submitted_at":"2023-10-12T16:50:08Z","title":"Prometheus: Inducing Fine-grained Evaluation Capability in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08491","snapshot_observed_at":"2026-08-07T00:14:00.821435Z","title":"Prometheus: Inducing fine-grained evaluation capability in language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:00.821435Z"},"links":{"cited_paper":"/paper/2310.08491","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:9042dc75533425f11373d7479ef7e7fb638ae460c2ddcaf6d467405f35b7bca0","observation_id":"23f0f18b-0cf3-4c05-bfe9-84b4bcc6320b","resolution":{"observed_at":"2026-08-07T00:14:00.821435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:02.431452Z","title":"A path towards autonomous machine intelligence.OpenReview preprint, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:02.431452Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:7ebe2521e27c14afc043fd048035368338c8b38403b974b8447bfe58d5fe5b56","observation_id":"656deb64-4dd4-42e0-a617-7f1281e26905","resolution":{"observed_at":"2026-08-07T00:14:02.431452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09756","last_updated":"2024-06-14T06:46:30Z","snapshot_observed_at":"2026-08-07T16:51:49.779326Z","submitted_at":"2024-06-14T06:46:30Z","title":"Grounding Image Matching in 3D with MASt3R","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09756","snapshot_observed_at":"2026-08-07T00:14:02.571229Z","title":"Grounding image matching in 3D with MASt3R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:02.571229Z"},"links":{"cited_paper":"/paper/2406.09756","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:72a947f0b77e666c85ecde42d6e363a615084e2138a59ae479e62b63575329e0","observation_id":"c940c8ed-b130-488c-80c3-524b8590abc2","resolution":{"observed_at":"2026-08-07T00:14:02.571229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09227","last_updated":"2024-03-14T09:48:36Z","snapshot_observed_at":"2026-08-06T09:37:53.788323Z","submitted_at":"2024-03-14T09:48:36Z","title":"BEHAVIOR-1K: A Human-Centered, Embodied AI Benchmark with 1,000 Everyday Activities and Realistic Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09227","snapshot_observed_at":"2026-08-07T00:14:02.647580Z","title":"BEHAVIOR-1K: A human-centered, embodied AI benchmark with 1,000 everyday activities and realistic simulation.arXiv preprint arXiv:2403.09227, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:02.647580Z"},"links":{"cited_paper":"/paper/2403.09227","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:bc3425b64b7ebc4f779f6fad0bc02863be470733e6d692137ddc8c5edc164b1c","observation_id":"e8b57921-b747-4c21-924d-f359b64f7a92","resolution":{"observed_at":"2026-08-07T00:14:02.647580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20694","last_updated":"2025-02-28T03:58:23Z","snapshot_observed_at":"2026-08-07T17:41:02.221324Z","submitted_at":"2025-02-28T03:58:23Z","title":"WorldModelBench: Judging Video Generation Models As World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20694","snapshot_observed_at":"2026-08-07T00:14:02.723079Z","title":"WorldModelBench: Judging video generation models as world models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:02.723079Z"},"links":{"cited_paper":"/paper/2502.20694","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:84dd0d466db40d9efa31aeba91f52a213552bdb7027778a2958c6cbbc0436333","observation_id":"f37a8bb2-5faa-49a9-824b-b4f0e931d151","resolution":{"observed_at":"2026-08-07T00:14:02.723079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10858","last_updated":"2026-05-11T17:05:49Z","snapshot_observed_at":"2026-07-06T23:22:47.781940Z","submitted_at":"2026-05-11T17:05:49Z","title":"Is Your Driving World Model an All-Around Player?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10858","snapshot_observed_at":"2026-08-07T00:14:01.674536Z","title":"Is your driving world model an all-around player? InIEEE/CVF Conf","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:01.674536Z"},"links":{"cited_paper":"/paper/2605.10858","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:91c4e8adb13babf9460a7e22418663a671351eb532ea0f381c0ac556d2f5a256","observation_id":"9765b7ef-976a-4043-92fc-e054f76aaef2","resolution":{"observed_at":"2026-08-07T00:14:01.674536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.02900","last_updated":"2026-05-24T13:33:45Z","snapshot_observed_at":"2026-08-02T11:46:07.449862Z","submitted_at":"2026-03-28T13:21:44Z","title":"Safety in Embodied AI: A Survey of Risks, Attacks, and Defenses","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.02900","snapshot_observed_at":"2026-08-07T00:14:03.294194Z","title":"SafetyinembodiedAI:Asurvey of risks, attacks, and defenses.arXiv preprint arXiv:2605.02900, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:03.294194Z"},"links":{"cited_paper":"/paper/2605.02900","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:496d8c359e5e6cd20422d9eb5ae27e6267b1f2487e32cf16d8a8d6ccdbc2c3ba","observation_id":"d025adcd-7dd5-44b6-9a49-5974552078ca","resolution":{"observed_at":"2026-08-07T00:14:03.294194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.16732","last_updated":"2026-06-25T19:54:02Z","snapshot_observed_at":"2026-08-07T10:54:05.573771Z","submitted_at":"2025-10-19T07:12:32Z","title":"A Comprehensive Survey on World Models for Embodied AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.16732","snapshot_observed_at":"2026-08-07T00:14:03.425756Z","title":"A comprehensive survey on world models for embodied AI.arXiv preprint arXiv:2510.16732, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:03.425756Z"},"links":{"cited_paper":"/paper/2510.16732","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:857eed70052d78140db64e32e97c47c2eef01113417a4ce4f979da1a12607a28","observation_id":"d93562c4-f6bf-4119-bdc8-efb2d3410d7a","resolution":{"observed_at":"2026-08-07T00:14:03.425756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04463","last_updated":"2024-12-06T19:15:46Z","snapshot_observed_at":"2026-08-03T14:50:26.372066Z","submitted_at":"2024-12-05T18:59:42Z","title":"MegaSaM: Accurate, Fast, and Robust Structure and Motion from Casual Dynamic Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04463","snapshot_observed_at":"2026-08-07T00:14:03.547097Z","title":"MegaSaM: Accurate, fast, and robust structure and motion from casual dynamic videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:03.547097Z"},"links":{"cited_paper":"/paper/2412.04463","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:40eb299b1b93232b3f15f85f0eec765a703ed101551a1c6b7ba7adf855eb431b","observation_id":"92908842-d826-41de-bd15-bf46b2f7bddc","resolution":{"observed_at":"2026-08-07T00:14:03.547097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03575","last_updated":"2024-07-19T07:28:03Z","snapshot_observed_at":"2026-07-06T17:55:44.838732Z","submitted_at":"2024-04-04T16:38:57Z","title":"DreamScene: 3D Gaussian-based Text-to-3D Scene Generation via Formation Pattern Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03575","snapshot_observed_at":"2026-08-07T00:14:02.872970Z","title":"DreamScene: 3D gaussian-based text-to-3D scene generation via formation pattern sampling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:02.872970Z"},"links":{"cited_paper":"/paper/2404.03575","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:f4672a1e6eef8e76279e399cbf2083cda58341b2d9ceaf39e69dae258dbdbe11","observation_id":"30a25c75-01b9-4fb4-94de-8661041649a3","resolution":{"observed_at":"2026-08-07T00:14:02.872970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:03.823108Z","title":"Codeaspolicies: Languagemodelprogramsforembodiedcontrol","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:03.823108Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:3727579abe4d524fd6e7b9b05c8b559363624da4d8d0465405c382959e9ebe3c","observation_id":"9417c376-aa33-413d-8fd9-7b3bd67f6ef1","resolution":{"observed_at":"2026-08-07T00:14:03.823108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:03.183457Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:03.183457Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:dee67f4550844674f59076f71cac070804c2719bb1218c7cc340173cf64eaab2","observation_id":"621450be-873e-4979-8b93-2d057cb21d4c","resolution":{"observed_at":"2026-08-07T00:14:03.183457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05498","last_updated":"2026-04-07T06:41:41Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T06:41:41Z","title":"JailWAM: Jailbreaking World Action Models in Robot Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.05498","snapshot_observed_at":"2026-08-07T00:14:04.691593Z","title":"JailWAM: Jailbreaking world action models in robot control","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:04.691593Z"},"links":{"cited_paper":"/paper/2604.05498","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:f3de203fa76b7cfee1a981e3420a05ea18413cd6fd8295a171b8f8a3ec9b7d9d","observation_id":"6793d2ba-dc6c-4f72-b3d3-a5be3d4c46c8","resolution":{"observed_at":"2026-08-07T00:14:04.691593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08268","last_updated":"2025-02-03T21:47:31Z","snapshot_observed_at":"2026-08-05T16:01:06.026395Z","submitted_at":"2024-02-13T07:47:36Z","title":"World Model on Million-Length Video And Language With Blockwise RingAttention","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08268","snapshot_observed_at":"2026-08-07T00:14:04.837069Z","title":"World model on million-length video and lan- guage with blockwise RingAttention","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:04.837069Z"},"links":{"cited_paper":"/paper/2402.08268","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:73eff759658ba269bafc8b954cce7039041d988f618b2da11e9760410173b1b0","observation_id":"24882778-3b69-4094-9c7a-8ddfd00dd58f","resolution":{"observed_at":"2026-08-07T00:14:04.837069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:03.688692Z","title":"LiDARCrafter: Dynamic 4D world modeling from LiDAR sequences","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:03.688692Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:d57432b558607ddf4ad4c8f7d102b408ed5b78f158b7c14585655847d216c080","observation_id":"3fdecfe2-3550-4b24-ba64-8cd39192a71f","resolution":{"observed_at":"2026-08-07T00:14:03.688692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16634","last_updated":"2023-05-23T22:12:16Z","snapshot_observed_at":"2026-08-02T04:02:36.848064Z","submitted_at":"2023-03-29T12:46:54Z","title":"G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16634","snapshot_observed_at":"2026-08-07T00:14:05.920491Z","title":"G-Eval: NLG evalu- ation using GPT-4 with better human alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:05.920491Z"},"links":{"cited_paper":"/paper/2303.16634","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:352880a5adfcf2cbc46450f606043f0cf9c1509eb2c34fce4a14b514160d09f0","observation_id":"3c569184-f91a-4c2a-96f6-6122deedca7d","resolution":{"observed_at":"2026-08-07T00:14:05.920491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:06.027717Z","title":"GWM: Towards scalable gaussian world models for robotic manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:06.027717Z"},"links":{"citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:4832a39c5a31bc6b17e784c74f24d2ebde0ea5c79811ec1b0253dd4f6a5c502f","observation_id":"bb06554f-0d80-42c5-afb9-0f9fe81a2240","resolution":{"observed_at":"2026-08-07T00:14:06.027717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T18:10:55.279151Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":226},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 226 outbound references and 0 inbound Pith citation observations for arXiv:2608.02713."}