{"as_of":"2026-08-06T18:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ab80c1c2a0460f4e6ddf28c652371eafbef5099a47fe458b29e32df86bd5c30b","coverage":[{"denominator":168,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T09:42:23.808691Z","state":"measured"},{"denominator":105,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":105,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T22:22:06.385856Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T17:50:00.080974Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.04707","snapshot_observed_at":"2026-07-12T22:22:06.385856Z","title":"Openworldlib: A unified codebase and definition of advanced world models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.10783","last_updated":"2026-05-25T13:18:36Z","snapshot_observed_at":"2026-07-12T22:21:23.393919Z","submitted_at":"2026-04-12T19:18:02Z","title":"Learning Preference-Based Objectives from Clinical Narratives for Dynamic Sepsis Treatment","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-12T22:22:06.385856Z"},"links":{"cited_paper":"/paper/2604.04707","citing_paper":"/paper/2604.10783"},"observation_digest":"sha256:d813516b2dbd0fd9f38312235d2c21224dfe03a907540eff618c51ebf9e7b93d","observation_id":"e2867898-b0f8-4474-99db-0e3ddbfea3a3","resolution":{"observed_at":"2026-07-12T22:22:06.385856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"cited_work":{"arxiv_id":"2604.04707","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.04707","snapshot_observed_at":"2026-07-04T17:50:00.080974Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","venue":"cs.CV","work_id":"3e02abe3-2305-4b43-9e49-bdd041e0aa0b","year":2026},"citing_paper":{"arxiv_id":"2604.10784","last_updated":"2026-05-19T19:12:18Z","snapshot_observed_at":"2026-07-06T22:59:18.756089Z","submitted_at":"2026-04-12T19:19:04Z","title":"TorchUMM: A Unified Multimodal Model Codebase for Evaluation, Analysis, and Post-training","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T15:32:01.551829Z"},"links":{"cited_paper":"/paper/2604.04707","citing_paper":"/paper/2604.10784"},"observation_digest":"sha256:5cd4fe3924bf6b1c223364f8304b85ca1652509d799f941adc7bb8c5553f3c9c","observation_id":"d707b2f4-9d2f-4184-a811-6397005aacd2","resolution":{"observed_at":"2026-05-11T10:21:03.160725Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"cited_work":{"arxiv_id":"2604.04707","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.04707","snapshot_observed_at":"2026-07-04T17:50:00.080974Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","venue":"cs.CV","work_id":"3e02abe3-2305-4b43-9e49-bdd041e0aa0b","year":2026},"citing_paper":{"arxiv_id":"2604.10784","last_updated":"2026-05-19T19:12:18Z","snapshot_observed_at":"2026-07-06T22:59:18.756089Z","submitted_at":"2026-04-12T19:19:04Z","title":"TorchUMM: A Unified Multimodal Model Codebase for Evaluation, Analysis, and Post-training","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T08:59:10.877437Z"},"links":{"cited_paper":"/paper/2604.04707","citing_paper":"/paper/2604.10784"},"observation_digest":"sha256:ad778d1396d371d58693a68cbf9dbd4b7806bf84cd7f17ad2b5043e059e6432f","observation_id":"4698b08e-fce8-4977-9ca0-fd8a186f2082","resolution":{"observed_at":"2026-05-21T08:59:55.243692Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"cited_work":{"arxiv_id":"2604.04707","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.04707","snapshot_observed_at":"2026-07-04T17:50:00.080974Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","venue":"cs.CV","work_id":"3e02abe3-2305-4b43-9e49-bdd041e0aa0b","year":2026},"citing_paper":{"arxiv_id":"2606.11129","last_updated":"2026-06-23T05:28:32Z","snapshot_observed_at":"2026-07-06T23:50:16.299969Z","submitted_at":"2026-06-09T17:24:36Z","title":"WorldOlympiad: Can Your World Model Survive a Triathlon?","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T13:05:26.397711Z"},"links":{"cited_paper":"/paper/2604.04707","citing_paper":"/paper/2606.11129"},"observation_digest":"sha256:17526146ec6447daf2350a218baf04383d2f8aa2659edd602f92be7f6ee01f55","observation_id":"20942eb3-9b31-4ca7-a937-8c3573ddcd4c","resolution":{"observed_at":"2026-07-03T05:47:41.290613Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"cited_work":{"arxiv_id":"2604.04707","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.04707","snapshot_observed_at":"2026-07-04T17:50:00.080974Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","venue":"cs.CV","work_id":"3e02abe3-2305-4b43-9e49-bdd041e0aa0b","year":2026},"citing_paper":{"arxiv_id":"2606.24669","last_updated":"2026-06-23T15:03:31Z","snapshot_observed_at":"2026-07-06T23:59:13.320720Z","submitted_at":"2026-06-23T15:03:31Z","title":"LaGO: Latent Action Guidance for Online Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-25T23:26:55.307583Z"},"links":{"cited_paper":"/paper/2604.04707","citing_paper":"/paper/2606.24669"},"observation_digest":"sha256:f124b950b9dded692cff135fea13bcca3221bedf0a98cb1f5812f4e23a2c9410","observation_id":"fc9caea3-1112-4fac-ade1-87d16ee8bdf9","resolution":{"observed_at":"2026-07-04T17:50:00.082392Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.04707/citation-record","integrity":"/paper/2604.04707/integrity","json":"/paper/2604.04707/citation-record.json","paper":"/paper/2604.04707"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Cosmos world foundation model platform for physical ai.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:69a60453a585eb86315e4f63536246f030c72a247a5abf936a2964662c8a38e0","observation_id":"414af9e3-47d4-4398-a455-fc112d2d59d6","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00062","last_updated":"2026-02-24T21:52:50Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-10-28T22:44:13Z","title":"World Simulation with Video Foundation Models for Physical AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.00062","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"World simulation with video foundation models for physical ai.arXiv preprint arXiv:2511.00062, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2511.00062","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:1782c5d77aae753bd38c435118d13582afd1f86676ddf2c88884abfd87dff95b","observation_id":"d6ab8ce6-250c-4191-aa3f-8b7db6070145","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Unictokens: Boosting personalized understanding and generation via unified concept tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:0d6e7b936e858d71fe64d86a72b749b749c82cfb17940f6bda112f5390723d9e","observation_id":"82546fd9-f863-462e-a1ce-7bd97351f667","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Genius: Generative fluid intelligence evaluation suite.arXiv preprint arXiv:2602.11144, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:c174a02978f0665300125e4b693964e4153e15c02e43dc29d5d5da1ce770e4fa","observation_id":"756c8c3c-09d9-4d96-8b5e-9175c6b87b4a","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"V-jepa 2: Self-supervised video models enable understanding, prediction and planning.arXiv preprint arXiv:2506.09985, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:3affb11608b9220c754f9d78ba68e69841791209e4f6bd779058f34b4ceb14b7","observation_id":"ef4339cd-0695-4a61-8b2a-e82da2a66563","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Recammaster: Camera-controlled generative rendering from a single video","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:b45f499e8eb73cc44b1f8e5540a71971a9cc996e4244119dbc51e252ea7557dd","observation_id":"b3cacc39-ab85-4108-8f17-4203d88a6898","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Qwen technical report.arXiv preprint arXiv:2309.16609, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:f1cbd0a03fe21175a174ebe4f9b9cbcea48508851f09b22ef093d1697ec8a53b","observation_id":"c4f88bb0-88b8-4e0c-b4bb-7833ae4a6ebf","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16640","last_updated":"2024-07-18T09:01:52Z","snapshot_observed_at":"2026-07-06T18:20:09.790181Z","submitted_at":"2024-05-26T17:31:21Z","title":"A Survey of Multimodal Large Language Model from A Data-centric Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16640","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"A survey of multimodal large language model from a data-centric perspective.arXiv preprint arXiv:2405.16640, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2405.16640","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:4341661c775cd259fb6101ad19a84bccba27d0e527eba2db87f88624fcf43157","observation_id":"06edcd31-2e63-438d-8c94-55e9d3787a46","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07235","last_updated":"2025-06-08T17:38:49Z","snapshot_observed_at":"2026-07-06T21:38:44.739873Z","submitted_at":"2025-06-08T17:38:49Z","title":"Multi-Step Visual Reasoning with Visual Tokens Scaling and Verification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07235","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Multi-step visual reasoning with visual tokens scaling and verification.arXiv preprint arXiv:2506.07235, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2506.07235","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:17c8c63b860e55ada642491d8541ee1cb667d9660fa028290e56363bbca57114","observation_id":"979eb267-7af1-4b5b-94d9-ca1c7e9f0ca1","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Positional encoding field.arXiv preprint arXiv:2510.20385, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:7c5201eca3ee400400e0d390482b04baef19034bdfd5951b9473f52d416ae1b7","observation_id":"1d4b282d-8ff1-4c43-8f35-181c8cc2546a","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"The safety challenge of world models for embodied ai agents: a review","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:48a6814f562a2018846a321e62ac83532e2e1d3323664827d8430cb855b8e57c","observation_id":"ba9bbdc2-5329-438c-a910-0fbde5508d1b","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"V-jepa: Latent video prediction for visual representation learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:e60167f608470cd0842f63d31ac9a9b2809585b0803eeb85d9c8804273fefd0b","observation_id":"daccdbc6-def8-4823-94c5-3474a5322fde","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"arXiv preprint arXiv:2410.24164, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:2d752e5e2f8521aeaa74fca1450c73a3cd862fc25b3d25b3f6ce8445e44d2046","observation_id":"5cd98ad9-9a92-4cf0-8f22-82a3d7550995","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Lovr: A benchmark for long video retrieval in multimodal contexts","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:b4088899bf4c2c81b84e5421fd14a33763f14484ee1a67790af864b8488d4223","observation_id":"0dec557c-3b58-4532-8832-ac904749e5d9","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Text2sql-flow: A robust sql-aware data augmentation framework for text-to-sql.arXiv preprint arXiv:2511.10192, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:2781d7de6a2ef6700aa9fe5de8a6b4880d3e7d4de1ff092543844523edbeb9ad","observation_id":"b7e9375a-c644-488a-8507-5632dc802951","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21539","last_updated":"2025-06-26T17:55:40Z","snapshot_observed_at":"2026-08-06T05:50:28.186700Z","submitted_at":"2025-06-26T17:55:40Z","title":"WorldVLA: Towards Autoregressive Action World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21539","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Worldvla: Towards autoregressive action world model.arXiv preprint arXiv:2506.21539, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2506.21539","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:e0efb26c1370523196997967111010c4fed1cbd321b76beefe331370a54500a0","observation_id":"8c4b2761-9cc7-47f0-a8db-b1143e03c025","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Spatialvlm: En- dowing vision-language models with spatial reasoning capabilities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:7159da33af7cc2ae48553f27deea09b17037d9a8956f54db8273e1ecd9b75d34","observation_id":"bba0f64c-6738-4c31-9629-ddc8bed1c207","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Diadem: Advancing dialogue descriptions in audiovisual video captioning for multimodal large language models.arXiv preprint arXiv:2601.19267, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:f8d46c90ab018956dc01acb9b2fa0d74d526d247bc08496c6ab54dbcef2eab25","observation_id":"4ec897bc-6e23-422b-9501-19e018c1d348","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Think with 3d: Geometric imagination grounded spatial reasoning from limited views","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:84b567a4ea8bdd5b83ef6120cba036ca426a01657c47e16e9da7166264a27bec","observation_id":"83cc6ee7-9ea9-4e75-a226-bdd44a3be81b","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Wow: Towards a world omniscient world model through embodied interaction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:684daff3a61fea51dc7c169aa016c14819e36d3b10150b9eaccf5cca782b384e","observation_id":"50ed3ddf-3f91-4c59-a703-326a05177814","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Gemini 2.5: Pushing the frontier with advanced reasoning, multimodality, long context, and next generation agentic capabilities.arXiv preprint arXiv:2507.06261, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:4a527723edd851d1f233aa3485c27d1c855c5f7c8564876c5a6b5a58ef203f4e","observation_id":"57049d44-8c1b-4ed9-825c-1ff39e6c9908","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Cwm: An open-weights llm for research on code generation with world models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:783ac0128fa0670ce0e3542195a50af33878b2731b3fa9295cd8eee758a7ee08","observation_id":"00210aba-d0e9-41bf-8dd8-7514aee6cc70","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.26583","last_updated":"2025-10-30T15:11:16Z","snapshot_observed_at":"2026-07-31T17:39:49.561332Z","submitted_at":"2025-10-30T15:11:16Z","title":"Emu3.5: Native Multimodal Models are World Learners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.26583","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2510.26583","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:55e9123c5e8f5b642d97921217d25f9bbada0f305ee33b3a0d1b4fa2f9b59b7b","observation_id":"3b0d5a40-e62d-4bcd-a180-c53f7d1e3158","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Molmo and pixmo: Open weights and open data for state-of-the-art vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:504f0ec82c715f2f08de35ed8bcb271bdf20c4545b0804e7568030e24f59ba50","observation_id":"21b24009-feb4-4786-a0f0-36b3cac5a808","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:1505f2b70b264a178e21531b28c338530149648e9977b54771a9a934a4bb6038","observation_id":"28962104-6e70-478b-ab86-797cf8b67489","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Understanding world or predicting future? a comprehensive survey of world models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:81e228379f18dbae7b6d41a79a0c8b98f7177fc6e34f032380ba12da1e5139c9","observation_id":"f07800d9-a232-4f3c-a1c1-ac6d49398f02","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.04804","last_updated":"2026-05-13T17:11:48Z","snapshot_observed_at":"2026-07-30T23:51:10.917702Z","submitted_at":"2026-02-04T17:51:05Z","title":"OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.04804","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Omnisift: Modality-asymmetric token compression for efficient omni-modal large language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2602.04804","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:c83c86d852137bb70892ce37c00d34edbdb43bd4805f85dcba230d3ce03e1410","observation_id":"bb0a9277-a48b-4e5a-b518-68e26f385471","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Mineru-diffusion: Rethinking document ocr as inverse rendering via diffusion decoding.arXiv preprint arXiv:2603.22458, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:33c30280295d97d4c4e04632e1aa92f1fa8d7e5b108a246eb1a0713140aa622c","observation_id":"9f78adf1-f26f-453c-ae5e-eee27decea8c","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Web world models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:f7422d4f66b8441b502ecdaf30b526d6d6dd3ec5b1daa183b496923e337eae69","observation_id":"7afef590-db17-4dfb-aaed-98e1011c5886","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11260","last_updated":"2025-09-10T14:02:23Z","snapshot_observed_at":"2026-07-06T20:23:13.049815Z","submitted_at":"2025-01-20T04:00:02Z","title":"A Survey of World Models for Autonomous Driving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11260","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"A survey of world models for autonomous driving.arXiv preprint arXiv:2501.11260, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2501.11260","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:5f8f562af8debc7ace86ea7234552a7ccc8d2fad0cd50da2879cbc3308b20828","observation_id":"ef2578d4-2312-46a0-a1af-f6dfb5836a35","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09943","last_updated":"2025-06-11T17:10:36Z","snapshot_observed_at":"2026-08-05T16:53:34.264139Z","submitted_at":"2025-06-11T17:10:36Z","title":"CausalVQA: A Physically Grounded Causal Reasoning Benchmark for Video Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09943","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Causalvqa: A physically grounded causal reasoning benchmark for video models.arXiv preprint arXiv:2506.09943, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2506.09943","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:54d25ec4b525b397cf21fa51b2bb9310a9da68175d5833225846377b2da58cc6","observation_id":"b8071a87-fb3f-4568-92b6-9a6028d83d0b","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22355","last_updated":"2025-07-07T15:42:11Z","snapshot_observed_at":"2026-07-06T21:48:45.170162Z","submitted_at":"2025-06-27T16:05:34Z","title":"Embodied AI Agents: Modeling the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.22355","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Embodied ai agents: Modeling the world.arXiv preprint arXiv:2506.22355, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2506.22355","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:2efc9be08f2895fde0b12dcf5fa4c36e904a99dab51bd4d7e33f26dd6a0bfd9c","observation_id":"62a32f2e-dfab-470b-91b6-fe0ad5b66666","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Spatial reasoning with vision-language models in ego-centric multi-view scenes.arXiv preprint arXiv:2509.06266, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:de48b157347e831a4bb44def6f5ef73b02d515c5a0aa89a6e42e8b48750a8587","observation_id":"7be55b1f-0ce3-4f8e-ae3f-244e0c9d1757","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Osvi-wm: One-shot visualimitationforunseentasksusingworld-model-guidedtrajectorygeneration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:b8d96d704aaa67843f4eb0a4fb5cf57d08dd7b2d9c1b5718f70f8954e9140fc4","observation_id":"ecb779c0-8155-4d96-8653-ece613e0f9f5","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Deepseek-coder: When the large language model meets programming–the rise of code intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:871c33c684e5cc651872609e6256148524fb09b2a4a3c8553cc4a98e0b32e748","observation_id":"c77279e2-90c3-492e-b1c5-6c03b9c1b882","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:f765e442190c149399b026be9f50cd5297e349f3a4046631912b0d821df02d6b","observation_id":"c26a7111-691f-469e-b869-81da6fc2f5c5","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07062","last_updated":"2025-05-11T17:28:30Z","snapshot_observed_at":"2026-08-02T16:13:31.498470Z","submitted_at":"2025-05-11T17:28:30Z","title":"Seed1.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07062","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2505.07062","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:b8daaa12550efc24dc528a6a7ae201110607b8edc8f5dd7291f59366d9fd9aec","observation_id":"9f7f9bfe-e4d0-46cf-86c9-40be3fad9562","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03168","last_updated":"2025-02-28T14:39:17Z","snapshot_observed_at":"2026-07-06T18:40:57.362549Z","submitted_at":"2024-07-03T14:41:39Z","title":"LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03168","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Liveportrait: Efficient portrait animation with stitching and retargeting control.arXiv preprintarXiv:2407.03168, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2407.03168","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:8cbeb7ef53c0d03b60b163858449c42bad6d870468433486e52c12723c289949","observation_id":"12ae84e1-3f97-4bb1-a22f-209bbe5f9911","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Brace: A benchmark for robust audio caption quality evaluation.arXiv preprint arXiv:2512.10403, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:3e1f99a144707a7fa99b9d39d50d853f4e47f81ff7735f0969b3f7661e9efa43","observation_id":"55b793e6-4564-42fa-9545-d88f5a6e8e1b","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"World models.arXiv preprint arXiv:1803.10122, 2(3), 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:a43229c6da3f60144b7e4e8b421d7b33bf237c7deccaca9ffdf04cd80c7dc15a","observation_id":"0336344f-8838-4ba1-94c2-25473f634609","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-03T15:20:23.515607Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Dream to control: Learning behaviors by latent imagination.arXiv preprint arXiv:1912.01603, 2019","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:63d91f70f14509bc3518c2d798aae08538fde868ba8f61a3753d7e01d12d5a53","observation_id":"aa91fc5f-d060-4dee-8322-81be5dab24b2","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Mastering diverse domains through world models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:55cbab75508b57ab9780b0ed4a42f4925084385563bcd666556ac75bb0c92692","observation_id":"dd4ff5d2-8510-4a98-a06a-78a88f3cb395","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13009","last_updated":"2026-04-07T11:37:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-18T15:28:53Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.13009","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2508.13009","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:de54622069c5d099628e81b5869cd6768a84048884a4e7b337a6ce65cab164bb","observation_id":"e1fda2ba-930f-40c3-95a6-06741b2bfebd","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Imagen video: High definition video generation with diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:c85dfa9fe6622cdd631d86025ca7a80b806a3a08bd76d7629e3fb3cfa8313170","observation_id":"189d7261-247b-4494-b38f-f5a03a4b8c61","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Gaia-1: A generative world model for autonomous driving.arXiv preprint arXiv:2309.17080, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:cc339ec20be97070e352fa20be00d9c1d93c9d00ffd72148908b5720c874d35d","observation_id":"335208ed-0881-444f-b49b-fb35f5c406d6","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Simulating the real world: A unified survey of multimodal generative models.arXiv preprint arXiv:2503.04641, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:3a3b2a1af35d9c9b1124c2242de8836b6dc41c68ef16a7ffa505db36eeb2e5c4","observation_id":"d4f8ce56-90dd-4e95-9178-ca1e12f35f98","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Awesome-world-models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:6ac489a5938f462feb5644a624b8a20d00596cdd570cc2701f66dae5ee615748","observation_id":"7929ba26-eef8-4cda-ba4e-91841b270926","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Vid2world: Crafting video diffu- sionmodelstointeractiveworldmodels","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:9d8ff1ec6bb2f88aa267474ac9b57b8162f06648222e114476cb48986f921449","observation_id":"784c5d15-eea5-411e-a97d-9aab626fb45b","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Mobilevla-r1: Reinforcing vision-language-action for mobile robots.arXiv preprint arXiv:2511.17889, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:18c84549b3a56bf12391094c1d3faa19603be1c850b638f7d4695a4df29d28eb","observation_id":"0b11ad13-7484-412f-a822-9b8622e93b15","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Mllms need 3d-aware representation supervision for scene understanding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:1cab8c5e5403e7b0e8212aa8d9d75470ec4687be3a7ac8440ca9522ffde7e213","observation_id":"56684e3a-0b4d-4bf1-bd9c-322a6a893504","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.04677","last_updated":"2026-07-31T10:43:50Z","snapshot_observed_at":"2026-08-05T23:09:55.836036Z","submitted_at":"2025-12-04T11:11:24Z","title":"Live Avatar: Streaming Real-time Audio-Driven Avatar Generation with Infinite Length","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.04677","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Live avatar: Streaming real-time audio-driven avatar generation with infinite length","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2512.04677","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:bf6a43f48c2c5c89ff955ab3733e3a230c2d479e01f091f9611ea5eff9d9f5d4","observation_id":"ef8231ae-2667-4bbf-8895-cc2fc003d90a","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15442","last_updated":"2025-06-18T13:14:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-18T13:14:46Z","title":"Hunyuan3D 2.1: From Images to High-Fidelity 3D Assets with Production-Ready PBR Material","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15442","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Hunyuan3d 2.1: From images to high-fidelity 3d assets with production-ready pbr material","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2506.15442","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:c49edd43801a64e5b244197947e17244c52e500ac2e73093d7179583b1bcd988","observation_id":"475babdc-c97e-4ed8-a3f4-047c45e1dfcc","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"arXiv preprint arXiv:2504.16054, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:37bc3022d50bb4deae83589b2aca357785e233c8c4bdf2de84d3d73820f59a00","observation_id":"2b784da9-16f9-4cf9-b58c-3caaeff64731","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17242","last_updated":"2025-04-02T21:12:32Z","snapshot_observed_at":"2026-08-02T01:59:04.180455Z","submitted_at":"2024-10-22T17:58:28Z","title":"LVSM: A Large View Synthesis Model with Minimal 3D Inductive Bias","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17242","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Lvsm: A large view synthesis model with minimal 3d inductive bias.arXiv preprint arXiv:2410.17242, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2410.17242","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:51756b4c9c0ed9eeff27153a54cf088880542c3f4e5d267a4462d4cb8e221190","observation_id":"12ea5ff2-10f2-4e20-bb6f-30ebe43a172f","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.13414","last_updated":"2026-01-23T18:59:33Z","snapshot_observed_at":"2026-07-06T22:30:07.020487Z","submitted_at":"2025-09-16T18:00:14Z","title":"MapAnything: Universal Feed-Forward Metric 3D Reconstruction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.13414","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Mapanything: Universal feed-forward metric 3d reconstruction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2509.13414","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:0619d1fbfe5ac0eaf312a2bd88de268e199f2eec3be316169a90640bab9abccb","observation_id":"d071a089-cc0c-4744-be1f-70f1e947890f","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Causal reasoning and large language models: Opening a new frontier for causality.Transactionson Machine Learning Research, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:778dce2a38a32bfd945ea139d9c0048dc1229a813466be49af52af0008b3f288","observation_id":"fc5ffd66-1817-47c1-8465-3c765c1d65ca","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-07-06T06:14:28.435222Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Ai2-thor: An interactive 3d environment for visual ai.arXiv preprint arXiv:1712.05474, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:bdc9293a307701c839a0f82cfd92d40297ec0a3381dcfedb2829caa120329a2d","observation_id":"8bb7a719-0b91-4b35-9416-ff350bdffa48","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"3d and 4d world modeling: A survey.arXiv preprint arXiv:2509.07996, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:dff4d7d7abfa90118442a615ddae59410e8eb60364cb8116a4a6aad5443ce9ff","observation_id":"9298a8c2-2480-4e4f-877d-342df97f879c","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"A path towards autonomous machine intelligence version 0.9","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:7c088dabb06c03d433d7dc027fdfebbccf17979923be544ef71a478f54cfcb8f","observation_id":"1b40cba7-8285-407f-ac59-f40e4c5fe944","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18313","last_updated":"2026-06-29T02:20:45Z","snapshot_observed_at":"2026-08-04T08:57:04.106391Z","submitted_at":"2025-10-21T05:49:01Z","title":"OmniNWM: Omniscient Driving Navigation World Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.18313","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Omninwm: Omniscient driving navigation world models.arXiv preprint arXiv:2510.18313, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2510.18313","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:056d13efef65462cb1a5d824f811f07f8dd3060807de70f228280c5f831dfeda","observation_id":"e0b06fe6-d62a-4d63-9c4b-b312267be7cf","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Semantic routing: Exploring multi-layer llm feature weighting for diffusion transformers","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:0b0b31555c5563132a2bbaa2ec7c809631a82be78548853b0d4647be0644bf2e","observation_id":"db17a96d-42e4-48dd-86b6-8b9303a76204","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Momagen: Generating demonstrations under soft and hard constraints for multi-step bimanual mobile manipulation.arXiv preprint arXiv:2510.18316, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:eb1c1a52472844bc9e9fd158019dd12c10456e76d64e3f5989084e96b8c5cdd5","observation_id":"45044a4c-18a9-432d-b1e5-226454abf401","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:b2dc97004218eec06c615a19d32bf34f8ead3c2790aabb197bc049a4c8c29df6","observation_id":"c9971db1-d70d-4329-9691-8501fc279a82","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Spatialladder: Progressive training for spatial reasoning in vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:021fb1dce4e35293b18682b84cbb27e52bd3c93427e3394686255a80fc282556","observation_id":"46f9d6b9-d51d-4c97-9cce-85f5219a43ee","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17201","last_updated":"2025-06-20T17:50:37Z","snapshot_observed_at":"2026-08-06T02:23:06.881934Z","submitted_at":"2025-06-20T17:50:37Z","title":"Hunyuan-GameCraft: High-dynamic Interactive Game Video Generation with Hybrid History Condition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17201","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Hunyuan-gamecraft: High-dynamic interactive game video generation with hybrid history condition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2506.17201","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:302e39a0e6989bf02c4e13235abb740ec87363eb54c15c5879c0f9b24c824fa3","observation_id":"84ef4230-0bde-43fc-8399-4594774dfe3a","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:ce925ddc868148a441e59f5468a5ffa343ec2e20c14d54801df0cab05d9da3c4","observation_id":"ed7e2a49-1d4b-4674-817e-c9c4e1c543fd","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21998","last_updated":"2026-03-22T15:37:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T17:07:43Z","title":"Causal World Modeling for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21998","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Causal world modeling for robot control.arXiv preprint arXiv:2601.21998, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2601.21998","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:b5b98daf79b5161ebd49fa11a9c3e2f9284d044f0d278bf719bb00233530b160","observation_id":"2923614a-58f2-4afa-9700-b128854d4a2c","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Worldgrow: Generating infinite 3d world","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:9216e23c707b9e079c971054a7ca34aed6ba02f55de51d08e9ac3363e11ceb0f","observation_id":"6bee0877-2040-4f16-9a16-372050c23296","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Drivingdiffusion: Layout-guided multi-view driving scenarios video generation with latent diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:05f3ad3ef771a934bff0c00fe6e5b895fc647fba81ab171b7b0f090cc87c69fd","observation_id":"09cfeeb1-2403-458a-97ea-fca749775bac","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.16732","last_updated":"2026-06-25T19:54:02Z","snapshot_observed_at":"2026-08-04T09:12:26.148461Z","submitted_at":"2025-10-19T07:12:32Z","title":"A Comprehensive Survey on World Models for Embodied AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.16732","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"A comprehensive survey on world models for embodied ai","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2510.16732","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:8ea56e3e958d9e76eaddd2ea92500715d2dd7b36117841b5532c06b7dc9c365e","observation_id":"d0b64b4e-433f-497b-86ef-3cb7e8f5e917","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Flashworld: High-quality 3d scene generation within seconds.arXiv preprint arXiv:2510.13678, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:ee5d98f0028e03b3db0d6e852e9d7e5d55465dcec54f19fd255b6ca101cb2820","observation_id":"723b1d6e-c364-4107-bdc9-3b28bb7993cd","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06908","last_updated":"2025-02-06T09:12:38Z","snapshot_observed_at":"2026-07-31T09:14:56.802440Z","submitted_at":"2024-11-11T12:11:36Z","title":"EVQAScore: A Fine-grained Metric for Video Question Answering Data Quality Evaluation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06908","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Evqascore: Efficient video question answering data evaluation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2411.06908","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:4d432f7d2772be6e82c552a97c8f1db0433f60960d8da353d3267b6943e116a1","observation_id":"3abdb974-0827-4ed3-8fba-9adff8cd2aac","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03104","last_updated":"2024-08-10T14:57:37Z","snapshot_observed_at":"2026-07-06T18:40:57.362549Z","submitted_at":"2024-07-03T13:41:44Z","title":"KeyVideoLLM: Towards Large-scale Video Keyframe Selection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03104","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Keyvideollm: Towards large-scale video keyframe selection.arXiv preprint arXiv:2407.03104, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2407.03104","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:8ee336f42049e06dda128007e98513f7b6ba014b161d479e2090ce4331cb130e","observation_id":"9707cea1-f099-4dc8-96b8-b678058fa7b8","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21669","last_updated":"2024-08-10T15:04:28Z","snapshot_observed_at":"2026-08-05T02:50:21.826065Z","submitted_at":"2024-07-31T15:12:24Z","title":"Synth-Empathy: Towards High-Quality Synthetic Empathy Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21669","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Synth-empathy: Towards high-quality synthetic empathy data.arXiv preprint arXiv:2407.21669, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2407.21669","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:781687ae642a05809056f741d6e4c9734a0687dfd4eadb817cd5f1ef56a3ff04","observation_id":"943280ee-b51a-4c7b-bd7b-72f3352eca9a","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Dataflow: An llm-driven framework for unified data preparation and workflow automation in the era of data-centric ai.arXiv preprint arXiv:2512.16676, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:c55cb259ba9e5aad7daa260ea775b4193ca65c266e5d8f7646d58289c7a9b6ad","observation_id":"01a78be9-eb97-43ad-91cc-d83c5b82344e","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19058","last_updated":"2026-08-05T12:36:09Z","snapshot_observed_at":"2026-08-06T17:39:43.169315Z","submitted_at":"2025-02-26T11:17:50Z","title":"MathDebugger: Detecting and Diagnosing Errors in Synthetic Mathematical Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19058","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Mathclean: A benchmark for synthetic mathematical data cleaning.arXiv preprint arXiv:2502.19058, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2502.19058","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:ecc663eb9e6be5c53eea8b67f00f8e08ad95712c1768febb922d235aba9884b0","observation_id":"43931ae1-d6b7-4ac4-9cd4-d7b00b71a802","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06079","last_updated":"2025-09-07T14:47:32Z","snapshot_observed_at":"2026-08-05T04:36:55.339989Z","submitted_at":"2025-09-07T14:47:32Z","title":"Multimodal Reasoning for Science: Technical Report and 1st Place Solution to the ICML 2025 SeePhys Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06079","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Multimodal reasoning for science: Technical report and 1st place solution to the icml 2025 seephys challenge.arXiv preprint arXiv:2509.06079, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2509.06079","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:be1bada6e6c32950e551dad41d1f37dbb84fa87b2e08758b08b24d1ed7cec4be","observation_id":"e0d45d73-e875-48d5-bdcb-251339d07260","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Data preparation for large language models.Journal of Computer Science and Technology, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:88cc280622323a6e5aff784ffa47e30b8a00f2412631586652cfc1e705a3fb75","observation_id":"1b45878f-beb7-4c15-8a9e-7d0631aa6897","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Towards next-generation llm training: From the data-centric perspective","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:5adf5793b8d88891999032d5b7d7435f5c8ced2d72a408e17e811ded2841e823","observation_id":"a13ba35c-e730-4e7e-9f74-a32398929874","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Dataflex: A unified framework for data-centric dynamic training of large language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:b5e39a8456a673e5f5a25c57738216b4954587a52a798a30a14a2190d9ecd1e8","observation_id":"a28a1b3d-d486-4e67-b212-363cfb41ebc5","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.10647","last_updated":"2025-11-13T18:59:53Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-13T18:59:53Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.10647","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Depth anything 3: Recovering the visual space from any views.arXiv preprint arXiv:2511.10647, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2511.10647","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:afef1975c018b2aee5ec8414f73b997665aa1860e323fe7c44a7da120255d618","observation_id":"ee4eaeaf-f275-4454-a3fc-b07800b5be57","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21765","last_updated":"2025-03-27T17:58:33Z","snapshot_observed_at":"2026-07-06T20:59:49.523414Z","submitted_at":"2025-03-27T17:58:33Z","title":"Exploring the Evolution of Physics Cognition in Video Generation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21765","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Exploring the evolution of physics cognition in video generation: A survey","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2503.21765","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:b2ba06281eafd72d6d25a375b4bb304ee568304533512341c3c3c47619def339","observation_id":"1a3fd40e-e15b-4663-a8f7-66fa2fdc7540","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Evo-0: Vision- language-action model with implicit spatial understanding, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:46151158eeeadac7d29db2f832ba42d685a48ea221caf9fd1ac131b4cad7b8b9","observation_id":"112ee45e-6b94-4d65-86cd-7da9eaf4eb97","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05302","last_updated":"2025-06-05T17:51:39Z","snapshot_observed_at":"2026-07-06T21:37:28.044836Z","submitted_at":"2025-06-05T17:51:39Z","title":"Perceive Anything: Recognize, Explain, Caption, and Segment Anything in Images and Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05302","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Perceive anything: Recognize, explain, caption, and segment anything in images and videos, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2506.05302","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:61c85788054c4c5c16409ffc1d34ffa1b99721b4936d75005f8af51d4ec8caa4","observation_id":"87f48f3a-8a30-4c2e-baec-3acd0e31e9bc","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05573","last_updated":"2025-06-05T20:30:28Z","snapshot_observed_at":"2026-07-06T21:37:37.394452Z","submitted_at":"2025-06-05T20:30:28Z","title":"PartCrafter: Structured 3D Mesh Generation via Compositional Latent Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05573","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Partcrafter: Structured 3d mesh generation via compositional latent diffusion transformers.arXiv preprint arXiv:2506.05573, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2506.05573","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:512c10bdac35754ed514fc0b79ae4eb11800a34b1016fbfe116affe4aa1ec43f","observation_id":"f4fe1c7b-b5b3-47d3-9f30-e93ea443f206","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Deepseek-v3 technical report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:4f435206c4fda5c7b488a419dedce2dc33b4b893c9d8e3ac53a2674056973961","observation_id":"89b23a2e-5cd9-464a-b21b-d9cb25ce22d8","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning.Advances in Neural Information Processing Systems, 36:44776– 44791, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:32cd8862ccbf0068055f80bc4f6d76f44abe109c8cb3d3425ac0ed66973ed20f","observation_id":"3ebf361f-7407-4540-b574-05cfbe81b4a5","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Aligning cyber space with physical world: A comprehensive survey on embodied ai.IEEE/ASME Transactionson Mechatronics, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:0f5dd2ad3e9c1391aadc2aae40fa8ce34e9ca9656561fba97ec9ddf7fe211d5a","observation_id":"47a6de39-e167-4915-9016-85ece10d7529","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Worldmirror: Universal 3d world reconstruction with any-prior prompting.arXiv preprint arXiv:2510.10726, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:f606317cd981d3288505c0d5aa1c3830dd8f46ddf93c4a3a2b0326f6f66065a0","observation_id":"7f92fd4c-12ef-4d25-8662-3f4e4c8c3a33","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20756","last_updated":"2025-08-11T14:20:55Z","snapshot_observed_at":"2026-08-04T05:33:48.921191Z","submitted_at":"2024-07-30T11:57:40Z","title":"SynthVLM: Towards High-Quality and Efficient Synthesis of Image-Caption Datasets for Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20756","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Synthvlm: High-efficiency and high-quality synthetic data for vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2407.20756","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:fb09ac1cf0b0c6461a9cef85574f4616c07595b24d223fd6d7dbd895b3a080eb","observation_id":"86727004-1a7a-436b-b9c3-b4e3579006c4","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00917","last_updated":"2025-09-03T01:44:58Z","snapshot_observed_at":"2026-08-05T10:13:59.728290Z","submitted_at":"2025-07-01T16:23:00Z","title":"A Survey: Learning Embodied Intelligence from Physical Simulators and World Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00917","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"A survey: Learning embodied intelligence from physical simulators and world models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2507.00917","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:fa1774d20c738323210c8bb2a5a7c23dd1d726f9a85deff02bf8c97cc6057d02","observation_id":"1190f747-45c9-48f5-b667-f33ff7c7d85e","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Camclonemaster: Enabling reference-based camera control for video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:8347d4a6e6dd3bee3e6fa9c16db33c7f362a2888386d66f095b9753df96631c7","observation_id":"df9d1fb7-e65b-4c6b-ae14-02ffc349f970","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Harmonydream: Task harmonization inside world models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:163cba3d37fe8d4285b09dc5fc1182976a9ce45cb09c3201792866a9e7312fc7","observation_id":"a7e8b6f9-890d-47f9-a457-a82abb19d40e","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20024","last_updated":"2025-06-10T17:53:33Z","snapshot_observed_at":"2026-07-06T21:15:54.445465Z","submitted_at":"2025-04-28T17:48:43Z","title":"SpatialReasoner: Towards Explicit and Generalizable 3D Spatial Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20024","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Spatialrea- soner: Towards explicit and generalizable 3d spatial reasoning.arXiv preprint arXiv:2504.20024, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2504.20024","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:6f76a2944348f86c729308920d290ec878fcaa690b4f12585da532f84523b8a9","observation_id":"cf327655-b1c2-435d-82ec-7eea25fe57c2","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Robot learning from a physical world model.arXiv preprint arXiv:2511.07416, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:4d15119adeb9b9824c354c5dd86c79f4489dd1d6968d91bffe2edc4a03bd47f8","observation_id":"0a621b29-fbca-4e39-9d30-ca6f9011a98d","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Yume-1.5: A text-controlled interactive world generation model.arXiv preprint arXiv:2512.22096, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:47797e1d8a6a075cbd11ecac3b318f9f5b394f5caa0be53f61072478c57eb47a","observation_id":"255fdf5d-eae1-4241-95b5-c27c073d4d8a","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17744","last_updated":"2025-07-23T17:57:09Z","snapshot_observed_at":"2026-08-06T14:36:41.778601Z","submitted_at":"2025-07-23T17:57:09Z","title":"Yume: An Interactive World Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17744","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Yume: An interactive world generation model.arXiv preprint arXiv:2507.17744, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2507.17744","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:76d499562f59d1f6df608d275f2eff6f7edff700106c18b328c442d116721a08","observation_id":"bfe36f58-ee82-4b75-a284-35a5911b3da8","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08441","last_updated":"2025-06-10T04:28:11Z","snapshot_observed_at":"2026-07-06T21:39:32.912866Z","submitted_at":"2025-06-10T04:28:11Z","title":"Time-Aware World Model for Adaptive Prediction and Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08441","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Time-aware world model for adaptive prediction and control.arXiv preprint arXiv:2506.08441, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2506.08441","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:c3c1101320564f89ea774d69c2644a9545f7020c1e02cc3910e23f94f51cea04","observation_id":"822cc658-b5a1-4bd4-b5ae-e93d9e5efb33","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":"Large language diffusion models.arXiv preprint arXiv:2502.09992, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:a1169dc314bac573f125a70aa7d9b610784dfa246e923077f4ebd654bf6d49e1","observation_id":"9b6af07e-8e4d-4291-a77a-d457f8cfb3f3","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T09:42:23.808691Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-07-13T09:42:23.808691Z"},"links":{"citing_paper":"/paper/2604.04707"},"observation_digest":"sha256:97df9bed11eddaa546ba1cfbc4042992f66d1d2712e75e25bec848d5e4e7bf7c","observation_id":"80db3e27-eae6-4e08-878a-79923b34003d","resolution":{"observed_at":"2026-07-13T09:42:23.808691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2604.04707","last_updated":"2026-05-25T06:28:44Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-13T09:42:22.607962Z","submitted_at":"2026-04-06T14:19:48Z","title":"OpenWorldLib: A Unified Codebase and Definition of Advanced World Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":168},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 100 of 168 outbound references and 5 inbound Pith citation observations for arXiv:2604.04707."}