{"as_of":"2026-08-09T05:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd92e7a95991587c4dc6caa90d821ffdb40056cae6e8a07dec16547604e7d2e4","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":24,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T18:25:51.323654Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T12:46:57.095080Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":"2412.19505","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-02T12:46:57.095080Z","title":"Driving- world: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":"b753c190-c8c0-41ac-89c9-3c549b616477","year":2024},"citing_paper":{"arxiv_id":"2504.18576","last_updated":"2026-04-24T20:54:23Z","snapshot_observed_at":"2026-07-06T21:14:57.707919Z","submitted_at":"2025-04-22T20:58:22Z","title":"DriVerse: Navigation World Model for Driving Simulation via Multimodal Trajectory Prompting and Motion Alignment","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T17:50:59.797593Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2504.18576"},"observation_digest":"sha256:4046ab364b2d0725d4ea41b494dd0cb061ae77543735ad2982c6aa7467785f9c","observation_id":"0db9d819-b5bb-41d5-8218-c317dea44932","resolution":{"observed_at":"2026-05-22T17:51:54.689364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-07T13:13:43.254703Z","title":"Drivingworld: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22421","last_updated":"2025-05-29T12:41:53Z","snapshot_observed_at":"2026-08-09T00:50:02.229626Z","submitted_at":"2025-05-28T14:46:51Z","title":"GeoDrive: 3D Geometry-Informed Driving World Model with Precise Action Control","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:13:43.254703Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2505.22421"},"observation_digest":"sha256:245ddb4a8ff5b8115bfdb22388a4f351edabb5f5f79e06e22438964fb340601d","observation_id":"b78d4b06-e9f4-4de9-acbc-71041aa5bb28","resolution":{"observed_at":"2026-08-07T13:13:43.254703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-07T05:03:12.935432Z","title":"Drivingworld: Constructingworld model for autonomous driving via video gpt.arXiv preprint arXiv:2412.19505, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08967","last_updated":"2025-06-13T10:07:42Z","snapshot_observed_at":"2026-08-08T15:39:54.287755Z","submitted_at":"2025-06-10T16:37:39Z","title":"Step-Audio-AQAA: a Fully End-to-End Expressive Large Audio Language Model","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:03:12.935432Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2506.08967"},"observation_digest":"sha256:8854ed2087e55303eeddff7f519c5b3cbc7043b7d3815cdd86ce866e7332c867","observation_id":"82e4a2a7-0850-40ef-9200-49d35d6dd197","resolution":{"observed_at":"2026-08-07T05:03:12.935432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-06T21:29:49.144575Z","title":"Driving- world: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.24113","last_updated":"2025-06-30T17:56:35Z","snapshot_observed_at":"2026-08-08T02:57:16.646869Z","submitted_at":"2025-06-30T17:56:35Z","title":"Epona: Autoregressive Diffusion World Model for Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:29:49.144575Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2506.24113"},"observation_digest":"sha256:ee3d24aed75e271fdd2b123f3eb7a58e74f35b7e7d4b948af06442c1c3d9495d","observation_id":"bb55e9a0-0669-4394-a68e-ee0fb00a8013","resolution":{"observed_at":"2026-08-06T21:29:49.144575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-06T20:52:02.480908Z","title":"Drivingworld: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01634","last_updated":"2025-07-02T12:05:57Z","snapshot_observed_at":"2026-08-07T12:13:41.680520Z","submitted_at":"2025-07-02T12:05:57Z","title":"Depth Anything at Any Condition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:02.480908Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2507.01634"},"observation_digest":"sha256:bce68c04ac3156851032db178895acefa635a730c3182bcadbc84a7c4192c4f0","observation_id":"65b2649b-0e03-4020-8598-f513f30aee3d","resolution":{"observed_at":"2026-08-06T20:52:02.480908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-06T18:32:54.718781Z","title":"Driving- world: Constructingworld model for autonomous driving via video gpt.arXiv preprint arXiv:2412.19505, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07997","last_updated":"2025-07-14T09:33:58Z","snapshot_observed_at":"2026-08-06T18:25:28.975585Z","submitted_at":"2025-07-10T17:59:54Z","title":"MGVQ: Could VQ-VAE Beat VAE? A Generalizable Tokenizer with Multi-group Quantization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:32:54.718781Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2507.07997"},"observation_digest":"sha256:3df6d81f9941a94c357b5a690f2402ea498dd8e67bc4679d47c132875edcdfec","observation_id":"b2409850-6265-41af-87aa-044ac4955e59","resolution":{"observed_at":"2026-08-06T18:32:54.718781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-05T06:04:15.535672Z","title":"DrivingWorld: Constructing world model for autonomous driving via video GPT.arXiv preprint arXiv:2412.19505, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07996","last_updated":"2026-07-20T17:34:32Z","snapshot_observed_at":"2026-08-07T09:38:31.708978Z","submitted_at":"2025-09-04T17:59:58Z","title":"3D and 4D World Modeling: A Survey","version":4},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-05T06:04:15.535672Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2509.07996"},"observation_digest":"sha256:81098713d06149dce5feda6f4dfe99b9fdfa41b26a1f8e8633623d8a803739af","observation_id":"c4fa05f2-f4f2-4f68-b7ba-c6ffff482753","resolution":{"observed_at":"2026-08-05T06:04:15.535672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-04T09:12:45.347912Z","title":"DrivingWorld: Constructing world model for autonomous driving via video gpt,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.16732","last_updated":"2026-06-25T19:54:02Z","snapshot_observed_at":"2026-08-07T10:54:05.573771Z","submitted_at":"2025-10-19T07:12:32Z","title":"A Comprehensive Survey on World Models for Embodied AI","version":3},"reference_index":133,"source":"pdf_text","source_observed_at":"2026-08-04T09:12:45.347912Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2510.16732"},"observation_digest":"sha256:1fdc426d50e274f48bd6e7fe565caab62af06f0686eeda7f05aa75aee9fda0db","observation_id":"db6ed7d7-8fec-4f55-87cc-dcd438111853","resolution":{"observed_at":"2026-08-04T09:12:45.347912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-04T08:57:09.462192Z","title":"Driving- world: Constructing world model for autonomous driving via video gpt.arXiv preprint arXiv:2412.19505, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.18313","last_updated":"2026-06-29T02:20:45Z","snapshot_observed_at":"2026-08-06T20:20:34.094359Z","submitted_at":"2025-10-21T05:49:01Z","title":"OmniNWM: Omniscient Driving Navigation World Models","version":6},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:09.462192Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2510.18313"},"observation_digest":"sha256:5e3c668083dc98420d99bcced699d049f7f2b4d2cdd7d6cc2593a34b478fa55e","observation_id":"4be31751-4d72-4bd0-8886-6c587a079584","resolution":{"observed_at":"2026-08-04T08:57:09.462192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-03T20:41:57.783447Z","title":"Driving- World: Constructing World Model for Autonomous Driving via Video GPT.arXiv preprint arXiv:2412.19505, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.18735","last_updated":"2026-07-08T02:31:12Z","snapshot_observed_at":"2026-08-03T20:41:54.855751Z","submitted_at":"2025-11-24T04:04:59Z","title":"Thinking Ahead: Foresight Intelligence in MLLMs and World Model","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T20:41:57.783447Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2511.18735"},"observation_digest":"sha256:51c6338b2a7693fe620e13ee1c89541842d0e655e40cc9f2a0bfb00271635129","observation_id":"d054fc5c-8512-4b6f-8410-dd03d7a4fa39","resolution":{"observed_at":"2026-08-03T20:41:57.783447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":"2412.19505","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-02T12:46:57.095080Z","title":"Driving- world: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":"b753c190-c8c0-41ac-89c9-3c549b616477","year":2024},"citing_paper":{"arxiv_id":"2512.23421","last_updated":"2026-04-17T11:51:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-29T12:32:27Z","title":"DriveLaW:Unifying Planning and Video Generation in a Latent Driving World","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T19:34:39.518649Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2512.23421"},"observation_digest":"sha256:dea3de5316d6265156edc8cafbbd341f78fbcfdb3b2aa97fe63c6646a8074e0f","observation_id":"6e6cbc5b-8e79-4619-8c5a-1bd740c0b85f","resolution":{"observed_at":"2026-05-16T19:38:21.152627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":"2412.19505","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-02T12:46:57.095080Z","title":"Driving- world: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":"b753c190-c8c0-41ac-89c9-3c549b616477","year":2024},"citing_paper":{"arxiv_id":"2604.09059","last_updated":"2026-04-10T07:38:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-10T07:38:05Z","title":"Learning Vision-Language-Action World Models for Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T17:08:10.442655Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2604.09059"},"observation_digest":"sha256:345153c7053902792571f4271f37f5ee8bdc174a1073b751bc97d0d910831c46","observation_id":"fccf9409-c6f8-4df7-8646-f78bce711583","resolution":{"observed_at":"2026-05-11T07:31:00.739946Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":"2412.19505","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-02T12:46:57.095080Z","title":"Driving- world: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":"b753c190-c8c0-41ac-89c9-3c549b616477","year":2024},"citing_paper":{"arxiv_id":"2604.12857","last_updated":"2026-04-14T15:09:07Z","snapshot_observed_at":"2026-07-06T23:01:00.830207Z","submitted_at":"2026-04-14T15:09:07Z","title":"Artificial Intelligence for Modeling and Simulation of Mixed Automated and Human Traffic","version":1},"reference_index":145,"source":"pdf_text","source_observed_at":"2026-05-10T16:00:59.662003Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2604.12857"},"observation_digest":"sha256:85eeb7bb5b20af2ac6581092be480dc26d0de70ba7dba7425d364b100794d08d","observation_id":"88dd64db-3028-4efc-94c8-2045588a8501","resolution":{"observed_at":"2026-05-11T09:26:02.515766Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":"2412.19505","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-02T12:46:57.095080Z","title":"Driving- world: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":"b753c190-c8c0-41ac-89c9-3c549b616477","year":2024},"citing_paper":{"arxiv_id":"2604.28196","last_updated":"2026-04-30T17:59:58Z","snapshot_observed_at":"2026-07-06T23:13:29.310140Z","submitted_at":"2026-04-30T17:59:58Z","title":"HERMES++: Toward a Unified Driving World Model for 3D Scene Understanding and Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-07T05:31:59.676725Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2604.28196"},"observation_digest":"sha256:ee92813d920d95e0d2c290768784c15b7551e2f15da6d9b25471c9a324c743c0","observation_id":"1523f59a-96a8-4f5a-bc00-c1ea18730cce","resolution":{"observed_at":"2026-05-12T10:36:29.886059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":"2412.19505","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-02T12:46:57.095080Z","title":"Driving- world: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":"b753c190-c8c0-41ac-89c9-3c549b616477","year":2024},"citing_paper":{"arxiv_id":"2605.10426","last_updated":"2026-05-13T08:01:33Z","snapshot_observed_at":"2026-07-06T23:22:23.287792Z","submitted_at":"2026-05-11T12:01:13Z","title":"CoWorld-VLA: Thinking in a Multi-Expert World Model for Autonomous Driving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-12T03:48:36.717026Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2605.10426"},"observation_digest":"sha256:9eeb9278501ad81e1d8227a85c926d1d4885d90a79fcebd983f110e5212f0c6c","observation_id":"23b6a125-2a6d-4deb-a730-0d96c104108d","resolution":{"observed_at":"2026-05-12T06:56:28.345061Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":"2412.19505","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-02T12:46:57.095080Z","title":"Driving- world: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":"b753c190-c8c0-41ac-89c9-3c549b616477","year":2024},"citing_paper":{"arxiv_id":"2605.10426","last_updated":"2026-05-13T08:01:33Z","snapshot_observed_at":"2026-07-06T23:22:23.287792Z","submitted_at":"2026-05-11T12:01:13Z","title":"CoWorld-VLA: Thinking in a Multi-Expert World Model for Autonomous Driving","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-14T21:36:52.396245Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2605.10426"},"observation_digest":"sha256:b328765c1d46f95e0ac1d7dc20cc1bce3dca155770ec4db9e8daa9ccd54cc286","observation_id":"200f7029-45a7-4d53-903c-1e4a480634f1","resolution":{"observed_at":"2026-05-14T21:38:00.700467Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":"2412.19505","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-02T12:46:57.095080Z","title":"Driving- world: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":"b753c190-c8c0-41ac-89c9-3c549b616477","year":2024},"citing_paper":{"arxiv_id":"2605.26113","last_updated":"2026-05-25T17:59:48Z","snapshot_observed_at":"2026-08-05T18:59:45.803385Z","submitted_at":"2026-05-25T17:59:48Z","title":"AnyScene: Towards Highly Controllable Driving Scene Generation at Anywhere and Beyond","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T21:15:12.465970Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2605.26113"},"observation_digest":"sha256:c96b48d39ad76c17eb4b919e3c6f81b129a22080ac498a03a959a643719534a3","observation_id":"63fe9d34-9637-40c3-81c9-f3479298f508","resolution":{"observed_at":"2026-06-29T22:04:00.902020Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":"2412.19505","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-02T12:46:57.095080Z","title":"Driving- world: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":"b753c190-c8c0-41ac-89c9-3c549b616477","year":2024},"citing_paper":{"arxiv_id":"2606.01164","last_updated":"2026-05-31T11:12:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-31T11:12:30Z","title":"Towards Interactive Video World Modeling: Frontiers, Challenges, Benchmarks, and Future Trends","version":1},"reference_index":213,"source":"pdf_text","source_observed_at":"2026-06-28T17:29:18.513507Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2606.01164"},"observation_digest":"sha256:4743212abe7cf2a111b9286bd87b751478d3cdb1ffdf4aaa0c38fbaf85efc3e1","observation_id":"724b52d1-eaac-4d39-9e19-98173b2f592c","resolution":{"observed_at":"2026-07-01T21:06:13.867181Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":"2412.19505","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-02T12:46:57.095080Z","title":"Driving- world: Constructingworld model for autonomous driving via video gpt","venue":null,"work_id":"b753c190-c8c0-41ac-89c9-3c549b616477","year":2024},"citing_paper":{"arxiv_id":"2606.05645","last_updated":"2026-06-09T07:25:40Z","snapshot_observed_at":"2026-07-06T23:45:37.713710Z","submitted_at":"2026-06-04T03:16:31Z","title":"Discrete-WAM: Unified Discrete Vision-Action Token Editing for World-Policy Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T01:49:25.510681Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2606.05645"},"observation_digest":"sha256:fd77b04e78c95a2e772cebe0082c2ccbb075b682181e232c0b1ca8999d80b501","observation_id":"ef710abf-7490-4f43-9c2a-61978eb80f36","resolution":{"observed_at":"2026-07-02T12:46:57.096758Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Drivingworld: Constructing world model for autonomous driving via video gpt.arXiv preprint arXiv:2412.19505, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:6297bd1ed46f20763bcb4db486b37a7db01b038524307fc2accc9bcde6e19d36","observation_id":"68ca223f-0f8f-4af5-9abd-6e3415aa9a5d","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-13T01:26:27.220907Z","title":"Drivingworld: Constructing world model for autonomous driving via video gpt.arXiv preprint arXiv:2412.19505,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09655","last_updated":"2026-07-10T17:54:14Z","snapshot_observed_at":"2026-08-07T13:41:10.157141Z","submitted_at":"2026-07-10T17:54:14Z","title":"OpenLongTail: Generative Scaling of Long-Tail Driving Data","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T01:26:27.220907Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2607.09655"},"observation_digest":"sha256:59dc9cde81707f4f42fb9918533bf6d7ab2133aa625c3c81657aad14d58bcdb9","observation_id":"18800ef9-5faf-4b61-897d-cf4217d7db68","resolution":{"observed_at":"2026-07-13T01:26:27.220907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-02T02:55:46.103411Z","title":"DrivingWorld: Constructing world model for autonomous driving via video GPT.arXiv preprint arXiv:2412.19505,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14203","last_updated":"2026-07-15T17:50:23Z","snapshot_observed_at":"2026-08-06T22:12:22.885620Z","submitted_at":"2026-07-15T17:50:23Z","title":"Instant NuRec: Feed-Forward 3D Gaussian Reconstruction for Driving Scene Simulation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T02:55:46.103411Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2607.14203"},"observation_digest":"sha256:1e0676f37fdafc09e58e700c489edc88e2172d5600cb50407a6c06031b573c05","observation_id":"7d925026-4feb-4bd7-a003-b0f70351c1f7","resolution":{"observed_at":"2026-08-02T02:55:46.103411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-01T22:05:02.737118Z","title":"Drivingworld: Constructing world model for autonomous driving via video gpt","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15898","last_updated":"2026-07-17T12:12:33Z","snapshot_observed_at":"2026-08-07T12:07:45.750212Z","submitted_at":"2026-07-17T12:12:33Z","title":"Orbis 2: A Hierarchical World Model for Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T22:05:02.737118Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2607.15898"},"observation_digest":"sha256:44d0b3b02655016daf239f8a7e15870b20caf8954a6120b62ca709ffe410dec9","observation_id":"8bd34162-89f3-46e2-a849-b45a45eed1cb","resolution":{"observed_at":"2026-08-01T22:05:02.737118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-07T18:25:51.323654Z","title":"Hu, Y.; Yang, J.; Chen, L.; Li, K.; Sima, C.; Zhu, X.; Chai, S.;Du,S.;Lin,T.;Wang,W.;etal.2023b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06008","last_updated":"2026-08-06T13:13:07Z","snapshot_observed_at":"2026-08-09T05:12:59.519782Z","submitted_at":"2026-08-06T13:13:07Z","title":"Adaptive-WAM: Quality-Guided Early-Exit Planning from Intermediate Video-Diffusion Features","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T18:25:51.323654Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2608.06008"},"observation_digest":"sha256:af99a54d6e464de3a7762ea4c8580b1f092afb167a6f1ca89bb5308ba0c18de8","observation_id":"a95fcd14-a47f-445b-b5dc-410b0a3670d1","resolution":{"observed_at":"2026-08-07T18:25:51.323654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.19505/citation-record","integrity":"/paper/2412.19505/integrity","json":"/paper/2412.19505/citation-record.json","paper":"/paper/2412.19505"},"outbound":[],"paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T07:18:46.889539Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2412.19505."}