{"as_of":"2026-08-10T14:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e647558477b41fccc616084d0c8a8da05bcce28dfa132bd02b15e79267eafb51","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T08:49:50.059578Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20988/citation-record","integrity":"/paper/2607.20988/integrity","json":"/paper/2607.20988/citation-record.json","paper":"/paper/2607.20988"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:46.436457Z","title":"Ppu introduction","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:46.436457Z"},"links":{"citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:b4ea12f0479d192cc81feead469dc47acb0d9730244073258e8fa867dbcc8183","observation_id":"527b2b1b-1a3d-45b8-ada3-d2a399e57285","resolution":{"observed_at":"2026-08-01T08:49:46.436457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-01T08:49:47.208845Z","title":"Gaia-1: A generative world model for autonomous driving.arXiv preprint arXiv:2309.17080, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:47.208845Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:e784f4c94664b01fbec3d07724274bd2679f30c6f957f3107ebf7ec8a9b5f7cb","observation_id":"e210e35e-e839-4cdd-87f1-2b4f3c97f88a","resolution":{"observed_at":"2026-08-01T08:49:47.208845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10426","last_updated":"2026-05-13T08:01:33Z","snapshot_observed_at":"2026-07-06T23:22:23.287792Z","submitted_at":"2026-05-11T12:01:13Z","title":"CoWorld-VLA: Thinking in a Multi-Expert World Model for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10426","snapshot_observed_at":"2026-08-01T08:49:47.335919Z","title":"Planning-oriented autonomous driving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:47.335919Z"},"links":{"cited_paper":"/paper/2605.10426","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:b6c66d97d8fa99307ceab5fa7147dfb8af96e25b340e407d353b853a9a82a34f","observation_id":"199d8f8d-cf73-4203-a52c-12b3744e3552","resolution":{"observed_at":"2026-08-01T08:49:47.335919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13549","last_updated":"2023-11-22T17:44:29Z","snapshot_observed_at":"2026-07-06T16:51:15.252642Z","submitted_at":"2023-11-22T17:44:29Z","title":"ADriver-I: A General World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13549","snapshot_observed_at":"2026-08-01T08:49:47.615397Z","title":"Adriver-i: A general world model for autonomous driving.arXiv preprint arXiv:2311.13549,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:47.615397Z"},"links":{"cited_paper":"/paper/2311.13549","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:ddb42dce0157275435022c11ffc3142fcafa4d5c450667f79eae3c6a9513eaa6","observation_id":"7adb7f2a-b43d-4ebe-aec0-74657411b552","resolution":{"observed_at":"2026-08-01T08:49:47.615397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07608","last_updated":"2025-03-10T17:59:42Z","snapshot_observed_at":"2026-08-01T16:55:41.453922Z","submitted_at":"2025-03-10T17:59:42Z","title":"AlphaDrive: Unleashing the Power of VLMs in Autonomous Driving via Reinforcement Learning and Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07608","snapshot_observed_at":"2026-08-01T08:49:47.783298Z","title":"AlphaDrive: Unleashing the power of VLMs in autonomous driving via reinforcement learning and reasoning.arXiv preprint arXiv:2503.07608,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:47.783298Z"},"links":{"cited_paper":"/paper/2503.07608","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:e14c1a600b058061a9f0b31538d2675267e358cc3a3e947e4bc8a5d29f88ebd5","observation_id":"01999687-242a-4c40-9d0e-ebfef0c9b6b6","resolution":{"observed_at":"2026-08-01T08:49:47.783298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.12796","last_updated":"2025-12-18T07:25:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-14T17:59:47Z","title":"DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.12796","snapshot_observed_at":"2026-08-01T08:49:47.902688Z","title":"Hydra-mdp++: Advancing end-to-end driving via hydra-distillation with expert-guided decision analysis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:47.902688Z"},"links":{"cited_paper":"/paper/2510.12796","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:aeff51e05fd401f50eb1010df6b7864cf9451ed4039b85d1fdf767346d63238c","observation_id":"4e999d6c-2cf0-45f0-ad79-1083fb7bba44","resolution":{"observed_at":"2026-08-01T08:49:47.902688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-01T08:49:48.026207Z","title":"Flow matching for generative modeling.arXiv preprint arXiv:2210.02747,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:48.026207Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:fdc09e7eb42cc2a38dc34d93a23f3b22d628c339e1fe04661be69abff0d6c0a6","observation_id":"b084b62c-a93a-46d8-80f3-2954eb2eeb94","resolution":{"observed_at":"2026-08-01T08:49:48.026207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.18486","last_updated":"2026-05-08T18:23:17Z","snapshot_observed_at":"2026-08-03T04:20:45.612992Z","submitted_at":"2026-04-20T16:37:22Z","title":"Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.18486","snapshot_observed_at":"2026-08-01T08:49:48.309380Z","title":"Xiaomi onevl: One-step latent reasoning and planning with vision- language explanation.arXiv preprint arXiv:2604.18486, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:48.309380Z"},"links":{"cited_paper":"/paper/2604.18486","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:0b8d9d745ad92a58da552607ea9b749e0dc4b7d70363ca80d2994f561b350a5f","observation_id":"90980c78-0455-40f7-b57c-a88828014828","resolution":{"observed_at":"2026-08-01T08:49:48.309380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.02714","last_updated":"2026-06-29T00:47:01Z","snapshot_observed_at":"2026-07-13T13:47:04.485036Z","submitted_at":"2026-04-03T04:14:13Z","title":"ExploreVLA: Dense World Modeling and Exploration for End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.02714","snapshot_observed_at":"2026-08-01T08:49:48.429071Z","title":"Explorevla: Dense world modeling and exploration for end-to-end autonomous driving.arXiv preprint arXiv:2604.02714,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:48.429071Z"},"links":{"cited_paper":"/paper/2604.02714","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:ec3f02ef46ca2d0fee83bf9cc38d616a046f80ebb9d6461d53b7fa0731f3f08e","observation_id":"bf0f9fd0-9617-4dac-9523-82adb793480f","resolution":{"observed_at":"2026-08-01T08:49:48.429071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.10226","last_updated":"2026-04-14T00:44:42Z","snapshot_observed_at":"2026-08-02T07:00:45.391301Z","submitted_at":"2025-12-11T02:22:07Z","title":"Latent Chain-of-Thought World Modeling for End-to-End Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.10226","snapshot_observed_at":"2026-08-01T08:49:48.558259Z","title":"Latent chain-of-thought world modeling for end-to-end driving.arXiv preprint arXiv:2512.10226,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:48.558259Z"},"links":{"cited_paper":"/paper/2512.10226","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:b0d5d23a4355289a8651938fff3ed943907d55131dd79c9fd11e0225391c54a2","observation_id":"071bc17c-273b-4938-8d51-a4b17dbb3095","resolution":{"observed_at":"2026-08-01T08:49:48.558259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:48.668577Z","title":"The role of world models in shaping autonomous driving: A comprehensive survey.arXiv preprint arXiv:2502.10498,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:48.668577Z"},"links":{"citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:2cda2dd3bfbdcda0b6e89b09c84c61f522cbcc80a7def26c3a308e766cbb4ee3","observation_id":"e94ad116-43ba-4345-a60f-68f8681a30b3","resolution":{"observed_at":"2026-08-01T08:49:48.668577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:48.777466Z","title":"Latent-wam: Latent world action modeling for end-to-end autonomous driving.arXiv preprint arXiv:2603.24581,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:48.777466Z"},"links":{"citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:e83bdee185ecdf7d4f09532939e1cce718a60b3d8fcc08216ceb849113749068","observation_id":"34b55adb-201d-4a08-99b0-d260433773c7","resolution":{"observed_at":"2026-08-01T08:49:48.777466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:48.925835Z","title":"DriveMLM: Aligning multi-modal large language models with behavioral planning states for autonomous driving.arXiv preprint arXiv:2312.09245,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:48.925835Z"},"links":{"citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:2259a60089ce2cdfab7222df290e08bf1acd6e42133755e49af312ba62bdf811","observation_id":"e305866d-0e6f-487f-b382-fd21c26fbd9f","resolution":{"observed_at":"2026-08-01T08:49:48.925835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-01T08:49:49.102938Z","title":"Drivedreamer: Towards real-world-drive world models for autonomous driving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:49.102938Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:397a7439669d13bfb1c448dd6c79d3cd22e2dd58acc9320d076d1c1cad7d11d7","observation_id":"c91c9ba3-ef20-4c8e-a1e2-53fca3c3cfa6","resolution":{"observed_at":"2026-08-01T08:49:49.102938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17805","last_updated":"2024-12-23T18:58:24Z","snapshot_observed_at":"2026-08-03T08:27:34.091363Z","submitted_at":"2024-12-23T18:58:24Z","title":"Large Motion Video Autoencoding with Cross-modal Video VAE","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17805","snapshot_observed_at":"2026-08-01T08:49:49.239066Z","title":"Large motion video autoencoding with cross-modal video vae.arXiv preprint arXiv:2412.17805,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:49.239066Z"},"links":{"cited_paper":"/paper/2412.17805","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:d012deebed090a011550b5b9ca9ef334580d839ed23390421b6c9e144439b266","observation_id":"5819cbac-3864-4975-8c75-9336030f2c9f","resolution":{"observed_at":"2026-08-01T08:49:49.239066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:49.393759Z","title":"Resim: Reliable world simulation for autonomous driving.Advances in Neural Information Processing Systems, 38:167710–167741, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:49.393759Z"},"links":{"citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:99b06365bd44776d62c1e1873740bff8cbd4abbdf5111f8969a4496243dd823c","observation_id":"16267b38-b916-4faf-8bc4-952b1c0f802b","resolution":{"observed_at":"2026-08-01T08:49:49.393759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17685","last_updated":"2025-11-11T01:31:25Z","snapshot_observed_at":"2026-08-02T20:06:32.255780Z","submitted_at":"2025-05-23T09:55:32Z","title":"FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17685","snapshot_observed_at":"2026-08-01T08:49:49.521156Z","title":"Futuresightdrive: Thinking visually with spatio-temporal cot for autonomous driving.arXiv preprint arXiv:2505.17685,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:49.521156Z"},"links":{"cited_paper":"/paper/2505.17685","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:9a284e2f42932bc03b26acf60604f66753b30ae8e826ea277bd552813e71f82a","observation_id":"9eacb8fb-c161-495b-8995-bff457403a36","resolution":{"observed_at":"2026-08-01T08:49:49.521156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:49.657500Z","title":"Shuang Zeng, Xinyuan Chang, Mengwei Xie, Xinran Liu, Yifan Bai, Zheng Pan, Mu Xu, and Xing Wei","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:49.657500Z"},"links":{"citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:4e2bdcb7fa71bff7ac1105651c4d10d76fb9b0aa2755b11c05ecddb2201bb59e","observation_id":"50f56db1-2421-44a3-bfa8-0ca140526cd0","resolution":{"observed_at":"2026-08-01T08:49:49.657500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:49.763901Z","title":"Resworld: Tem- poral residual world model for end-to-end autonomous driving.arXiv preprint arXiv:2602.10884,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:49.763901Z"},"links":{"citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:5ddc7d2a26b87ea3dbe8cf6b48f11a368153ca59fbd1b67ac352db1cf9a74f57","observation_id":"7ed22ca5-ef81-4012-ac4b-ee7e91c1ecb7","resolution":{"observed_at":"2026-08-01T08:49:49.763901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09627","last_updated":"2024-12-12T18:59:59Z","snapshot_observed_at":"2026-08-05T03:34:06.291232Z","submitted_at":"2024-12-12T18:59:59Z","title":"Doe-1: Closed-Loop Autonomous Driving with Large World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09627","snapshot_observed_at":"2026-08-01T08:49:49.882619Z","title":"Doe-1: Closed- loop autonomous driving with large world model.arXiv preprint arXiv:2412.09627,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:49.882619Z"},"links":{"cited_paper":"/paper/2412.09627","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:67e9ce441fba7b6747986adf9b533cbd6029131d8fc8dba1da1f7721144f64d0","observation_id":"dd329218-274c-48e7-a7fe-63efbe1b1e5b","resolution":{"observed_at":"2026-08-01T08:49:49.882619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:50.059578Z","title":"Open- drivevla: Towards end-to-end autonomous driving with large vision language action model.arXiv preprint arXiv:2503.23463, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:50.059578Z"},"links":{"citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:7367649795029df8c35786265a2c07deeccc42963a3e7e2ea47ac5e29bd629d0","observation_id":"4284fe62-e282-40db-9421-97ac6a85ce86","resolution":{"observed_at":"2026-08-01T08:49:50.059578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:46.743096Z","title":"Pseudo-simulation for autonomous driving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:46.743096Z"},"links":{"citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:5e3cd86f11304477356bd25cb922aa9cbca37227c2ba0f9fefa1e55560cc7b23","observation_id":"5b80a77f-b2cd-48ba-ad34-7984a5b662ab","resolution":{"observed_at":"2026-08-01T08:49:46.743096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T08:49:48.149103Z","title":"Driveworld-vla: Unified latent-space world modeling with vision-language-action for autonomous driving.arXiv preprint arXiv:2602.06521,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:48.149103Z"},"links":{"citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:85ffc185232edcdf4c42c57ff107119cde9abde9019284bc711c18dde767da25","observation_id":"0f455f9b-bd56-4e93-b47c-568b50e86279","resolution":{"observed_at":"2026-08-01T08:49:48.149103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15349","last_updated":"2024-10-31T17:58:34Z","snapshot_observed_at":"2026-07-06T18:35:00.245966Z","submitted_at":"2024-06-21T17:59:02Z","title":"NAVSIM: Data-Driven Non-Reactive Autonomous Vehicle Simulation and Benchmarking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15349","snapshot_observed_at":"2026-08-01T08:49:46.880137Z","title":"Navsim: Data-driven non- reactive autonomous vehicle simulation and benchmarking.arXiv preprint arXiv:2406.15349,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:46.880137Z"},"links":{"cited_paper":"/paper/2406.15349","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:3159d33dc88675614515bddd36f099006c4f591482e30330b48ab92ea2eec688","observation_id":"f7c32a07-87ab-4ce4-a3e2-2278d4a76736","resolution":{"observed_at":"2026-08-01T08:49:46.880137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11810","last_updated":"2022-02-04T02:50:02Z","snapshot_observed_at":"2026-08-09T09:38:45.203903Z","submitted_at":"2021-06-22T14:24:55Z","title":"NuPlan: A closed-loop ML-based planning benchmark for autonomous vehicles","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11810","snapshot_observed_at":"2026-08-01T08:49:46.573313Z","title":"nuplan: A closed-loop ml-based planning benchmark for autonomous vehicles.arXiv preprint arXiv:2106.11810,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:46.573313Z"},"links":{"cited_paper":"/paper/2106.11810","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:8e18f7b0696579dc2d0f3fdd86f5b2331e0c5a6d96e3b4f9a80f9f706d690910","observation_id":"df31e6e9-5e6d-4cd9-866b-2455a81261a8","resolution":{"observed_at":"2026-08-01T08:49:46.573313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19755","last_updated":"2025-03-25T15:18:43Z","snapshot_observed_at":"2026-08-05T21:57:39.132989Z","submitted_at":"2025-03-25T15:18:43Z","title":"ORION: A Holistic End-to-End Autonomous Driving Framework by Vision-Language Instructed Action Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19755","snapshot_observed_at":"2026-08-01T08:49:47.035253Z","title":"Orion: A holistic end-to-end au- tonomous driving framework by vision-language instructed action generation.arXiv preprint arXiv:2503.19755,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:47.035253Z"},"links":{"cited_paper":"/paper/2503.19755","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:9c08b3dbca3335182305071e0178e35ac5e64a51593c3325368cbc7966ea8bbf","observation_id":"079b8758-c960-45f7-8fb1-e1c89b2d0bf6","resolution":{"observed_at":"2026-08-01T08:49:47.035253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23262","last_updated":"2025-09-23T04:19:59Z","snapshot_observed_at":"2026-08-05T06:31:46.069300Z","submitted_at":"2024-10-30T17:46:31Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23262","snapshot_observed_at":"2026-08-01T08:49:47.488543Z","title":"EMMA: End-to-end multimodal model for autonomous driving.arXiv preprint arXiv:2410.23262,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T08:49:47.488543Z"},"links":{"cited_paper":"/paper/2410.23262","citing_paper":"/paper/2607.20988"},"observation_digest":"sha256:d5deb919f9dcf7e3358da9725c44c791d36f67005e9277f00194af9a58b1d8ef","observation_id":"72db3736-993c-4107-8963-e4ea4fdb0f91","resolution":{"observed_at":"2026-08-01T08:49:47.488543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20988","last_updated":"2026-07-23T07:11:41Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T16:29:13.350727Z","submitted_at":"2026-07-23T07:11:41Z","title":"HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2607.20988."}