{"as_of":"2026-08-09T16:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc5b2ca2bf5c9d5f65fd12c0addeb12ef1a95131627a7134515e32ea86888c90","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:19:32.259571Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T08:57:19.282237Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T07:41:15.133064Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-08-04T08:57:19.282237Z","title":"World4drive: End-to-end au- tonomous driving via intention-aware physical latent world model.arXiv preprint arXiv:2507.00603, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.18313","last_updated":"2026-06-29T02:20:45Z","snapshot_observed_at":"2026-08-06T20:20:34.094359Z","submitted_at":"2025-10-21T05:49:01Z","title":"OmniNWM: Omniscient Driving Navigation World Models","version":6},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:19.282237Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2510.18313"},"observation_digest":"sha256:a81a71b8cf9db3b112e8550e28d92b2cf4df3b30390433187db262f9609420ef","observation_id":"1bad7dc3-c9fd-4f6f-95c5-e457e6acf8c8","resolution":{"observed_at":"2026-08-04T08:57:19.282237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":"2507.00603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"World4drive: End-to-end autonomous driving via intention-aware physical latent world model.ArXiv, abs/2507.00603","venue":null,"work_id":"0560de60-63b0-402a-8674-64c8f388bded","year":2025},"citing_paper":{"arxiv_id":"2604.18564","last_updated":"2026-04-21T06:41:18Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T17:52:15Z","title":"MultiWorld: Scalable Multi-Agent Multi-View Video World Models","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-10T05:06:11.514186Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2604.18564"},"observation_digest":"sha256:973dac6673feca7123f1b3ff5c3eec95df13b18fb2372e418154b97caafd54e1","observation_id":"d74bd310-6264-4902-b8a1-542f03462abe","resolution":{"observed_at":"2026-05-10T10:09:08.267982Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":"2507.00603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"World4drive: End-to-end autonomous driving via intention-aware physical latent world model.ArXiv, abs/2507.00603","venue":null,"work_id":"0560de60-63b0-402a-8674-64c8f388bded","year":2025},"citing_paper":{"arxiv_id":"2605.19631","last_updated":"2026-05-19T10:12:01Z","snapshot_observed_at":"2026-08-07T15:23:28.953160Z","submitted_at":"2026-05-19T10:12:01Z","title":"HEAT: Heterogeneous End-to-End Autonomous Driving via Trajectory-Guided World Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T04:53:31.033435Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2605.19631"},"observation_digest":"sha256:6c0f10ee3c80c416c7835a16a7f7ad2e427c1b0be720672f3f981e41a8074c5c","observation_id":"fb12a3b3-edb1-4212-b1f5-8d1ba74e5a4e","resolution":{"observed_at":"2026-05-20T04:58:05.378019Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":"2507.00603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"World4drive: End-to-end autonomous driving via intention-aware physical latent world model.ArXiv, abs/2507.00603","venue":null,"work_id":"0560de60-63b0-402a-8674-64c8f388bded","year":2025},"citing_paper":{"arxiv_id":"2605.22089","last_updated":"2026-05-21T07:31:49Z","snapshot_observed_at":"2026-07-06T23:32:30.578213Z","submitted_at":"2026-05-21T07:31:49Z","title":"LVDrive: Latent Visual Representation Enhanced Vision-Language-Action Autonomous Driving Model","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-22T07:37:11.292270Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2605.22089"},"observation_digest":"sha256:440ecc15f432ddfc323f33181e9bc204c34e24c3904197c777369594a249a81f","observation_id":"fbd15da8-b747-470f-ab19-c2770d77a4d6","resolution":{"observed_at":"2026-05-22T07:41:15.136172Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":"2507.00603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"World4drive: End-to-end autonomous driving via intention-aware physical latent world model.ArXiv, abs/2507.00603","venue":null,"work_id":"0560de60-63b0-402a-8674-64c8f388bded","year":2025},"citing_paper":{"arxiv_id":"2605.22456","last_updated":"2026-05-21T13:20:51Z","snapshot_observed_at":"2026-08-01T15:43:56.465078Z","submitted_at":"2026-05-21T13:20:51Z","title":"Steins;Gate Drive: Semantic Safety Arbitration over Structured Futures for Latency-Decoupled LLM Planning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T05:39:56.299842Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2605.22456"},"observation_digest":"sha256:13d77a66989ada490ec6838d2b69b05d981a8609c66138b90be5f6ea5f62263a","observation_id":"dafd4fd8-97c0-458b-bb51-2e0855007bc7","resolution":{"observed_at":"2026-05-22T05:41:08.304980Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-08-02T05:26:07.155612Z","title":"World4drive: End-to-endautonomousdrivingviaintention-awarephysical latent world model.arXiv preprint arXiv:2507.00603, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16314","last_updated":"2026-07-15T00:58:45Z","snapshot_observed_at":"2026-08-07T02:32:13.619549Z","submitted_at":"2026-07-15T00:58:45Z","title":"Depth-Regularized JEPA World Models Learn More Transferable Representations from Real Outdoor Robot Data","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T05:26:07.155612Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2607.16314"},"observation_digest":"sha256:dda5150a16164f2d0d4595cedafe1f35c5f8c18dd60916e1e8d956869bc1907b","observation_id":"494a20fd-e69d-45db-9f83-7cc66dacf5fa","resolution":{"observed_at":"2026-08-02T05:26:07.155612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.00603/citation-record","integrity":"/paper/2507.00603/integrity","json":"/paper/2507.00603/citation-record.json","paper":"/paper/2507.00603"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.15672","last_updated":"2025-02-21T18:56:02Z","snapshot_observed_at":"2026-08-07T17:57:44.152083Z","submitted_at":"2025-02-21T18:56:02Z","title":"VaViM and VaVAM: Autonomous Driving through Video Generative Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15672","snapshot_observed_at":"2026-08-06T21:19:28.485169Z","title":"Vavim and vavam: Autonomous driving through video gen- erative modeling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.485169Z"},"links":{"cited_paper":"/paper/2502.15672","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:33eee160214726d4259cb55ab572703d2f50857b2a23d6cb4e62a7c3ac6b94f8","observation_id":"eaa5fb24-5ed8-48a9-bf5f-1e51a0fa7e99","resolution":{"observed_at":"2026-08-06T21:19:28.485169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:37.400759Z","title":"nuscenes: A multi- modal dataset for autonomous driving","venue":null,"work_id":"e895d99a-1d34-4eab-b524-2bd3d4d74467","year":2020},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.552086Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:4597f89e339269d7f7b22ec36833a5273a154060dcda28857a3726a3b50c36aa","observation_id":"74ee6551-9412-4f04-9125-82fb894a30ac","resolution":{"observed_at":"2026-08-06T21:19:37.456134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13243","last_updated":"2026-04-17T23:12:55Z","snapshot_observed_at":"2026-08-04T01:21:26.466156Z","submitted_at":"2024-02-20T18:55:09Z","title":"VADv2: End-to-End Vectorized Autonomous Driving via Probabilistic Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13243","snapshot_observed_at":"2026-08-06T21:19:28.630401Z","title":"Vadv2: End-to-end vectorized autonomous driving via probabilistic planning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.630401Z"},"links":{"cited_paper":"/paper/2402.13243","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:424561c2020ed0d4eb35bf48a0fb6a9c97e0ced0707d1611e32e8fd49bff6c12","observation_id":"68783d80-a1f9-4d0a-9f13-411aabfcee6a","resolution":{"observed_at":"2026-08-06T21:19:28.630401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:37.287326Z","title":"Ppad: Iterative interactions of prediction and planning for end-to-end autonomous driving","venue":null,"work_id":"e27ad75e-61f4-40c1-a000-62b5b4ef6b25","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.710796Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:778c438605de18cc2913c3a57c321ee3d1656a78448ebdb0a3f617e0c3d96f63","observation_id":"8bcc522b-9329-4391-82ab-5c63a4a46ec4","resolution":{"observed_at":"2026-08-06T21:19:37.331104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:37.185453Z","title":"Openscene: The largest up-to- date 3d occupancy prediction benchmark in autonomous driving","venue":null,"work_id":"f94d740d-6c1f-45a6-8816-5228030e5b19","year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.754600Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:e7ea05b53b2e708632808c3e5d46efef134340452163fc0ad3b4b5cb626cfa2b","observation_id":"264d854e-769e-4216-b3f1-451208352558","resolution":{"observed_at":"2026-08-06T21:19:37.231874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17398","last_updated":"2024-10-28T05:53:17Z","snapshot_observed_at":"2026-08-07T02:31:28.236732Z","submitted_at":"2024-05-27T17:49:15Z","title":"Vista: A Generalizable Driving World Model with High Fidelity and Versatile Controllability","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17398","snapshot_observed_at":"2026-08-06T21:19:28.847600Z","title":"Vista: A generalizable driving world model with high fidelity and versatile controllability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.847600Z"},"links":{"cited_paper":"/paper/2405.17398","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:581f4b54c7205a6fd40b84e76071ffef5d370948ddaeac73e06b5807c6472a33","observation_id":"7a7430b1-a84f-4c71-8a4d-8924bde0988b","resolution":{"observed_at":"2026-08-06T21:19:28.847600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10429","last_updated":"2024-10-14T12:24:32Z","snapshot_observed_at":"2026-08-07T21:31:53.134914Z","submitted_at":"2024-10-14T12:24:32Z","title":"DOME: Taming Diffusion Model into High-Fidelity Controllable Occupancy World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10429","snapshot_observed_at":"2026-08-06T21:19:28.914725Z","title":"Dome: Tam- ing diffusion model into high-fidelity controllable occupancy world model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.914725Z"},"links":{"cited_paper":"/paper/2410.10429","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:51972b37713c736a650ab2fc6d87d8373f423154aca5c4a9d19670109f66ec15","observation_id":"7e9a3492-fd7b-4a7f-a38c-7bb133eceb70","resolution":{"observed_at":"2026-08-06T21:19:28.914725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:37.048740Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"46510e42-ec2b-4c10-a4a3-69987eccf53c","year":2016},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.000610Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:9aaf6b22d569fdae6d3e54329cd89ecc5d10ea12b9e4cdc50a2e2c8e7875aca7","observation_id":"fb96ad21-bb1c-4452-899e-43f308da5477","resolution":{"observed_at":"2026-08-06T21:19:37.123963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.948063Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"313e41d5-1dd1-484f-b834-9e15cc15d594","year":2020},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.088121Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:b06392135b6bb8f12f4b6c2eb2c648682df0ca1f96336a69a3464d1e1da10500","observation_id":"fcf4db1d-31d4-4616-a7ea-7b0ebf66ea57","resolution":{"observed_at":"2026-08-06T21:19:36.992525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-06T21:19:29.168385Z","title":"Gaia-1: A generative world model for au- tonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.168385Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:ac2e45063f926bcc4e55aa13874f84880b51b9c3290235ee93cc450b66edb3fd","observation_id":"13c980ee-1142-4a85-abbf-f07843dea237","resolution":{"observed_at":"2026-08-06T21:19:29.168385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.821958Z","title":"Metric3d v2: A versatile monocular geomet- ric foundation model for zero-shot metric depth and surface normal estimation","venue":null,"work_id":"ee059a57-81c0-471e-906e-438790ef279e","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.243697Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:a4d7f4a85b952a7ffd5adbd85128dddaccb06deb874c8142daad9dab362ab05d","observation_id":"17d354fa-5b82-4c15-a252-bd55ba34b179","resolution":{"observed_at":"2026-08-06T21:19:36.869266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.723671Z","title":"St-p3: End-to-end vision-based au- tonomous driving via spatial-temporal feature learning","venue":null,"work_id":"604a706f-c3a4-4ae6-b44d-4c2a5b3f70e8","year":2022},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.321885Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:c91ea8fd517a64494a4628ed4a078e3131b846f30a6da9b05b80b932b85a8b48","observation_id":"664e0aa8-7228-4829-b6fb-0fe5b637c82e","resolution":{"observed_at":"2026-08-06T21:19:36.765702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.611914Z","title":"Planning-oriented autonomous driving","venue":null,"work_id":"3a5f7539-49c9-490d-9756-13629a95c4d3","year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.401745Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:1bda5ccbd4e552bb27f0de1d3d8604b411b18e37664dc5f7961513e792c3a6ba","observation_id":"bd7bcb25-a4ab-475a-bef3-822833a5900c","resolution":{"observed_at":"2026-08-06T21:19:36.653677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15349","last_updated":"2024-10-31T17:58:34Z","snapshot_observed_at":"2026-07-06T18:35:00.245966Z","submitted_at":"2024-06-21T17:59:02Z","title":"NAVSIM: Data-Driven Non-Reactive Autonomous Vehicle Simulation and Benchmarking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15349","snapshot_observed_at":"2026-08-06T21:19:29.501478Z","title":"Navsim: Data-driven non-reactive autonomous vehicle simulation and benchmarking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.501478Z"},"links":{"cited_paper":"/paper/2406.15349","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:0d7c6ac2c7b59c4fe9c94ced11cf24f9328222f3a39627546b2d2e1532a14e84","observation_id":"fcd41b05-1cd8-4c5d-a182-1e32e33d1bca","resolution":{"observed_at":"2026-08-06T21:19:29.501478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.453562Z","title":"Drivetransformer: Unified transformer for scalable end-to- end autonomous driving","venue":null,"work_id":"433e22bf-0be4-40e0-91c2-10f3ece76988","year":2025},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.592046Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:c4d7c03822780051023102dfe41375d89b6dc4c1c73d979eec2ec4f1dbb79510","observation_id":"d1501d27-c461-4b6e-8f4a-91a4d422fcbb","resolution":{"observed_at":"2026-08-06T21:19:36.528619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.310625Z","title":"Vad: Vectorized scene representation for efficient autonomous driving","venue":null,"work_id":"357f4a0f-c6ef-4b7e-b9df-b38f7ae64e30","year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.666510Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:ad77173f6898510a565751f7baf0848296b8a0fb70a6cb7564185c0ec951a621","observation_id":"49874fa3-e297-4d87-a191-1ce7a4f12f29","resolution":{"observed_at":"2026-08-06T21:19:36.373483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.171945Z","title":"Tod3cap: Towards 3d dense captioning in out- door scenes","venue":null,"work_id":"c8357808-6f26-4548-bc96-c6966c50e4e5","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.751803Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:82e1dcbdd5412805c22fa0d88bdac647f2acc1fff325f45f5e0d900aa71ee8a2","observation_id":"cb38460e-e258-448e-aa38-ae591708b525","resolution":{"observed_at":"2026-08-06T21:19:36.242987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.995062Z","title":"Enhancing end-to-end au- tonomous driving with latent world model","venue":null,"work_id":"69b09181-da4c-4e45-9fa6-cc613f8016c7","year":2025},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.861107Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:9d8967e24a6dae0fb2de4195ce97a13b9b5a1263b5032507a8e449f6ebaa88af","observation_id":"c3023140-b71c-4257-9cf9-609842e5a61d","resolution":{"observed_at":"2026-08-06T21:19:36.092425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06978","last_updated":"2024-08-30T03:37:36Z","snapshot_observed_at":"2026-07-06T18:28:42.314877Z","submitted_at":"2024-06-11T06:18:26Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06978","snapshot_observed_at":"2026-08-06T21:19:29.947637Z","title":"Hydra-mdp: End-to-end multimodal planning with multi- target hydra-distillation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.947637Z"},"links":{"cited_paper":"/paper/2406.06978","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:4eac6f3b5f7e7fcc9011cfc9e348a7f3fb5b4911753316019d779b07b428da2f","observation_id":"28b2a234-28c4-4704-8599-082f118ebb27","resolution":{"observed_at":"2026-08-06T21:19:29.947637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.849218Z","title":"Bevformer: learning bird’s-eye-view representation from lidar-camera via spatiotemporal transformers","venue":null,"work_id":"2a729a5c-e35f-40dc-b0c0-3d9ca0ae1254","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.030580Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:9258b0abbb6d65dcf0d3412e871b6faff35e522698376dd43a6294c53bb4ffc8","observation_id":"990e4bee-8798-4ad1-8b09-0c60b67f1f1b","resolution":{"observed_at":"2026-08-06T21:19:35.912066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.698733Z","title":"Is ego status all you need for open- loop end-to-end autonomous driving? In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, 2024","venue":null,"work_id":"733545ae-9ef5-4f57-add4-02acd190a69f","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.091560Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:244ab9c29c71781a5e8045c79ce2b310ac9c5c726c40bad77e2ff6295dda4b3e","observation_id":"ac2e1a1c-f24f-4da5-92ad-730aa7f7acc7","resolution":{"observed_at":"2026-08-06T21:19:35.779898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.14437","last_updated":"2023-01-30T02:39:49Z","snapshot_observed_at":"2026-07-06T13:47:00.653824Z","submitted_at":"2022-08-30T17:55:59Z","title":"MapTR: Structured Modeling and Learning for Online Vectorized HD Map Construction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.14437","snapshot_observed_at":"2026-08-06T21:19:30.149583Z","title":"Maptr: Structured modeling and learning for online vectorized hd map construction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.149583Z"},"links":{"cited_paper":"/paper/2208.14437","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:9566271e10afe169adadde765b9e95f71473b8b53e14b7c1930951469a39e470","observation_id":"d236a067-cfa1-41e8-99d6-0ce07717d53d","resolution":{"observed_at":"2026-08-06T21:19:30.149583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.559663Z","title":"Diffusiondrive: Trun- cated diffusion model for end-to-end autonomous driving","venue":null,"work_id":"e0bf1e14-a8a5-4710-9b0b-6222d1b74008","year":2025},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.208857Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:baf1dfa4c5ef7e82c73a3e7d5b4405d4566d349f4cf3e3a7c008838a849b890f","observation_id":"ca8ec8b8-6327-477e-b9f0-9745141ef45d","resolution":{"observed_at":"2026-08-06T21:19:35.650618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T21:19:30.259711Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.259711Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:041875a196218003dba7480e30429a1ec647ebf2b0b803e9e580426a21820a69","observation_id":"76534d3f-2bfd-4c15-b5aa-f7dac4250ec9","resolution":{"observed_at":"2026-08-06T21:19:30.259711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.422894Z","title":"Petr: Position embedding transformation for multi-view 3d object detection","venue":null,"work_id":"65caea87-061d-4a33-82f2-a3d3a6171228","year":2022},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.332034Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:4c76fe36a4470c72461d827457f85173b347345ef3cbc76725321f173da7c6fd","observation_id":"d195bb2a-8347-4b10-8281-9ed835417b9e","resolution":{"observed_at":"2026-08-06T21:19:35.492270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.262949Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"c31e4695-7f76-494c-9b27-8628bf25abb4","year":2021},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.421159Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:a845e8c1ed21324df1d1b5647880f0353f804c58e830c4ce9d6cd8a7efd508a9","observation_id":"2a5cb714-f320-4f94-98ba-e79b06a9255b","resolution":{"observed_at":"2026-08-06T21:19:35.355100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.113252Z","title":"Lingoqa: Visual question answering for autonomous driv- ing","venue":null,"work_id":"122f9f8b-b8e2-44c8-bf6b-858be70d3a31","year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.505212Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:77a7148491c20fed7d4db275e55ddeb5bbe540a12c47f48bac4b9b05e799b871","observation_id":"9b909651-8fea-40b4-ae17-ce48b2ae8421","resolution":{"observed_at":"2026-08-06T21:19:35.203112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.941036Z","title":"Driveworld: 4d pre-trained scene understanding via world models for autonomous driving","venue":null,"work_id":"6ffbc5e1-590d-4ae1-b4de-bf4eef1a9bbd","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.573785Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:27d08404ac1e9153a3eedb3e88c64146a2ffab1143a58c6107d386387753d7ed","observation_id":"7e8df97c-4e79-49fd-904d-cf8a60102460","resolution":{"observed_at":"2026-08-06T21:19:35.023310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.775292Z","title":"Vlp: Vision language planning for autonomous driving","venue":null,"work_id":"6f583cd5-4485-4a65-a968-3a41635e3e92","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.643565Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:51d65b19fec86f506751797c2b31a8316b9902aa3cb63702c60cf8f6d8e3ec3d","observation_id":"df0e6bfc-023b-4598-b321-e56357d95d2a","resolution":{"observed_at":"2026-08-06T21:19:34.859327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.632135Z","title":"Multi-modal fusion transformer for end-to-end autonomous driving","venue":null,"work_id":"26c012c5-9172-488c-9eaf-c687501717e1","year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.689533Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:00d1d2aadaaa59cb6a2f57d7e9c72dd41114a8d5944b393219b928650d5c0f32","observation_id":"47f24059-ce9a-4017-9994-a50d4b2fba34","resolution":{"observed_at":"2026-08-06T21:19:34.702738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-06T21:19:30.752490Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.752490Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:92cf306d481464c751d7fc73cd21f4bebe70f82c63968d2b8c1c90b38462fd74","observation_id":"c1f00341-6da6-49fc-83aa-d770a8d92902","resolution":{"observed_at":"2026-08-06T21:19:30.752490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.425726Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":"bd36e482-2d93-44a4-acbd-b996c43fc7a5","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.825740Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:1ed4b1de60b20bd6ac73c1bf3ca86003e25fbdb7345076c61ad49304a75d79ab","observation_id":"fd73dddc-0de6-49e2-bb4a-e2d7d8e3b70a","resolution":{"observed_at":"2026-08-06T21:19:34.505505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19620","last_updated":"2024-05-31T07:40:55Z","snapshot_observed_at":"2026-07-06T18:22:22.643181Z","submitted_at":"2024-05-30T02:13:56Z","title":"SparseDrive: End-to-End Autonomous Driving via Sparse Scene Representation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19620","snapshot_observed_at":"2026-08-06T21:19:30.874272Z","title":"Sparsedrive: End-to-end au- tonomous driving via sparse scene representation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.874272Z"},"links":{"cited_paper":"/paper/2405.19620","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:cea84378f617c1a7c8e3360ec4502e01bba47c1b71b3ba5f9ee1e7dae9b5cffe","observation_id":"26ddc1ba-a5d9-43ea-9be1-873a8c795287","resolution":{"observed_at":"2026-08-06T21:19:30.874272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00959","last_updated":"2024-07-01T04:34:50Z","snapshot_observed_at":"2026-07-06T18:39:20.664293Z","submitted_at":"2024-07-01T04:34:50Z","title":"Tokenize the World into Object-level Knowledge to Address Long-tail Events in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00959","snapshot_observed_at":"2026-08-06T21:19:30.946025Z","title":"Tokenize the world into object-level knowledge to address long-tail events in autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.946025Z"},"links":{"cited_paper":"/paper/2407.00959","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:24cf8fd81053810d7fc2ae22ec4c637be10df0e21d319aa1d7822f3d390c702c","observation_id":"b3e99cc9-d179-489f-bba1-2a693627bbfe","resolution":{"observed_at":"2026-08-06T21:19:30.946025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12289","last_updated":"2024-06-25T17:55:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-19T17:04:04Z","title":"DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12289","snapshot_observed_at":"2026-08-06T21:19:31.032780Z","title":"Drivevlm: The convergence of autonomous driving and large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.032780Z"},"links":{"cited_paper":"/paper/2402.12289","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:f5f592a823c13e62022530f253ede26443803403c126deaf02ea0e66ffa09475","observation_id":"711c9425-4f87-455c-ac2f-31d5525982a5","resolution":{"observed_at":"2026-08-06T21:19:31.032780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.246559Z","title":"Scene as occupancy","venue":null,"work_id":"09967d44-355c-4aab-8785-0cb36045c64a","year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.106173Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:ebea20b4e42ba29c16ccd493ba96cb5a8518579afa3bbe526904b1e4ee98e38f","observation_id":"97a3dfbb-e648-41b4-8c9b-f6b0057bca99","resolution":{"observed_at":"2026-08-06T21:19:34.352992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.080286Z","title":"Drivedreamer: Towards real-world- drive world models for autonomous driving","venue":null,"work_id":"5d5cabe6-1047-4e93-9753-eba2641b9f0d","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.211308Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:5e796d3285bbc3e0ff771362b25ec0824ff4e9d43b52ff6e1db6c357dfde87c3","observation_id":"f165220a-96a0-4b45-9591-19ba24858a8a","resolution":{"observed_at":"2026-08-06T21:19:34.177795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:33.915484Z","title":"Driving into the future: Multiview visual forecasting and planning with world model for au- tonomous driving","venue":null,"work_id":"2d2fe262-a893-456b-9bad-374fec5d901b","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.321359Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:74c989335968cf88bb88bdce2d3d7105416043721e11337b8ecf8a94b4d2886a","observation_id":"dc92a3fb-997c-48d5-ad4b-6b52b408ed8b","resolution":{"observed_at":"2026-08-06T21:19:34.013476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:33.764359Z","title":"Para-drive: Parallelized architecture for real- time autonomous driving","venue":null,"work_id":"5149f068-dc99-46ff-b1a2-3f51fbd75f7e","year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.420041Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:d62d3b01a6db696240ff5960eaa0e2d188fa86ad96525be981f5a36e840ddc60","observation_id":"34f69d0e-47f3-4ba7-8bea-ae6d279c1fad","resolution":{"observed_at":"2026-08-06T21:19:33.851837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:33.578444Z","title":"Goalflow: Goal- driven flow matching for multimodal trajectories generation in end-to-end autonomous driving","venue":null,"work_id":"ebe4de76-83ae-4b64-87b9-f63fff8a0c80","year":2025},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.480525Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:855fead7dc5e2041220cc67cef56cf5b66bc4dcd1893607e87d22fbd590295ad","observation_id":"2d06c762-09a1-422d-ad14-62bd66fe4f96","resolution":{"observed_at":"2026-08-06T21:19:33.665806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:33.340197Z","title":"Bevformer v2: Adapting modern image backbones to bird’s-eye-view recognition via perspective su- pervision","venue":null,"work_id":"63e9ee21-bc44-4a5c-907a-95b226140e96","year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.565136Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:448e0d103feba0fe53cd6a09a32d38b7035a46d275fcc293fbe96f41530bb8b8","observation_id":"35669cf3-2d43-4330-841d-1f6e76883f22","resolution":{"observed_at":"2026-08-06T21:19:33.433842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.12826","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:32.474905Z","title":"Uncad: Towards safe end-to-end au- tonomous driving via online map uncertainty","venue":null,"work_id":"23f04f33-1ce8-4042-bd98-0567641ec6ae","year":2025},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.678697Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:274fbb8a9d6b0889c4f39bbe726a1cf1f3288ed0fe5cd41c2875515bb60a6b6e","observation_id":"2a31b648-c68f-4137-baae-effdc302a7f1","resolution":{"observed_at":"2026-08-06T21:19:32.558442Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:33.187360Z","title":"Metric3d: Towards zero-shot metric 3d prediction from a single image","venue":null,"work_id":"83c7865f-a954-4dcf-8df0-9ea7963548ea","year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.740030Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:1052f46579b1a687980ba21808d16347b98b2e7ab3534779417703b722aca4c6","observation_id":"d1bdf9e9-930a-47f3-91ea-ebb57e5ca801","resolution":{"observed_at":"2026-08-06T21:19:33.252720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:33.017049Z","title":"Copilot4d: Learning unsupervised world models for autonomous driving via discrete diffusion","venue":null,"work_id":"cbefc48c-2aee-46d6-beac-589c01572c29","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.871893Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:c4c4a9f9126d41b87ad7ef2eab3497af3e18035413c6dd6faa6674a762875048","observation_id":"f07abe13-4478-45da-bd94-694769daa85e","resolution":{"observed_at":"2026-08-06T21:19:33.108275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06845","last_updated":"2024-04-11T04:17:13Z","snapshot_observed_at":"2026-08-06T17:41:27.486645Z","submitted_at":"2024-03-11T16:03:35Z","title":"DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06845","snapshot_observed_at":"2026-08-06T21:19:31.953866Z","title":"Drivedreamer-2: Llm-enhanced world models for diverse driving video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.953866Z"},"links":{"cited_paper":"/paper/2403.06845","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:ddadef0b1e94139e2569635eb14bf25055c3a3b8ab19150e08e1cf2389ba47ce","observation_id":"36b5becb-0b33-49fc-acc1-b7f78f4ee496","resolution":{"observed_at":"2026-08-06T21:19:31.953866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:32.897912Z","title":"Occworld: Learning a 3d occupancy world model for autonomous driving","venue":null,"work_id":"f0fabca9-6bac-497f-9037-bb700eeade69","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:32.111585Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:bc9a2615002b7d9fd88d893f312f0f2b34e55abab7c106beeba6f4f4af31e0fb","observation_id":"dd9c9df6-5671-45f1-9011-fa11786930dd","resolution":{"observed_at":"2026-08-06T21:19:32.961648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:32.754664Z","title":"Genad: Generative end-to-end au- tonomous driving","venue":null,"work_id":"f434f828-d4e8-46df-b403-61f7a4441099","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:32.182946Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:ff94af10df417c55a511f567ff9c3b6f7e53be13e21cef08612c543f1be314d2","observation_id":"fa9dc8c2-17e4-4a8c-b72b-526e02cc11bf","resolution":{"observed_at":"2026-08-06T21:19:32.824617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:32.259571Z","title":"Preliminary investigation into data scaling laws for imitation learning-based end-to-end autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:32.259571Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:0750aaad50ed620d8168af9158826c2ce53fb85353b82b83bee91124e70013d3","observation_id":"7f4e1ff1-c050-4b85-b4dd-8e7de229baa0","resolution":{"observed_at":"2026-08-06T21:19:32.259571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":32},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 6 inbound Pith citation observations for arXiv:2507.00603."}