{"as_of":"2026-08-12T21:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e05d501596945ae4aac252f6de6c434234c1467fb74fdbc2e6daaaf19d3ff641","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T06:07:10.575230Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.10719/citation-record","integrity":"/paper/2602.10719/integrity","json":"/paper/2602.10719/citation-record.json","paper":"/paper/2602.10719"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.18361","last_updated":"2024-05-28T16:57:44Z","snapshot_observed_at":"2026-07-06T18:21:26.195207Z","submitted_at":"2024-05-28T16:57:44Z","title":"Is a 3D-Tokenized LLM the Key to Reliable Autonomous Driving?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18361","snapshot_observed_at":"2026-08-04T06:07:07.593375Z","title":"Is a 3d-tokenized llm the key to reliable autonomous driving?arXiv preprint arXiv:2405.18361,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:07.593375Z"},"links":{"cited_paper":"/paper/2405.18361","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:a2d1a29d95aaf9d372e040c4fd05f19999f25b950ae9b5b855a64339caf61242","observation_id":"43feb6cd-7ddf-42f2-babb-c72b2997c47a","resolution":{"observed_at":"2026-08-04T06:07:07.593375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15111","last_updated":"2025-05-21T05:05:38Z","snapshot_observed_at":"2026-08-07T15:21:35.395398Z","submitted_at":"2025-05-21T05:05:38Z","title":"iPad: Iterative Proposal-centric End-to-End Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15111","snapshot_observed_at":"2026-08-04T06:07:08.238644Z","title":"ipad: Iterative proposal-centric end-to-end autonomous driving.arXiv preprint arXiv:2505.15111,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:08.238644Z"},"links":{"cited_paper":"/paper/2505.15111","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:7e5dedeec40f29130a943d1d1d1ac53d1d5ed48874376ff4200f86d92577c4b0","observation_id":"6adc54cf-6f3f-4c74-8727-90923c910f12","resolution":{"observed_at":"2026-08-04T06:07:08.238644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23262","last_updated":"2025-09-23T04:19:59Z","snapshot_observed_at":"2026-08-05T06:31:46.069300Z","submitted_at":"2024-10-30T17:46:31Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23262","snapshot_observed_at":"2026-08-04T06:07:08.383889Z","title":"Emma: End-to-end multimodal model for autonomous driving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:08.383889Z"},"links":{"cited_paper":"/paper/2410.23262","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:a1fd1ddb36ad0254ad12a69259a4165fc8ea522e91f6a2f5d4a612eaa62ef311","observation_id":"59cf92a5-7e6e-4af5-959e-72f8d2a590b3","resolution":{"observed_at":"2026-08-04T06:07:08.383889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22313","last_updated":"2024-10-29T17:53:56Z","snapshot_observed_at":"2026-07-31T01:16:26.372370Z","submitted_at":"2024-10-29T17:53:56Z","title":"Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22313","snapshot_observed_at":"2026-08-04T06:07:08.496067Z","title":"Senna: Bridging large vision-language models and end-to-end autonomous driving.arXiv preprint arXiv:2410.22313,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:08.496067Z"},"links":{"cited_paper":"/paper/2410.22313","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:fa8f45714b7aa443f52afe29fcdce8170374bc9f3c0fedc1eb7697e83cadf073","observation_id":"5972ab4a-f7d4-49ba-ba11-0f6a6ddb0b40","resolution":{"observed_at":"2026-08-04T06:07:08.496067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:07:08.603921Z","title":"Driving on registers.arXiv preprint arXiv:2601.05083,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:08.603921Z"},"links":{"citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:c7f9fc0eaf19001b70fe8d8c310e5a8e4eb8ddf547d4db775a634812fba785db","observation_id":"905b0922-fe69-4b3a-9d06-0aebd8182a00","resolution":{"observed_at":"2026-08-04T06:07:08.603921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15139","last_updated":"2025-04-10T08:48:37Z","snapshot_observed_at":"2026-08-12T14:25:05.594791Z","submitted_at":"2024-11-22T18:59:47Z","title":"DiffusionDrive: Truncated Diffusion Model for End-to-End Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15139","snapshot_observed_at":"2026-08-04T06:07:08.966984Z","title":"Dif- fusiondrive: Truncated diffusion model for end-to-end autonomous driving.arXiv preprint arXiv:2411.15139,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:08.966984Z"},"links":{"cited_paper":"/paper/2411.15139","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:b0396b2f980332db8116b373d5db62eddc9b4105e319cc1bac93379a1b2230ef","observation_id":"03d3ef13-b7f2-426f-b044-eff232a4788b","resolution":{"observed_at":"2026-08-04T06:07:08.966984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01415","last_updated":"2023-12-05T05:26:29Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:57Z","title":"GPT-Driver: Learning to Drive with GPT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01415","snapshot_observed_at":"2026-08-04T06:07:09.140508Z","title":"Gpt- driver: Learning to drive with gpt.arXiv preprint arXiv:2310.01415, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:09.140508Z"},"links":{"cited_paper":"/paper/2310.01415","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:3e64bab628c2a96d40c833b567e10f7e4805c2045140973c5abf444089874f65","observation_id":"e266002b-2b20-49ed-bfaa-f055d82514ec","resolution":{"observed_at":"2026-08-04T06:07:09.140508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03661","last_updated":"2024-07-20T15:59:53Z","snapshot_observed_at":"2026-08-12T06:49:46.031945Z","submitted_at":"2023-12-06T18:32:33Z","title":"Reason2Drive: Towards Interpretable and Chain-based Reasoning for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03661","snapshot_observed_at":"2026-08-04T06:07:09.272985Z","title":"Sch¨onemann, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:09.272985Z"},"links":{"cited_paper":"/paper/2312.03661","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:b44380aab5912bd5f9bd953abc231bbab261eafcf94555c09cd8b98caa8e8904","observation_id":"852dc445-123f-4aad-97c6-fa0e80d250bf","resolution":{"observed_at":"2026-08-04T06:07:09.272985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.24044","last_updated":"2025-06-30T16:50:02Z","snapshot_observed_at":"2026-08-12T19:26:12.850812Z","submitted_at":"2025-06-30T16:50:02Z","title":"A Survey on Vision-Language-Action Models for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.24044","snapshot_observed_at":"2026-08-04T06:07:09.468768Z","title":"Tian, X., Gu, J., Li, B., Liu, Y ., Wang, Y ., Zhao, Z., Zhan, K., Jia, P., Lang, X., and Zhao, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:09.468768Z"},"links":{"cited_paper":"/paper/2506.24044","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:2d586540ae90252ae8d215062c642ffbc6f5363f38a91cf8e566449e3f6a91dd","observation_id":"04c9f689-ac34-47c7-a01d-e8440510b18d","resolution":{"observed_at":"2026-08-04T06:07:09.468768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:07:09.663477Z","title":"Wang, S., Yu, Z., Jiang, X., Lan, S., Shi, M., Chang, N., Kautz, J., Li, Y ., and Alvarez, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:09.663477Z"},"links":{"citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:0184622172a8c08f1a58905c6bed233073d0c4798be285e88c9471481ee8e8fa","observation_id":"e756eab8-0838-4aa4-ba82-eee6c167b0fd","resolution":{"observed_at":"2026-08-04T06:07:09.663477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:07:09.749744Z","title":"Wam-diff: A masked diffusion vla framework with moe and online reinforce- ment learning for autonomous driving.arXiv preprint arXiv:2512.11872,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:09.749744Z"},"links":{"citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:cf2ca89abd812774976c4836a7fc0a794d850d8567fa39b65728f2f84c8d907d","observation_id":"75dfcd14-b7c2-419b-b79f-22c7a5592e7f","resolution":{"observed_at":"2026-08-04T06:07:09.749744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03601","last_updated":"2024-08-14T04:31:32Z","snapshot_observed_at":"2026-08-03T08:33:00.534249Z","submitted_at":"2024-08-07T07:41:01Z","title":"DRAMA: An Efficient End-to-end Motion Planner for Autonomous Driving with Mamba","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03601","snapshot_observed_at":"2026-08-04T06:07:09.820418Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:09.820418Z"},"links":{"cited_paper":"/paper/2408.03601","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:18345498f06e63a04bca425e3de0b44785d02edd19571bb5f84cc0de182b8cfd","observation_id":"c2e44f28-07b0-4ea9-bf21-9f51f3188c58","resolution":{"observed_at":"2026-08-04T06:07:09.820418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21505","last_updated":"2025-03-27T13:45:47Z","snapshot_observed_at":"2026-08-07T16:32:50.266092Z","submitted_at":"2025-03-27T13:45:47Z","title":"Fine-Grained Evaluation of Large Vision-Language Models in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21505","snapshot_observed_at":"2026-08-04T06:07:10.012899Z","title":"arxiv.org/abs/2503.21505v1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:10.012899Z"},"links":{"cited_paper":"/paper/2503.21505","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:8dd90672b39c9c4665ec3ac12b5139e9896d1f7a7d05750b29d05bf8b3a3cb85","observation_id":"87d1d350-20c6-4b6e-b2e1-31c4d1a8ee87","resolution":{"observed_at":"2026-08-04T06:07:10.012899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.14702","last_updated":"2026-05-26T09:29:37Z","snapshot_observed_at":"2026-08-03T09:12:16.614175Z","submitted_at":"2026-01-21T06:29:09Z","title":"Drive-P2D: A Progressive Perception-to-Decision Benchmark for VLMs in Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.14702","snapshot_observed_at":"2026-08-04T06:07:10.099362Z","title":"Zhang, S., Huang, W., Gao, Z., Chen, H., and Lv, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:10.099362Z"},"links":{"cited_paper":"/paper/2601.14702","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:1756ec46078a7f20f6068cf8f3dec5772b5a554eec4f16c527a7a2ff9fe2ac5c","observation_id":"1a4aa5fe-9ec7-4bfa-8e87-23e337e62e15","resolution":{"observed_at":"2026-08-04T06:07:10.099362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14917","last_updated":"2025-02-19T09:50:44Z","snapshot_observed_at":"2026-08-12T00:26:31.299959Z","submitted_at":"2025-02-19T09:50:44Z","title":"Sce2DriveX: A Generalized MLLM Framework for Scene-to-Drive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14917","snapshot_observed_at":"2026-08-04T06:07:10.218338Z","title":"Sce2drivex: A generalized mllm framework for scene-to-drive learning.arXiv preprint arXiv:2502.14917,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:10.218338Z"},"links":{"cited_paper":"/paper/2502.14917","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:7f3ec481bf654e1a92f064e19358d77cebec7fdee7e72d00d3839e66c31103fa","observation_id":"f99483ac-4145-48d8-81c4-5621eb0c1358","resolution":{"observed_at":"2026-08-04T06:07:10.218338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13757","last_updated":"2025-11-05T23:46:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-16T17:58:50Z","title":"AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13757","snapshot_observed_at":"2026-08-04T06:07:10.397329Z","title":"Z., Zhang, Y ., Huang, Z., Zhou, B., and Ma, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:10.397329Z"},"links":{"cited_paper":"/paper/2506.13757","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:041a0f9ceb143b2980353b07baa4820751a5f75103fdbd54f0b7897ddfe93baf","observation_id":"7d52e9d4-252f-46b1-9725-d3c32a6f991f","resolution":{"observed_at":"2026-08-04T06:07:10.397329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:07:10.575230Z","title":"Diffusiondrivev2: Rein- forcement learning-constrained truncated diffusion mod- eling in end-to-end autonomous driving.arXiv preprint arXiv:2512.07745,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:10.575230Z"},"links":{"citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:79fbbc9adca2b8a4234e31e09d1f6ea7679a35afcffe02aa43bdbe3b03628f96","observation_id":"10f28bc0-d57d-4069-a387-53ae7baf74fe","resolution":{"observed_at":"2026-08-04T06:07:10.575230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14150","last_updated":"2025-01-16T10:57:44Z","snapshot_observed_at":"2026-08-11T22:13:54.077535Z","submitted_at":"2023-12-21T18:59:12Z","title":"DriveLM: Driving with Graph Visual Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14150","snapshot_observed_at":"2026-08-04T06:07:07.991904Z","title":"Feng, R., Xi, N., Chu, D., Wang, R., Deng, Z., Wang, A., Lu, L., Wang, J., and Huang, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:07.991904Z"},"links":{"cited_paper":"/paper/2312.14150","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:0e472895765ea10739b405f90c41d77c423ac0a04f0a5b889092d7fd4a196a30","observation_id":"3d8c5845-fb10-4cb0-ac89-1b1178910c48","resolution":{"observed_at":"2026-08-04T06:07:07.991904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13243","last_updated":"2026-04-17T23:12:55Z","snapshot_observed_at":"2026-08-04T01:21:26.466156Z","submitted_at":"2024-02-20T18:55:09Z","title":"VADv2: End-to-End Vectorized Autonomous Driving via Probabilistic Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13243","snapshot_observed_at":"2026-08-04T06:07:07.706398Z","title":"Vadv2: End-to-end vectorized autonomous driving via probabilistic planning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:07.706398Z"},"links":{"cited_paper":"/paper/2402.13243","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:31dbb0901480f0fe83e7637d052820f41185c99c14ed6f7a32dcdc159aa26123","observation_id":"72651e63-9180-4f92-9514-1ac3b6dfdf4b","resolution":{"observed_at":"2026-08-04T06:07:07.706398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19755","last_updated":"2025-03-25T15:18:43Z","snapshot_observed_at":"2026-08-05T21:57:39.132989Z","submitted_at":"2025-03-25T15:18:43Z","title":"ORION: A Holistic End-to-End Autonomous Driving Framework by Vision-Language Instructed Action Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19755","snapshot_observed_at":"2026-08-04T06:07:08.095703Z","title":"Orion: A holis- tic end-to-end autonomous driving framework by vision- language instructed action generation.arXiv preprint arXiv:2503.19755,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:08.095703Z"},"links":{"cited_paper":"/paper/2503.19755","citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:bc0cb2b71bbc8ba5ed8bd035506100c08925d02eb96a338f3e516ab827fb859b","observation_id":"16d582f5-0a8b-4957-9a6d-fe77161a0b8f","resolution":{"observed_at":"2026-08-04T06:07:08.095703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:07:08.761015Z","title":"Imagidrive: A unified imagination-and-planning framework for autonomous driving.arXiv preprint arXiv:2508.11428, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-04T06:07:08.761015Z"},"links":{"citing_paper":"/paper/2602.10719"},"observation_digest":"sha256:432dd2d206cac0e23f8682439eeaec064f235f344cf37c4b8784335e6f9ab816","observation_id":"ac926fb9-9d60-4637-9d52-1bbfd0f44f72","resolution":{"observed_at":"2026-08-04T06:07:08.761015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.10719","last_updated":"2026-08-01T13:11:04Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-12T12:27:34.087622Z","submitted_at":"2026-02-11T10:25:05Z","title":"From Representational Complementarity to Dual Systems: Synergizing VLM and Vision-Only Backbones for End-to-End Driving"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2602.10719."}