{"as_of":"2026-08-08T18:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0520730289c18a7012989c415cff8e10a926b9511d7ddb9a0b962f3dbe210344","coverage":[{"denominator":94,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":94,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T17:42:49.902997Z","state":"measured"},{"denominator":94,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":94,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.27038/citation-record","integrity":"/paper/2605.27038/integrity","json":"/paper/2605.27038/citation-record.json","paper":"/paper/2605.27038"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"A survey on vision-language-action models for autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:ca93b7259daf2366036d598e0c4d2dc311668ef996ee35ff7a0967ed117061fe","observation_id":"b8b96268-6971-4f15-8069-2260b197eeeb","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Vision language models in autonomous driving: A survey and outlook.IEEE Transactions on Intelligent Vehicles, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:7095195386b098615c9a76cb7693e8703227e9c97b9ec15db2f75935577bf731","observation_id":"f6919ba6-0efc-433e-a41f-1c491956d828","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Large (vision) language models for autonomous vehicles: Current trends and future directions.IEEE Transactions on Intelligent Transportation Systems, 27(1):187–210, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:21952c104fcb212edef1873ee8b5c707e097d6002e98cea231eb9d91b16154db","observation_id":"915a7126-068e-444b-ae03-de8d56108b0e","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.20794","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:49:42.162490Z","title":"arXiv preprint arXiv:2602.20794 (2026) 10","venue":null,"work_id":"c4ab65e5-d5a3-4ea0-bea1-71848086df12","year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:06ce8c3326fa64cd0513fd9d8b230614df662e88ec71c82ed1e1f3f8c22da88f","observation_id":"e3de236c-68a2-4321-a4ea-42c63309b17b","resolution":{"observed_at":"2026-06-29T17:43:45.723535Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Vlm4d: Towards spatiotem- poral awareness in vision language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:55a417cbb5309435182600fcc0fa3effde285a258e090249637b6b20afdc16d2","observation_id":"9f61a0c8-9ba1-4309-b4b2-f0218d36ca7e","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-07T19:50:06.597130Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":"2411.13112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-07-05T11:41:02.531094Z","title":"Surds: Benchmarking spatial un- derstanding and reasoning in driving scenarios with vision language models","venue":"cs.CV","work_id":"f4ca6aea-f1e8-4324-8d9b-eb9f9da7bc3e","year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:442ad7a088534c828112e170719a61585e38b9e2eb99e7c56de6e135e841e221","observation_id":"1a4c4179-c0d0-4476-b469-3c0481d825ea","resolution":{"observed_at":"2026-06-29T17:43:45.768968Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Language prompt for autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:fc1bf599c9338cce8d3d3451c6192cdf78f6604446526c0e45bf39e72293d1b2","observation_id":"861a5adf-631c-40b8-8f75-0f348c0e0dfa","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05898","last_updated":"2024-11-08T15:50:30Z","snapshot_observed_at":"2026-07-06T19:47:38.708013Z","submitted_at":"2024-11-08T15:50:30Z","title":"Integrating Object Detection Modality into Visual Language Model for Enhanced Autonomous Driving Agent","version":1},"cited_work":{"arxiv_id":"2411.05898","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.05898","snapshot_observed_at":"2026-06-29T17:43:45.773426Z","title":"Integrating object detection modality into visual language model for enhanced autonomous driving agent.arXiv preprint arXiv:2411.05898, 2024","venue":null,"work_id":"989e9357-0e75-4aa5-860c-1d1f9f538ffb","year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2411.05898","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:aeb4dd1971ade8800b3b76a673155e44c44c19bad4fdf673d4c6d4cafac9aa1a","observation_id":"0dfe563f-f198-4402-ae9e-086509fbbcf4","resolution":{"observed_at":"2026-06-29T17:43:45.775267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.10719","last_updated":"2026-07-12T18:02:23Z","snapshot_observed_at":"2026-08-03T17:07:38.286115Z","submitted_at":"2025-12-11T14:59:07Z","title":"SpaceDrive: Infusing Spatial Awareness into VLM-based Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2512.10719","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.10719","snapshot_observed_at":"2026-07-05T11:41:02.546151Z","title":"SpaceDrive: Infusing Spatial Awareness into VLM-based Autonomous Driving","venue":"cs.CV","work_id":"bcc054b3-d176-439e-b728-eaf20b134494","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2512.10719","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:e52b446ad2d8bb44588330763243192bf2a259d531661329e6698c1ca963339b","observation_id":"c48582ca-7669-4528-9ff6-ccbfbac2bb58","resolution":{"observed_at":"2026-06-29T17:43:45.788064Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.01928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:09:44.908036Z","title":"Last-vla: Thinking in latent spatio-temporal space for vision-language-action in autonomous driving","venue":null,"work_id":"2cd8d8af-b827-4c00-a75a-0e1d2fd4a5d1","year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:d530d4dd5504fbb933076a42cbf54d8700c0824fbcbce54e73b965f02d27145c","observation_id":"1f538e8b-7a8d-43a5-82d4-57540b51ed01","resolution":{"observed_at":"2026-06-29T17:43:45.774425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17685","last_updated":"2025-11-11T01:31:25Z","snapshot_observed_at":"2026-08-02T20:06:32.255780Z","submitted_at":"2025-05-23T09:55:32Z","title":"FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2505.17685","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17685","snapshot_observed_at":"2026-07-08T05:34:32.413426Z","title":"FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving","venue":"cs.CV","work_id":"6ad88a41-f4d4-4df5-b676-2d30afb525ce","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2505.17685","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:77f38f48d40b0f572ea7752ae50c8dc55b2e004ddfc1bcd1124783297b7f197e","observation_id":"e2d587e5-328f-4a16-9440-84f0a40e4c5b","resolution":{"observed_at":"2026-06-29T17:43:45.785029Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Occworld: Learning a 3d occupancy world model for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:e16e557b623c18c3961af1e64ec17278bec81d511480d6f5695977671f92014c","observation_id":"46478123-a0ee-4b60-b231-0d6b843853f7","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Fastdrivevla: Efficient end-to-end driving via plug-and-play reconstruction-based token pruning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:5b82752c33e6c6b7a9583a9bae806ff8247e0b0e3acbd56c1b1750fbef8bd900","observation_id":"d9fc86e8-123a-4c29-870d-fddeeffbdfd4","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Self-supervised multi- modal learning: A survey.IEEE Transactions on Pattern Analysis and Machine Intelligence, 47(7):5299–5318, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:185ac8fc25d6f661faf5ae157fc191990185575743a4b6524fbb9eacc080fb87","observation_id":"ae3af8db-26ec-48b6-840d-fdc53d1c32d6","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Scaling laws for native multimodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:afc79990dc3e51957549d9e40f3412bdff1436b3b16e67cdc4a763c3dce47e6c","observation_id":"37c8f65e-d88e-4327-a252-8f31d7b5f100","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01043","last_updated":"2024-08-12T11:53:28Z","snapshot_observed_at":"2026-07-06T16:42:04.139453Z","submitted_at":"2023-11-02T07:23:33Z","title":"LLM4Drive: A Survey of Large Language Models for Autonomous Driving","version":4},"cited_work":{"arxiv_id":"2311.01043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.01043","snapshot_observed_at":"2026-07-04T11:29:50.262614Z","title":"Llm4drive: A survey of large language models for autonomous driving.ArXiv, abs/2311.01043","venue":null,"work_id":"79671237-59f7-4a5f-9019-55c26f13b2ff","year":2023},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2311.01043","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:9f7ce494d6f8374c3943c3cf0826dacb0123d3a576a306cb9d6df21ecbf12c6c","observation_id":"62e006fc-13e6-43fa-940d-27a0ddb36540","resolution":{"observed_at":"2026-06-29T17:43:45.697077Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:0605117cf602d2d53640ffa25dd2c68b1ffdcbd21db6209a72ed238f156ee79f","observation_id":"7bce8c10-47e5-4a0c-a60e-e08675495b12","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06218","last_updated":"2025-06-06T16:25:22Z","snapshot_observed_at":"2026-08-07T05:56:07.289023Z","submitted_at":"2025-06-06T16:25:22Z","title":"STSBench: A Spatio-temporal Scenario Benchmark for Multi-modal Large Language Models in Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2506.06218","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.06218","snapshot_observed_at":"2026-07-09T05:46:01.450385Z","title":"STSBench: A Spatio-temporal Scenario Benchmark for Multi-modal Large Language Models in Autonomous Driving","venue":"cs.CV","work_id":"ed88a64c-969e-4262-b09b-e20d235294e6","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2506.06218","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:24b01b0ac816462012c9c6293e80638d382ee64acd1d4d72519992ab54ec0660","observation_id":"57803ea2-d4b9-4db3-bc67-e67f7b813e83","resolution":{"observed_at":"2026-06-29T17:43:45.701944Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06750","last_updated":"2026-05-20T12:28:41Z","snapshot_observed_at":"2026-08-02T01:38:41.062803Z","submitted_at":"2026-04-08T07:14:55Z","title":"How Well Do Vision-Language Models Understand Sequential Driving Scenes? A Sensitivity Study","version":2},"cited_work":{"arxiv_id":"2604.06750","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.06750","snapshot_observed_at":"2026-06-29T17:43:45.701030Z","title":"How Well Do Vision-Language Models Understand Sequential Driving Scenes? A Sensitivity Study","venue":"cs.CV","work_id":"011643ee-e208-4b33-a532-ac4f49928d49","year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2604.06750","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:4d543278d750641da198b6b74d351ba86b6187552cd70a69ef1620aa14859e34","observation_id":"eae8dedd-3b8f-46c1-8491-2f5c392b2767","resolution":{"observed_at":"2026-06-29T17:43:45.702400Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Are vision llms road-ready? a comprehensive benchmark for safety-critical driving video understanding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:df967981a42aa097a8f284b451213862df36381d9e84529adf1f1335e4bf0d7e","observation_id":"92cb2c1d-af41-456c-baa3-9bab77417708","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Drivegpt4: Interpretable end-to-end autonomous driving via large language model.IEEE Robotics and Automation Letters, 9(10):8186–8193, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:241ef51c7b3db69dd88ec1646bfd6b32f7669245493f2ca4eda8515d815192b5","observation_id":"35920196-aa0e-4b46-b4e8-e01fcacfda5c","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Lmdrive: Closed-loop end-to-end driving with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:249a467c0716fb603e834eb99300dbc9cc7099729d59812aa658d65a15b344a3","observation_id":"9a526889-0bdb-4904-a79a-794729963c94","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Bench2drive: Towards multi-ability benchmarking of closed-loop end-to-end autonomous driving.Advances in Neural Information Processing Systems, 37:819–844, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:1c23387df71af97eecb7dc4127d3a40fe42445981b495ae5393648dad66b33ea","observation_id":"8b821fa7-e409-4343-9315-159f94eb82ee","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2604.01259","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T19:26:00.292698Z","title":"Bench2Drive-VL: Closed-loop VLM evalua- tion for autonomous driving","venue":null,"work_id":"70054278-6bf6-4259-850a-ceb06ee93615","year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:3787c597bdac6cdd86c14bde652095ee45a1d1d213df8561861ae93ab32656af","observation_id":"7b87845f-0d3c-4920-be44-568882f49c44","resolution":{"observed_at":"2026-06-29T17:43:45.711387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Carla: An open urban driving simulator","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:8c213a5f255ef0d7e8cddd53c2d481c31c6ff9df3655eff003774eaad9e8a98c","observation_id":"25f346f7-6e0e-4859-8ed4-ef39d37eef14","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Drivemlm: aligning multi-modal large language models with behavioral planning states for autonomous driving.Visual Intelligence, 3(1):22, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:0a8a76447c85c575ca7926f0d504daa934f86cbc8c9fb55d168c51395e1051c2","observation_id":"d661e6c9-302b-4630-a403-b6f2f550e7a1","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Omnidrive: A holistic vision-language dataset for autonomous driving with counterfactual reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:ff6a9776e0b399431b7933fa229baab70968fd511dd7b4d5c1419123aacf0bcc","observation_id":"d2b4a479-4765-4475-9a2f-72f73b2451e2","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Bevdriver: Leveraging bev maps in llms for robust closed-loop driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:66828452a35fdeeee3292aae981fd96d7405e634551755d1b5254998b69d251f","observation_id":"3bdbd19f-4d28-4c8d-b2d2-b9a16e1483ae","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.05578","last_updated":"2025-09-06T03:47:21Z","snapshot_observed_at":"2026-08-05T05:17:16.038427Z","submitted_at":"2025-09-06T03:47:21Z","title":"OccVLA: Vision-Language-Action Model with Implicit 3D Occupancy Supervision","version":1},"cited_work":{"arxiv_id":"2509.05578","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.05578","snapshot_observed_at":"2026-07-03T16:48:39.596474Z","title":"Oc- cvla: Vision-language-action model with implicit 3d occu- pancy supervision","venue":null,"work_id":"9a241737-7f79-4923-9916-3869db2905d0","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2509.05578","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:3225c74292f4a070cce21b14427556659dd8d5f4c188367b4c6239bafb38667c","observation_id":"207aa84a-c5bf-4bc7-96ca-eaf65bf772c0","resolution":{"observed_at":"2026-06-29T17:43:45.704784Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.18795","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:43:45.697705Z","title":"Perceptio: Perception enhanced vision language models via spatial token generation.arXiv preprint arXiv:2603.18795, 2026","venue":null,"work_id":"b747eeda-5df7-4e2f-93e1-20b81ed831d0","year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:e1bade7f160d8b2ae8713bfc87c21110c2f5babb12300138c8a370cd21cc9356","observation_id":"74f25745-ab09-4ddb-a4c9-dae24d914d3e","resolution":{"observed_at":"2026-06-29T17:43:45.699198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08645","last_updated":"2026-04-09T17:57:35Z","snapshot_observed_at":"2026-07-06T22:57:40.773778Z","submitted_at":"2026-04-09T17:57:35Z","title":"3D-VCD: Hallucination Mitigation in 3D-LLM Embodied Agents through Visual Contrastive Decoding","version":1},"cited_work":{"arxiv_id":"2604.08645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.08645","snapshot_observed_at":"2026-06-29T17:43:45.715895Z","title":"3D-VCD: Hallucination Mitigation in 3D-LLM Embodied Agents through Visual Contrastive Decoding","venue":"cs.CV","work_id":"468cdcda-cc5a-4c8d-82ed-4e6783fe3adc","year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2604.08645","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:7effcecb12c583c15306fab36d161159dce0024d508bbf9f82c95abc6de45cab","observation_id":"2ca8f3b0-d5e3-424b-9a10-73a0ebdc8154","resolution":{"observed_at":"2026-06-29T17:43:45.717404Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07518","last_updated":"2024-12-10T13:56:49Z","snapshot_observed_at":"2026-07-06T20:04:39.240950Z","submitted_at":"2024-12-10T13:56:49Z","title":"Hallucination Elimination and Semantic Enhancement Framework for Vision-Language Models in Traffic Scenarios","version":1},"cited_work":{"arxiv_id":"2412.07518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.07518","snapshot_observed_at":"2026-06-29T17:43:45.778447Z","title":"Hallucination elimi- nation and semantic enhancement framework for vision-language models in traffic scenarios","venue":null,"work_id":"dedd208c-8d60-4274-bb9d-1f094fcbd52c","year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2412.07518","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:6f775a4d9c4d077fd082615843903941beb3cc68b95fc36e1be5ca65c5cd19d3","observation_id":"b38fe928-87d4-47db-943c-ad196390170f","resolution":{"observed_at":"2026-06-29T17:43:45.780075Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Task interference in vlms for autonomous driving: When better perception hurts planning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:84deb6a1f8c882e8cd4cbe154cf627637e477893924c48bf3001f8ec1fa15df5","observation_id":"a3cdea60-2758-4ac2-b571-b21616eea9f7","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.19675","last_updated":"2026-05-03T12:12:49Z","snapshot_observed_at":"2026-07-29T22:55:09.570425Z","submitted_at":"2026-03-20T06:19:31Z","title":"DynFlowDrive: Flow-Based Dynamic World Modeling for Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2603.19675","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.19675","snapshot_observed_at":"2026-06-29T17:43:45.781088Z","title":"DynFlowDrive: Flow-Based Dynamic World Modeling for Autonomous Driving","venue":"cs.CV","work_id":"7161c517-3fb3-475e-b9a3-fed1d5fa54a2","year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2603.19675","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:3912e5fe118fe0e192c1c1d28dd42811561fd10745fa39b7a3714fc7e8e5524d","observation_id":"c12cc7c7-3808-498e-97e1-53e37d0fc352","resolution":{"observed_at":"2026-06-29T17:43:45.782546Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.10498","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:43:45.789563Z","title":"The role of world mod- els in shaping autonomous driving: A comprehensive survey","venue":null,"work_id":"f70bbb2e-90fe-4410-a4e1-ec76db1cc7d9","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:a081192b8d711ed589e52661b259609a491a11d99641d6e110b6c927f522e51a","observation_id":"3eddd94b-ac35-446f-b8d2-a14d6ca92793","resolution":{"observed_at":"2026-06-29T17:43:45.791126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"World4drive: End-to-end autonomous driving via intention-aware physical latent world model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:9f83834dcba42f131c0c46f177cf8f43a2b2025e1f02d7bbfb09701e84fafab1","observation_id":"47af7719-a7c0-4f54-b395-36948c893b8c","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11260","last_updated":"2025-09-10T14:02:23Z","snapshot_observed_at":"2026-08-07T05:28:26.048880Z","submitted_at":"2025-01-20T04:00:02Z","title":"A Survey of World Models for Autonomous Driving","version":4},"cited_work":{"arxiv_id":"2501.11260","doi":"10.48550/arxiv.2501.11260","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11260","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey of world models for autonomous driving","venue":"ArXiv.org","work_id":"5775e072-5965-490b-b444-42d28c541e6f","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2501.11260","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:8bbcc0c38864da8b90159194044be7503f7b31966917a878ba1c9d0dd2d9e2c7","observation_id":"762abc54-3391-4e07-8393-7d427d92a794","resolution":{"observed_at":"2026-06-29T17:43:45.777928Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Dio: Decomposable implicit 4d occupancy-flow world model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:96c133ecea776860f385406d8eeac02679f1bc856357b65cd6b0c0ffbe5e4b67","observation_id":"e2040c52-803c-45f3-9e28-1167a367483f","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.25329","last_updated":"2026-04-28T07:46:30Z","snapshot_observed_at":"2026-07-06T23:11:11.827339Z","submitted_at":"2026-04-28T07:46:30Z","title":"ProDrive: Proactive Planning for Autonomous Driving via Ego-Environment Co-Evolution","version":1},"cited_work":{"arxiv_id":"2604.25329","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.25329","snapshot_observed_at":"2026-06-29T17:43:45.789465Z","title":"ProDrive: Proactive Planning for Autonomous Driving via Ego-Environment Co-Evolution","venue":"cs.RO","work_id":"5c76b013-0372-48d3-8a54-fd88c322ff5a","year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2604.25329","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:b931f5e3ae73b54cf83e794ccdd66429ec3c759092eb8c102067694e36f8f99f","observation_id":"e489d821-cf32-48c1-9128-917c9283f15b","resolution":{"observed_at":"2026-06-29T17:43:45.790958Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Visual point cloud forecasting enables scalable autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:243852947cdd3e5c62565c335811843f5ff22b9a4959482079ea6d2013532d6e","observation_id":"080b498c-5328-4ff9-8c31-2e8f3f3998c6","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Uno: Unsu- pervised occupancy fields for perception and forecasting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:77b0813e57b6aba78eb7b685b24185f85077a47bfd0e434a936b4a2ce5330c91","observation_id":"262bdc29-2885-4e02-9aa9-5f5fc06012be","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10429","last_updated":"2024-10-14T12:24:32Z","snapshot_observed_at":"2026-08-07T21:31:53.134914Z","submitted_at":"2024-10-14T12:24:32Z","title":"DOME: Taming Diffusion Model into High-Fidelity Controllable Occupancy World Model","version":1},"cited_work":{"arxiv_id":"2410.10429","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10429","snapshot_observed_at":"2026-07-04T03:29:29.474307Z","title":"Dome: Tam- ing diffusion model into high-fidelity controllable occupancy world model","venue":null,"work_id":"a319c6c5-4f7e-41dc-bc52-b4d6ae93b698","year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2410.10429","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:10f9506f326115325a719458a94adf6d494f7ca7987bd6192aac8390b620841f","observation_id":"e6dfff39-892b-46c2-a6a9-223c2a24e304","resolution":{"observed_at":"2026-06-29T17:43:45.765979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Driveworld: 4d pre-trained scene understanding via world models for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:4d3f3c47aef54cfbc45ae0b1e1495d521c0e3b22a297efa451dcdf648862cd86","observation_id":"11afd099-b8b1-4045-a070-0051ff93e947","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Smart: Scalable multi-agent real-time motion generation via next-token prediction.Advances in Neural Information Processing Systems, 37:114048–114071, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:90708d54d4369b5c04d959bbcccbb819b532991e2fc4c433d584a7bd05ab9b6f","observation_id":"74140957-a56f-4c00-bf10-4d7da6e07ee0","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901, 2020","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:d9470c3c3345e97db936751fe9e261c38a34771995774eb895630b70c090c55c","observation_id":"8f7e9baa-6261-490d-8eaa-48b14896e578","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2309.17080","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-07-10T11:47:02.949785Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","venue":"cs.CV","work_id":"313484e6-a442-4522-8e19-d07e502844a8","year":2023},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:51433f750cf0a33670bff288556dfac21f11055d4e28012bd038983f9d53b522","observation_id":"d32114f2-9a0a-4edd-8f2c-e21b35daf429","resolution":{"observed_at":"2026-06-29T17:43:45.743512Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Model-based imitation learning for urban driving.Advances in Neural Information Processing Systems, 35:20703–20716, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:0781737cec6ba097a6eb1bc94e6f881747c87bf7e4a3100df93700f67aa435cd","observation_id":"350da1f7-c5d0-4710-b786-4bbf0cc377f2","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Genie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:9992ea7769feecdb2526c0bedfc9c6c9c27c752c787bcde9e7d8af51fa6a7ee6","observation_id":"f7952e2b-0e3a-411b-aaad-5872b64e2bb3","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":"2301.04104","doi":"10.1126/sciadv.adu2488","metadata_source":"pith","pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mastering Diverse Domains through World Models","venue":"cs.AI","work_id":"6aeb260f-8c7c-4f9c-b98b-067cd7c59acd","year":2023},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:27e7e5a6e008fc4ec7324420a064fb7918aabf6c924bff4df9bdc028836f695d","observation_id":"1ff4e26f-84a3-4176-8a9d-c929ed3057db","resolution":{"observed_at":"2026-06-29T17:43:45.746248Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:29bfe079fff0a6307cfc3b0d891936388e5d2584b55131fef5d02b175f37930c","observation_id":"278d9e19-8654-478b-868d-cefe9a5fcafa","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.20321","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:09:50.827602Z","title":"Unitok: A unified tokenizer for visual generation and understanding.arXiv preprint arXiv:2502.20321, 2025a","venue":null,"work_id":"31d5c278-398d-4fee-8130-a864fb6b3717","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:ef0dc046bf9eab3e7f946e5bea267108ac5d2a2edb85d1003449c99e9db5e025","observation_id":"193f5cf4-c0b2-4c26-b896-30a0a9e4eccf","resolution":{"observed_at":"2026-06-29T17:43:45.747262Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Spatialvlm: Endowing vision-language models with spatial reasoning capabilities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:7a4fcc099e260b469066fc204c0a5b6d4db3c9d96feb797e8a261483133c0992","observation_id":"67a34c7c-aa21-486f-925b-cc813c4e5362","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.23404","last_updated":"2026-04-20T17:18:17Z","snapshot_observed_at":"2026-07-06T22:50:23.931381Z","submitted_at":"2026-03-24T16:38:09Z","title":"Unleashing Spatial Reasoning in Multimodal Large Language Models via Textual Representation Guided Reasoning","version":2},"cited_work":{"arxiv_id":"2603.23404","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.23404","snapshot_observed_at":"2026-06-30T20:55:04.189513Z","title":"Unleashing Spatial Reasoning in Multimodal Large Language Models via Textual Representation Guided Reasoning","venue":"cs.CV","work_id":"4e7c053c-c18d-4bb7-9f60-d1a904a3cdd2","year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2603.23404","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:d595b70bd9e7c82585a6e79c8b51ff187881578e9a714ea38d689a288dd6b916","observation_id":"c0f9ed18-93ba-416e-8249-6abb943c4771","resolution":{"observed_at":"2026-06-29T17:43:45.750460Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.08592","last_updated":"2026-04-26T17:36:17Z","snapshot_observed_at":"2026-07-31T15:55:15.225728Z","submitted_at":"2026-03-09T16:42:43Z","title":"Boosting MLLM Spatial Reasoning with Geometrically Referenced 3D Scene Representations","version":2},"cited_work":{"arxiv_id":"2603.08592","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.08592","snapshot_observed_at":"2026-07-01T20:46:13.700923Z","title":"Boosting MLLM Spatial Reasoning with Geometrically Referenced 3D Scene Representations","venue":"cs.CV","work_id":"c42ea365-16e5-4425-86c9-a6c3cafcadfb","year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2603.08592","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:020f8eccf30def879508c79a34887fdd5f567caca5780cbdd1bca44ca6d8fa85","observation_id":"4a5a853f-2c37-4481-ab3b-c7f178b1babd","resolution":{"observed_at":"2026-06-29T17:43:45.737126Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Gaussianvlm: Scene-centric 3d vision-language models using language-aligned gaussian splats for embodied reasoning and beyond.IEEE Robotics and Automation Letters, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:564eb5f8eea1a1bf498e72c0c6e3fb348d8711407d1093ac0d09c44aaa45bae2","observation_id":"8079c63a-91c5-4246-b6be-ccd30dfc5c97","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Spatialrgpt: Grounded spatial reasoning in vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:c25b3bf5f1fe725e221b835dbde2dca9566e8e1c047946551d671bd5be60e050","observation_id":"8037f1d5-625d-4b19-aa94-e0923566412c","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Neural discrete representation learning.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:18a4e6d3f8d4bb71472a0eaef2120c143865d808033064fd9567c3872461ab06","observation_id":"0a5f912b-9551-4159-9b3e-ebbc46568574","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03272","last_updated":"2024-09-05T06:30:01Z","snapshot_observed_at":"2026-08-06T22:24:59.570320Z","submitted_at":"2024-09-05T06:30:01Z","title":"OccLLaMA: An Occupancy-Language-Action Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2409.03272","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03272","snapshot_observed_at":"2026-07-02T12:46:57.193503Z","title":"Occllama: An occupancy-language-action generative world model for au- tonomous driving","venue":null,"work_id":"5fc5e45b-2831-45a2-bd1c-b8697eee8c10","year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2409.03272","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:f09d29df46479572dad28ee0c1e570b37c38e24879520b9862cf8bc796de77dc","observation_id":"8b1bce87-431d-40c3-a293-6aa12eedb329","resolution":{"observed_at":"2026-06-29T17:43:45.753360Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:3897a49d387f137331bf9e1efbb5c6cd141a39655f5e6de387ecdbbca51a8cc4","observation_id":"b9a651d6-a409-40df-b8bf-9e20586da551","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Center-based 3d object detection and track- ing","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:4b9ed2e87e66d7d5e47bd57fe18f59aa1fe9f47b50d5b69163e9571934fcbcf8","observation_id":"7e6add75-b4e5-4e8c-a5a6-cfa91487a6ac","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"V oxelnet: End-to-end learning for point cloud based 3d object detection","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:7e0fa024b526e91b0d04d09cf2463294f5bc2ec18f0770e52916bccbb92fd8da","observation_id":"210e82b6-f573-4b79-bbf1-76bd2a89d133","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15804","last_updated":"2026-04-21T03:35:14Z","snapshot_observed_at":"2026-08-01T22:56:50.755050Z","submitted_at":"2026-04-17T08:05:46Z","title":"Qwen3.5-Omni Technical Report","version":2},"cited_work":{"arxiv_id":"2604.15804","doi":"10.48550/arxiv.2604.15804","metadata_source":"pith","pith_arxiv_id":"2604.15804","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Qwen3.5-Omni Technical Report","venue":"cs.CL","work_id":"9d0aeac4-3b94-4a09-af62-5e32286fdf5f","year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2604.15804","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:b7da50b95502c677cc7e756fc0fdc6816f56d38bcc86b44cc0cdb4c8e1fbbd59","observation_id":"99b5bbfa-c3c0-4079-9b45-4739a1ef8ee6","resolution":{"observed_at":"2026-06-29T17:43:45.760188Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Traffic scene perception via multimodal large language model with data augmentation and efficient training strategy.Applied Soft Computing, 177:113210, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:f0e6aed12f40ffea5cbf99b72d9187b4dddd3fb44c7910eb1aab2c0a8c98b9ce","observation_id":"97289252-1dce-4e96-a144-d2fa30b61163","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Implementation of image generative models using imagegpt","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:e6ea482f9c6da097ba2376b050a72a71f4e4eb9abd1487ff41271bd4a474a35d","observation_id":"1622c959-1647-4798-b738-8bb4170be019","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:0da3a89b45c316de08413fb392d20792e9884a809f96be42dc8f186638bf7a7c","observation_id":"56d4e0f6-4083-48db-8495-a11266bf007b","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Efficient diffusion policies for offline reinforcement learning.Advances in Neural Information Processing Systems, 36:67195–67212, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:6ddb92f90e520126a98351f74320321c37658dd37620020a8e8a0ce558009420","observation_id":"c97b4652-3a75-4d1a-958c-770d61feaa04","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Denoising diffusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:2df3e2801e58a9f8ad7a0bdceca1f037923a2be5f6b5eeec199ef5f9518709a7","observation_id":"6dc1c05a-84f2-422b-856c-ff759f5597e9","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"St-p3: End-to-end vision-based autonomous driving via spatial-temporal feature learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:517c2833afab05ffe4306922316e2b390b1ebf51bcaa45006589a2b98ee4923e","observation_id":"8904bdf8-ce46-4e8a-9829-6cdcf241dc07","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Planning-oriented autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:afe074ceac355fb1bded12f5a00f949f5e3a44cf6aa393924a52d21fb04bf19a","observation_id":"b241627c-c561-485f-bbfc-ef6e0d4d5ed2","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Is ego status all you need for open-loop end-to-end autonomous driving? InProceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pages 14864–14873, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:e245946e737fadb37649195d2c6591360c072d9912fc3e43680be5327469ae52","observation_id":"68950d7e-c73d-4c7b-8593-95f58985cfbd","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Don’t shake the wheel: Momentum-aware planning in end-to-end autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:a9aeb31081abec32739a40273d7a007987ca2bfb33590fccbe96f01856b26f5e","observation_id":"11c88c5d-5a33-4882-9503-ab63aa0e51e0","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"He-drive: Human-like end-to-end driving with vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:17f5d364224c1770cae4652249c34c1380bf39e744c85777fe920016bc0ab942","observation_id":"7642de8d-5775-4855-858f-b8eccd584608","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Diffusiondrive: Truncated diffusion model for end-to-end autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:4922e876cfeceee84e70f69ddeb90f95773e8edff87a8add1d96a1ef2f066caa","observation_id":"7606be72-9abd-46b0-b037-27ff89473446","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Prix: learning to plan from raw pixels for end-to-end autonomous driving.IEEE Robotics and Automation Letters, 11(5):6400– 6407, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:8965edfcb2fe0ee6e38bc031d56021a031630c5bde694b5115776c8697864f37","observation_id":"8db4518b-b9a4-465f-8813-721bbeaad098","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Making large language models better planners with reasoning-decision alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:6e12133f329854270464fb0282f48ce59371e3af65f7f72eaf7bd91939cf51ed","observation_id":"a511359a-1cbb-4b92-8bb5-7a0158c9936c","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09627","last_updated":"2024-12-12T18:59:59Z","snapshot_observed_at":"2026-08-05T03:34:06.291232Z","submitted_at":"2024-12-12T18:59:59Z","title":"Doe-1: Closed-Loop Autonomous Driving with Large World Model","version":1},"cited_work":{"arxiv_id":"2412.09627","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09627","snapshot_observed_at":"2026-06-29T17:43:45.730253Z","title":"Doe-1: Closed-loop autonomous driving with large world model.ArXiv, abs/2412.09627","venue":null,"work_id":"a7359a92-a145-4039-a07a-c82043315c1e","year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2412.09627","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:1cf433857119d1f916e957316b8b6c8303da690bd3ef6d4a7c6aec1222ee124e","observation_id":"0c2f2884-66aa-4b66-b55d-be0689f21510","resolution":{"observed_at":"2026-06-29T17:43:45.732453Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23262","last_updated":"2025-09-23T04:19:59Z","snapshot_observed_at":"2026-08-05T06:31:46.069300Z","submitted_at":"2024-10-30T17:46:31Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2410.23262","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.23262","snapshot_observed_at":"2026-07-10T08:36:59.765622Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","venue":"cs.CV","work_id":"61d9e129-bb61-41e0-9c9f-b30ba6f179b6","year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2410.23262","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:72e849884c6f271b8065f7a15620089859a5b4358ac380657e48a59d37b937f9","observation_id":"f45c6ce2-5f64-4e72-b85e-ba46c64d8c83","resolution":{"observed_at":"2026-06-29T17:43:45.734285Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:495360c12171e9ddeba838c694173023ac20038e5e1c6640d994cd18b7c76a07","observation_id":"cba6eb56-ecd5-470c-8e56-be5cf75d40b8","resolution":{"observed_at":"2026-06-29T17:43:45.754584Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Drivinggpt: Unifying driving world modeling and planning with multi-modal autoregressive transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:262e8f55f041fb928b94258c411abeb5bfe8a6d03f819d4a020779f2c17e4033","observation_id":"df4bbb40-2980-4d85-bb34-3c38cb32018e","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"End-to-end driving with online trajectory evaluation via bev world model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:80fd2c863fd2633ae5abca52c34a4cf7a3462b25888c1bb63a5c6d6c0e214c96","observation_id":"e3531b71-aca1-4ca7-8047-b1aa810c5f68","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13757","last_updated":"2025-11-05T23:46:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-16T17:58:50Z","title":"AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning","version":3},"cited_work":{"arxiv_id":"2506.13757","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13757","snapshot_observed_at":"2026-07-10T08:36:59.854319Z","title":"AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning","venue":"cs.CV","work_id":"945172fb-0f3b-43be-88b4-ae61042517e9","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2506.13757","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:2f6a9b46deb2d508f1dcc505589b29f69d9bad9681744196d6b73e99a5e42741","observation_id":"55b23e7c-19c3-4fa8-b4ff-b47f942a691f","resolution":{"observed_at":"2026-06-29T17:43:45.768926Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08052","last_updated":"2025-09-29T17:21:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-09T03:14:04Z","title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2506.08052","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.08052","snapshot_observed_at":"2026-07-10T08:36:59.842975Z","title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","venue":"cs.CV","work_id":"02bd7e58-a437-4e26-912d-8f1a2e695fa7","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2506.08052","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:a795632250c5aeaec827f7d64e1bdb8913b3ce2c1b6adddc7248ce8f9db4eb7e","observation_id":"e31df525-e358-4d48-bdf9-f82884c40f85","resolution":{"observed_at":"2026-06-29T17:43:45.793906Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Transfuser: Imitation with transformer-based sensor fusion for autonomous driving.IEEE transactions on pattern analysis and machine intelligence, 45(11):12878–12895, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:94d295a8008903773704130c89b6e1ce60cb8738133135509ef9f2f05881681f","observation_id":"9eff0f14-a0c8-40b5-8845-786537b9f1a3","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Hydra-mdp++: Advancing end-to-end driving via hydra-distillation with expert-guided decision analysis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:38481d9341fc478ecb908c70186c8d9a634464bc5b4f14721fa860c08e39c5ba","observation_id":"3ab0277b-da50-4532-899e-422807886013","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.12796","last_updated":"2025-12-18T07:25:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-14T17:59:47Z","title":"DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2510.12796","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.12796","snapshot_observed_at":"2026-07-10T08:36:59.776968Z","title":"DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving","venue":"cs.CV","work_id":"c356b2a8-eaa6-476d-b6d8-8680bb5ddff8","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2510.12796","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:97a9d0cd0e2ee2ca456168a69bd8c67b655221498e0709bd4e5d11fce8754a1a","observation_id":"4bee2365-84b7-4650-8eed-d037fb203177","resolution":{"observed_at":"2026-06-29T17:43:45.726240Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Bevworld: A multimodal world model for autonomous driving via unified bev latent space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:b2051bc851a48c982aa6c60bd6e7e723343a619df1e0a17a513ec772a61dfe70","observation_id":"8699c021-d1bf-4e80-a907-db693704782f","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Driving in the occupancy world: Vision-centric 4d occupancy forecasting and planning via world models for autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:54a7e66c52adfcd0553c178de14a5ec2c6f2fab066738c54480f210250ef34c5","observation_id":"62bd9ea7-f6ca-435f-bdb5-c8dfb5340887","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"nuscenes: A multimodal dataset for autonomous driving","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:39501c8ed6060c0c38a8f1e91540c817663c1280e36c8ee4b81e13b659e94fab","observation_id":"f6f311e5-161b-4cee-88c6-f46cd821108d","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Navsim: Data-driven non- reactive autonomous vehicle simulation and benchmarking.Advances in Neural Information Processing Systems, 37:28706–28719, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:62363448b7e743033cf8de6794d4d0927c9ad83498dc374e672b9f95d4d1b2bd","observation_id":"32aa6c69-2598-4c01-932a-b67f21367d7e","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.04218","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:25.570449Z","title":"Pseudo-simulation for autonomous driving.arXiv preprint arXiv:2506.04218","venue":null,"work_id":"d8bb0a5f-f4f1-4d7d-a9b1-90eacc293742","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:7e5bef197b178c96f1f5d82016b5ec41253a30793ea8f92a5c3f8870796c534d","observation_id":"411e0f98-029e-4d00-89af-88992e436be9","resolution":{"observed_at":"2026-06-29T17:43:45.723525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.09315","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:43:45.709102Z","title":"Transdiffuser: End-to-end trajectory gen- eration with decorrelated multi-modal representation for au- tonomous driving","venue":null,"work_id":"5d065ad1-f6d5-43f4-be3f-a65c1bd5a5f9","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:f0a7ec9b69336f5237ae64d8cdaa402e5f9b28b311244216eb3c2fee67f9d51b","observation_id":"ee945d11-c3ec-4904-82de-45d8ae697ca2","resolution":{"observed_at":"2026-06-29T17:43:45.711150Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:42:49.902997Z","title":"Genad: Gen- erative end-to-end autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:7800c5bd073975bd0c9991c5b600e5a25c94d51e58a0afd9f32b3f219dff1359","observation_id":"2609fdbe-50b8-409a-be08-54e13800c93c","resolution":{"observed_at":"2026-06-29T17:42:49.902997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17659","last_updated":"2026-06-02T02:54:45Z","snapshot_observed_at":"2026-08-07T14:40:41.464905Z","submitted_at":"2025-05-23T09:22:19Z","title":"Plan-R1: Safe and Feasible Trajectory Planning as Language Modeling","version":5},"cited_work":{"arxiv_id":"2505.17659","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17659","snapshot_observed_at":"2026-07-01T19:36:08.477680Z","title":"Plan-r1: Safe and feasible trajectory planning as language modeling","venue":"cs.RO","work_id":"30ddee3f-1341-4cc9-b6d0-daab499d03ce","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2505.17659","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:be318253bad52d7008e04e29072c8448b9a03fd9ef08b1e49a9a13b295435d25","observation_id":"13211735-c114-48c9-98bd-807de787ac90","resolution":{"observed_at":"2026-06-29T17:43:45.714468Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.17940","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:30:08.132323Z","title":"Drivedpo: Policy learning via safety dpo for end-to-end autonomous driving","venue":null,"work_id":"87d25e56-fa80-4c5b-a584-6cc24dfcc4ba","year":2025},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:658acdce2df4fb45ee24c15c0ae8c259087d7762e19f0f4ff51c3f39e6a562b0","observation_id":"8135629e-aa8a-4a3d-ae94-8da1cf4514a6","resolution":{"observed_at":"2026-06-29T17:43:45.728952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving"},"reference_resolution":{"displayed":94,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":58,"verified_exact":36,"verified_fuzzy":0},"total_outbound_references":94},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 94 of 94 outbound references and 0 inbound Pith citation observations for arXiv:2605.27038."}