{"as_of":"2026-08-06T21:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4fa8ad239b0f275457f60e8252e8bb20fa2ede77f1229eb142fd1df54cd5d071","coverage":[{"denominator":87,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":87,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T02:36:49.451297Z","state":"measured"},{"denominator":87,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":87,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.05774/citation-record","integrity":"/paper/2606.05774/integrity","json":"/paper/2606.05774/citation-record.json","paper":"/paper/2606.05774"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"nuscenes: A multimodal dataset for autonomous driving","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:84c6479237f4549f4c0ad37f220ffe328f18d73b95acd3333035e0da93c17a11","observation_id":"d736fe20-bc98-4447-9d50-86e52a24a5eb","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Vadv2: End-to-end vectorized autonomous driving via probabilistic planning.ICLR, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:7ef69e565f2995db3ab871d3c3f797de6a592985ca651c503073af0fb553f0c3","observation_id":"69903d47-43d4-4b7f-b6c7-a58c2c51f8bd","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Drivinggpt: Unifying driving world modeling and planning with multi-modal autoregressive transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:0464af85365d4f1fe24964806d0fb487ee30a7351d35946f7c306e2df538b7fc","observation_id":"74dc6935-0edb-4159-ab1a-7a22ab9d56d9","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Bevdistill: Cross-modal bev distillation for multi-view 3d object detection.arXiv, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:c8d235a77ad2601a857b170c816e6f3031c61e0d4a28fa73631a471cfc9d466e","observation_id":"bf0be160-4abc-4b50-9577-ef5159c29199","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Openscene: The largest up-to-date 3d occupancy prediction bench- mark in autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:b7c41db0ac69bec099b4d7701c1bf106c5783abed9574e56c39bf3ffcf718b8d","observation_id":"f565b0fe-2bd8-4c4c-9b75-181f51867abd","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Sparseworld: A flexible, adaptive, and efficient 4d occupancy world model powered by sparse and dynamic queries","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:f70a44a67cdf61bb9537d5705742de712caf8d0809a6b2679357c097bbf0b266","observation_id":"9f304731-6b74-46c2-8138-bc245cea11e2","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Navsim: Data-driven non-reactive autonomous vehicle simulation and benchmarking.NeurIPS, 37:28706–28719, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:51cfc42917ea8f032800b617edd0d54aa26adc4c33515455ebfa9e9c4452f0c4","observation_id":"54ccc197-7d4d-468c-92a8-4304da66bf00","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Sparseworld-tc: Trajectory-conditioned sparse occupancy world model.arXiv, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:0059605684c39139c182e92963c54989f9f3725b96228805472cd47795ea02ce","observation_id":"14fe80e6-8f6a-42dc-b2d1-6f4ce008409b","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Artemis: Autoregressive end-to-end trajectory planning with mixture of experts for autonomous driving.IEEE RAL, 11(1):226–233, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:63693878076d7f2634b5d03a979aea3d9881a3be7007179042d28fc297c49789","observation_id":"71bdc983-2a0a-4096-ac63-cfb84d7a6f32","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:a130898a0f5fdcb01f55b9bae596155f414a8b02890ffc70ae901631305dbc24","observation_id":"83fc67ee-1daa-4b23-b449-9eca277cbe0a","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Dome: Taming diffusion model into high-fidelity controllable occupancy world model.arXiv, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:c906428b0f3c4f125e11a0cfb317adc06552f2bf4d64a5c2369893e669155d25","observation_id":"fa51b45a-f719-402c-a2ff-bc8e2c1fd965","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"3d packing for self-supervised monocular depth estimation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:241664d40b9358c8905bd249fdd94914d996499107cba83b0fe2e11c39958577","observation_id":"a5b48923-cf71-4813-915c-084624121d81","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:c68f5b188e45763565e3238219ca47cf4648ac3807a88cc9c7fa810728d7f335","observation_id":"0e68335f-d074-4eca-be35-9a59b08017d7","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Lrm: Large reconstruction model for single image to 3d","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:396ea9f3187e8238790d9e0556c8a8f17a10f59070fe6b94f2d7d14c38804401","observation_id":"6efb426f-aac0-407f-bda0-22410045d4a0","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"One thousand and one hours: Self-driving motion prediction dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:fc9021b04bf896a4c80578acf617a535acab6d01257489037a1e0007c7faeab5","observation_id":"f8043ab9-76d1-43f4-9983-cd94f3595d39","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Planning-oriented autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:9f4ff935630fa7f90c66db528deb3959117d40843938c9bad066aaec3f01efbc","observation_id":"0b99c806-23e7-4f0e-a58c-8497e355ed18","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Bevdet4d: Exploit temporal cues in multi-camera 3d object detection.arXiv, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:ca49fe197c5c0a61eff6babfd81956022fe5f79641bd83b2f8f1aa569dbb5256","observation_id":"71eac3da-3b37-4d01-ade1-d52bb621f10e","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Bevdet: High-performance multi-camera 3d object detection in bird-eye-view.arXiv, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:872ba9203710dcd852076466f792a40a256dcd0e31bf2c1dd70789f29fe9ee09","observation_id":"0fe2eec4-6aee-49ca-bce0-9cba7763337e","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Tig-bev: Multi-view bev 3d object detection via target inner-geometry learning.arXiv, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:6ec2d2f9db3301f11c871118f43d588ee804f8f0b0a0af29f185417dfc9048c4","observation_id":"05d02189-7914-4e0c-a0c6-6aacc69f7d0a","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:b99c1710a2a395b80cfbef3b38e5389624d96ce82600fbf8536da0deed725ccd","observation_id":"2ebdf374-62ad-4f20-837b-09c80136a51d","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Occtens: 3d occupancy world model via temporal next-scale prediction.IEEE RAL, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:e2c0eb67ecf6c91588ce3fb197d4358593efc7f1e94da300a17e56d9f9aa3512","observation_id":"491761bb-e9d0-4fb9-a7d6-11533a625192","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Trans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:20d1f1944375d59bd3aaf41c735679ab449a5b09ca7df8bdfd9084200bfd73d5","observation_id":"b609beb9-3d3f-46b7-8893-76df5d8fc409","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"X3kd: Knowledge distillation across modal- ities, tasks and stages for multi-camera 3d object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:c18346779b9fb0d355c4f196905d7972806889ff829b466d0f4ff3fee1ef2ee9","observation_id":"cd1027b8-3b46-4b58-834e-75ef8c8e49a4","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Grounding image matching in 3d with mast3r","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:4106a08675a0b38be2c2914ad2359867622c0c0380233c0b6b93d8bdc563cc39","observation_id":"40c27cf7-8d71-415a-9369-601263a68574","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Semi-supervised vision-centric 3d occupancy world model for autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:237e893534ed8d4b550fe6baccd45802cb41eaa91098f2b75ee83edd8140cbb8","observation_id":"e72d43e5-b57b-4bbb-a443-023b5d48986e","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"V oxformer: Sparse voxel transformer for camera-based 3d semantic scene completion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:de666685221507da00c18890d48fdbb7476c2f4948b5a212e2032b3f14921489","observation_id":"e6b38abb-3af9-43ce-a7d5-a5197bdcf0a4","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Enhancing end-to-end autonomous driving with latent world model.ICLR, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:0ec62ea3aea16fe18280689c6bf389d453ef2cde3832af4870dd01a4f92d7b1f","observation_id":"276e4ce2-5328-4d82-9a87-d2976f32a3e9","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"End-to-end driving with online trajectory evaluation via bev world model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:aaf55f49d6809088cb4eb098c49dbf04bec5e21e872a8eeac016d071efafc2c6","observation_id":"a7b08df4-eea9-4914-8d80-4ad392f7a28e","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Drivevla-w0: World models amplify data scaling law in autonomous driving.ICLR, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:fc213a11c9d57e6e3ff6bf2c7dc0cf317915f1adf9ee601e5a3350d18aff7825","observation_id":"d08e538e-eb5e-4b2e-8383-ad40e374de15","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:4ccf542e6eb227a7bc5a05c2e1586e0d7e4684355c73b3758ca18deb7368c07a","observation_id":"4cd346e2-56dd-48a5-833f-ef616b19fe77","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Recogdrive: A reinforced cognitive framework for end-to-end autonomous driving.ICLR, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:60675479100a7c7fc826d86c68b402dbd41a2d2da51edc97106a3e2c698d4608","observation_id":"4902e27b-658e-48ed-8a07-c6a62d30e99a","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Hydra-mdp: End-to-end multimodal planning with multi-target hydra-distillation.arXiv, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:9e2a3e0ff63058cb87e2d92351e3749bad49db6ed62655037eb5d88905e9ca5f","observation_id":"5b5599e0-87bc-40a6-8d4e-4321102b0a44","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Bevformer: learning bird’s-eye-view representation from lidar-camera via spatiotemporal transformers.IEEE TPAMI, 47(3):2020–2036, 2024","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:1b98166c69943cd6a1c16c354336d391b1ceb6d87a1b27116b637d6efb9dfae0","observation_id":"a8fa39d3-5d34-42d1-9979-dd5a24be1ede","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v40i8.37610","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Diffusion-based contextual reconstruction for point cloud segmentation with limited annotations.AAAI, 40(8): 6780–6788, Mar","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"a2356d81-5a02-4fbe-b17c-c441b60abfe3","year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:70441102cd5297f95f296de25f888b1bd445101cfc87e396ad176617aaac8f89","observation_id":"d66bab72-ddb7-47f9-9b7d-edc570d5d4bb","resolution":{"observed_at":"2026-06-28T02:41:31.847526Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Bevfusion: A simple and robust lidar-camera fusion framework","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:3c7c3ed08d78402fa8953a7bd2bb802f69fe50cfe912d33e7aeb6f14ca93b88f","observation_id":"4285a2d5-a1a9-4657-9385-04f3bf95ec43","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Diffusiondrive: Truncated diffusion model for end-to-end autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:20c45b68e0e0df0dbf417e54f4c8218874a0d9e6e42d3ae13906bfa153c89082","observation_id":"1616dade-a5f1-47b1-b728-b6d9c527fae5","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"I2- world: Intra-inter tokenization for efficient dynamic 4d scene forecasting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:1cf8e3802e816b1abd0f5d4dfc47802b260494aeddd587adb4f28f929adf0f16","observation_id":"b71882a5-6368-451c-8877-c431ffca4ad0","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Adathinkdrive: Adaptive thinking via reinforcement learning for autonomous driving.arXiv, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:837819496cddf3bd932967aee5b4bb7182dd31e84385e9a069bb98e883cb4b7b","observation_id":"4cdd5f6c-10e5-4dea-9716-9978eb004195","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Nerf: Representing scenes as neural radiance fields for view synthesis.CACM, 65 (1):99–106, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:94e20939a7d60c38ad23a97958a8efe2c34905ccdd894581652cf88361efa42d","observation_id":"395cdbe0-3f96-4e61-8fa4-30020b397978","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Mast3r-slam: Real-time dense slam with 3d reconstruction priors","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:770206ed3a11966f4775fb4602fecbab7b62efe811bb3e5b79df08ebefb2a471","observation_id":"de3ecdb8-af8a-4aa7-bf3b-bab347678b93","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Dinov2: Learning robust visual features without supervision.arXiv, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:f20c5508656501bf4e6056e855772e1e8a966f2b03cdae7fd1565ed398e586c5","observation_id":"4c75676d-cff7-4939-b902-45dbd9c291de","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Renderocc: Vision-centric 3d occupancy prediction with 2d rendering supervision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:4e440d64aa87cfdd438270c3ef2118a90012757ac227173f17beadd0a95fb4c0","observation_id":"e8242a74-eaab-4199-b32a-369a8279351b","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Omnivggt: Omni-modality driven visual geometry grounded transformer.arXiv, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:a0b30ada0b53d5441c305793da0898016947d6bca21f2d68b3b436ac310ac952","observation_id":"b83a4f0b-7f3b-4f7c-bd24-9830e7525bcd","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:2987810165c092ea3318ca67cb7d235ffdade4e9dd45dde784e2467fd595f973","observation_id":"df33ef23-04d1-47ae-b3cf-4aafd4b385a3","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Multi-modal fusion transformer for end-to-end autonomous driving","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:7e9ebba1a0c17ed90ca0ae75b9615d2de1beed76b30547aa16b9366e751db19d","observation_id":"a74c6831-05bb-466a-b2fe-1aec63897bc5","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Fastvggt: Training-free acceleration of visual geometry transformer.arXiv, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:c3bdcf610749544d5a7bfdb6b24f5309f8ac2273d37f6c74ad8aedfec3683cbe","observation_id":"ea0ee314-22b8-44fe-93be-c434e1649bf6","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Come: Adding scene-centric forecasting control to occupancy world model.NeurIPS, 38:70–96, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:f19d857c5b5006df64f320c8bf1549ac622ad9fed6b981b99cddaaf179bbe731","observation_id":"7834f91a-424d-43f2-b169-134993622479","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Litevggt: Boosting vanilla vggt via geometry-aware cached token merging","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:e2c4beab36fb288f0cd884990b8bbaa06cb3ff7d64ac86ab278685ee3dbf67de","observation_id":"7b598f1e-b03f-483c-be97-c06105b759cc","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:bf279edadd108018504bdaa3f43396cf31b755cee0af3e0fe3f8624c4e258a80","observation_id":"df328570-598d-44bf-b043-06dc32e399d7","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Training very deep networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:2f9d376c2334e3fac729a29010718300b3211b06960845177c39c10966bc65cf","observation_id":"f4fa47b6-1560-40fd-904e-953f7af1b4ec","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Scalability in perception for autonomous driving: Waymo open dataset","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:c7888ab2e614353ba5e352d41d19c15ab04578042cbfd3ddf209657822193d91","observation_id":"2b92354b-ddb5-45f8-b3ed-cd8a1d0a083d","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving.NeurIPS, 36:64318–64330, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:e37675e685102dc7e5bf223f5123138f8d3231cbf8b44f353a54886cb6574d44","observation_id":"537bebac-5e06-4fb7-8053-35946ff84701","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Drivevlm: The convergence of autonomous driving and large vision-language models.arXiv, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:013c32d12f385af36bf70f460942b916b7a80beed9f46de868abf7e2527d74e4","observation_id":"18d167b9-dc02-46da-9663-ff6b3e532573","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Least-squares estimation of transformation parameters between two point patterns.IEEE TPAMI, 13(4):376–380, 1991","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:52baafa2d6600dbe377dca7f0407eaf633c3d7b30bf0afa39b2827a24ebda008","observation_id":"14723948-bdb5-41ae-9423-98dbe1e3f4a0","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:1a347b1283f9968c38e931acc40aaf41e7e29c3addc8fcb861c97a8ad8ea6713","observation_id":"05e95815-16ad-4208-9176-b1f9980faed2","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Regularizing nighttime weirdness: Efficient self-supervised monocular depth estimation in the dark","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:20aa4d727c4c914630482de350aaabb799f5a9a79a4b55b8de14ba6c4952abb2","observation_id":"24055aa1-47d9-42c0-ac50-f0363e0edfa8","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Continuous 3d perception model with persistent state","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:0afc5a216764a2bfc510b7f02e36ef9eedadc1cab541c8f5ff8b6ce53386bd16","observation_id":"8e084a06-db21-4f47-825e-5ea9af8599cf","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Dust3r: Geometric 3d vision made easy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:98dc4628e87da835727dbef853da3e2ecc5df92c31bbc315f1b84f0032c1219e","observation_id":"6d4ab06f-999b-407d-bedb-d75edcc9c558","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Openoccupancy: A large scale benchmark for surrounding semantic occupancy perception","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:3919728138d0a77935b335d2359aad8ac817a0f5a0ece13474c2a418012dfc0d","observation_id":"c927d161-06fd-4036-b618-fe249a5efe9d","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"pi3: Permutation-equivariant visual geometry learning.arXiv, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:3db64a6f56c3448d698547fa160bdb1741f9353fcad00439e8ddd884d787a4ea","observation_id":"43092c7a-6530-42b0-a4d7-b9066636e81f","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Distillbev: Boosting multi-camera 3d object detection with cross-modal knowledge distillation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:da84999821d8e82779c2aa7eec8c17903e58322539d02d6aee1adaf5cf279ffb","observation_id":"26161b7b-d1eb-4832-8201-02858a5366d1","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:2deb0455770f8b527fa626c45fffc03baf0e08b308602d89c4409eac450ff7e4","observation_id":"b4934d20-b097-4d29-9042-6a22480d5c9c","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Weathergen: A unified diverse weather generator for lidar point clouds via spider mamba diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:2bf7814fbc1c7b24c88813c04ebc5154f97f8996d82231265fa191f62a18fa3e","observation_id":"fb8b8107-f570-4ae3-b267-e75895b2ec01","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Gem: Generating lidar world model via deformable mamba.arXiv, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:f9f2dfd564dff0fec8596afd11e5ac83684418e3b8003f1a5ae2c3bc309e55ef","observation_id":"b610b7ae-a854-4c1f-943c-4170d7b4171b","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Distill to think, foresee to act: Cognitive-physical reinforcement learning for autonomous driving.arXiv, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:33186882f83ea7c38b8e615f97e06d5eb02562d3f146e56d3c07436763728858","observation_id":"a91c3581-9078-4ac4-8d4f-c2f989b1bf61","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Drivelaw: Unifying planning and video generation in a latent driving world.CVPR, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:0a4032af89b582260ddac145ddc01ccac3dcd83dad683f1389a56450940ac654","observation_id":"1114843d-46ce-4add-ac8d-cb19c10e05b9","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Pandaset: Advanced sensor suite dataset for autonomous driving","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:621ded22f1cc13fa8ffdf0b746652d068d200fbd9d787f228aa6beeb5ae7cc52","observation_id":"8d130a23-69d1-4a69-93fd-68b9f749b0b9","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Goalflow: Goal-driven flow matching for multimodal trajectories generation in end-to-end autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:f29f3e53fd8fe2307f67082f142ad4cf5d689baa47b0811a6c01bfa175caeec4","observation_id":"19034c1b-c174-4df0-89e8-3fddb29cbad0","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Delta- triplane transformers as occupancy world models.arXiv, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:ae3208247e366dc8e5bf9e99377067bfe5934a09bfad435a075421b73187204d","observation_id":"680d1da5-a1da-4010-b5e4-ef865bd21432","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Occ-llm: Enhancing autonomous driving with occupancy-based large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:7f00c1eb0be577dc2feccfb1856936e0cef15ea02f8b799b65c6e7211146ac78","observation_id":"1a4911e6-8987-4f29-ab2e-d5238d93dd28","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:1010c02820cac340c576a9e9bee5a274b7c0eb2d64b1eb9072bc69c65a192094","observation_id":"2e281bf3-e528-476d-9b99-fbb250089064","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Depth anything v2.NeurIPS, 37:21875–21911, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:760ef66136ef5499209b199132e6ebd6f2e100a0c863bc94c3d2de03d5d899b1","observation_id":"2082148b-7a82-4e08-b4fa-c476b5204e19","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Masked generative distillation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:4f0a6adf4ff99d384635752d70d88dd4e4253dd66e9bad7d5270fa5e78fff582","observation_id":"9a3cd497-3b5b-4aea-9af7-434d6f12407a","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Drivesuprim: Towards precise trajectory selection for end-to-end planning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:ffce82eb8a9a363e7c89eb76511e85fa0f48d4ab62acb7679ebb90a48cbf42a1","observation_id":"c28b5851-02ec-4556-b4e0-f0de45a1c4c9","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Mvsnet: Depth inference for unstructured multi-view stereo","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:44d87d93807362b6109dedbd2f61951f9d5a218bedc9a1e4fe8569bd563873d3","observation_id":"5a42c5f2-ccfa-4b3e-977b-e546355c5912","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Flashocc: Fast and memory-efficient occupancy prediction via channel-to-height plugin.arXiv, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:cda7ed3e7617eae1d7e7eda6e916c09e5e17d90b779cd75f282233048a3ac863","observation_id":"b2a5dee9-da89-4b9d-8619-21eae83ef442","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Paying more attention to attention: Improving the performance of convolutional neural networks via attention transfer.arXiv, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:8c065cb15fd9b0b8ec0f767f7356305dffd9f766f6579d1198c228d3bb9bc894","observation_id":"a0334c93-add4-4ae0-8cc5-54fe8c53b74f","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"An efficient occupancy world model via decoupled dynamic flow and image-assisted training.arXiv, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:a488e1acdcd59d9389a798065c8c885470638dfea1b5af30e77d50512f37e23c","observation_id":"3fd2c200-6647-44b2-8d27-a3a7ede51795","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Epona: Autoregressive diffusion world model for autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:283c064e9dc3c6b1d08f8cec29479744c45e3c8f6ae702934841be31478eac57","observation_id":"64a199f6-5c56-4e35-928a-50bbe6c9d077","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Pointdistiller: Structured knowledge distillation towards efficient and compact 3d detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:1658ee6988550a81ffd55eb4cdc6d60c20a99d928db22623cb59d5d0ef913780","observation_id":"60f1f884-2bb9-4162-ad8c-1284832ba1ed","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Copilot4d: Learning unsupervised world models for autonomous driving via discrete diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:776e23bb6341c54f24ec424be710f3d5a7dab16a1eae18dd2ba4e495b26ea852","observation_id":"94dbd7ab-64b5-44c3-bdca-55ada4c81d0e","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Decoupled knowledge distillation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:e000c9f3eb82c41c53cabe08a694031da1d190eadbcdab9abfc5a683fa4412ae","observation_id":"92b0f049-6d67-4975-9f2b-07ed265d04b0","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"From forecasting to planning: Policy world model for collaborative state-action prediction.NeurIPS, 38:134585–134611, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:6fa0b5541ecd2d2a93f99af1b2e780c822f99a345730c00db972b49076916471","observation_id":"cbe9dd5c-2a49-4ba3-a819-60a3be53aa4f","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Unidistill: A universal cross-modality knowledge distillation framework for 3d object detection in bird’s-eye view","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:cfc0a8f54bd440726dd7d3ea8c40154b2449a7a4fce88965dddf29e240e3d189","observation_id":"cf074a29-c64c-4c8c-8ff1-f9f5b32fe95c","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Autovla: A vision-language-action model for end-to-end autonomous driving with adaptive reasoning and reinforcement fine-tuning.NeurIPS, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:2cc48326fe31af6a98737e99744068cb5e918d8edebc2107996cba2044b78bfc","observation_id":"c7f05f4d-8439-481d-9680-18357b58259e","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Dvgt: Driving visual geometry transformer.arXiv, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:51be6e23ed791eb2a15812d3bb5dec64f5bc582eca825b4357e3dff9e4962f76","observation_id":"3c166c52-89f7-4a9e-8136-915ca9da9cb4","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T02:36:49.451297Z","title":"Dvgt-2: Vision-geometry-action model for autonomous driving at scale.arXiv, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-28T02:36:49.451297Z"},"links":{"citing_paper":"/paper/2606.05774"},"observation_digest":"sha256:17a237263f86e25848e2099122352da743f367aed0915ea7800e861b887d317f","observation_id":"25f796ab-4c83-42eb-a8dc-1c08ca833f32","resolution":{"observed_at":"2026-06-28T02:36:49.451297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.05774","last_updated":"2026-06-04T06:58:44Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T15:15:41.417647Z","submitted_at":"2026-06-04T06:58:44Z","title":"LiAuto-GeoX: Efficient Grounded Driving Transformer"},"reference_resolution":{"displayed":87,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":86,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":87},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 87 of 87 outbound references and 0 inbound Pith citation observations for arXiv:2606.05774."}