{"as_of":"2026-08-05T09:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3b424d45584481f0b4d4ca60d4c14acc9a056470c646934e7af9529096c943f2","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T03:01:22.470554Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.19145/citation-record","integrity":"/paper/2604.19145/integrity","json":"/paper/2604.19145/citation-record.json","paper":"/paper/2604.19145"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Autonomous driving: cognitive construction and situation understanding.Science China Information Sciences, 62(8):81101","venue":null,"work_id":"b0c81375-9505-42ea-a323-939677ff89d9","year":2019},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:e20ce9ef459fd17d039a80c53fa7286db6258f54de887ba30a6182061a1fa0f9","observation_id":"5a873005-05e9-4b7b-813c-35631c17d155","resolution":{"observed_at":"2026-05-22T18:26:55.542442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advanced trajectory prediction framework integrating diverse driving styles for autonomous vehicles.Science China Information Sciences, 69(3):1–16","venue":null,"work_id":"e9bc5f71-01f4-4bdb-8b1f-8e99065edf71","year":2026},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:1706d34ee8d35ac55ddd1f2afa9a3a2ccb870e75101cb4fd8fc22c684bd23766","observation_id":"ebc3e750-90d1-49cb-9dd8-b146b1426fe6","resolution":{"observed_at":"2026-05-22T18:26:55.855557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trajectory planning and tracking control for vehicles with tire blowout in complex traffic flows.Science China Information Sciences, 68(3):132202","venue":null,"work_id":"7b65b82c-7af7-4622-84ef-98c7f688725f","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:642ec0aef9728990b501fc2fdd84accfea78516b37dffdef4c36500e0008b02a","observation_id":"2a1a8c28-bf03-462c-8bda-659fc0f91b0d","resolution":{"observed_at":"2026-05-22T18:26:55.857714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision language models in autonomous driving: A survey and outlook.IEEE Transactions on Intelligent Vehicles","venue":null,"work_id":"d6297370-66b0-4175-aa60-339f65ccfae5","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:604bf01261a366f98d028971965415891202b11ea64cf1384a900652911d4a3f","observation_id":"2fab4fc4-011c-4ac3-ac09-a160969784d9","resolution":{"observed_at":"2026-05-22T18:26:55.850630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large (vision) language models for autonomous vehicles: Current trends and future directions.IEEE Transactions on Intelligent Transportation Systems, 27(1):187–210","venue":null,"work_id":"534afa9a-7541-40ba-9a42-1c264c8fb978","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:8336a8322198a088eb3ea77f5650d641baacbd2ff0ea42568213733525dfc78c","observation_id":"8756bb6c-2b7a-454f-bc60-687ed67c2fc8","resolution":{"observed_at":"2026-05-22T18:26:55.546866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Enhancing scene understanding based on deep learning for end-to-end autonomous driving.Engineering Applications of Artificial Intelligence, 116:105474","venue":null,"work_id":"372afc0c-d625-46a6-92e1-c969aea87749","year":2022},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:d18d0fb119fc7733f1a0b2570f8863fa927328604ce6de2ffb137f064361a869","observation_id":"aaf81770-112c-4d77-a7e2-34056e4069fa","resolution":{"observed_at":"2026-05-22T18:26:55.544611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Predicting the road ahead: A knowledge graph based foundation model for scene understanding in autonomous driving","venue":null,"work_id":"9d7bbb02-244b-447b-860b-4e93fb1f1cd8","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:908ce9e37f372a154288780cf653d8d7dec754470b5952903b8d5ea2efd32e65","observation_id":"712660e6-c267-44f3-9962-fe3950ba111a","resolution":{"observed_at":"2026-05-22T18:26:55.853387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"319d1f8d-7ef8-4b05-9846-9c9e30096fde","year":2022},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:60f4c37c8a06a4563667ea571aec3327aeae468f1915144e1cbba0bbec8649de","observation_id":"a4b0a072-c135-417d-b920-d2358c51e479","resolution":{"observed_at":"2026-05-22T18:26:55.879536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rethinking closed-loop training for autonomous driving","venue":null,"work_id":"1b2f04b9-4454-464d-ae12-24b771308325","year":2022},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:7dad8e780a8b57fbcb5f917c9a3daf17d912613dcb5e08424869be538566d444","observation_id":"f4f995cb-3056-4bf7-a758-59ee6d0ea0df","resolution":{"observed_at":"2026-05-22T18:26:55.881723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bench2drive: Towards multi-ability benchmarking of closed-loop end-to-end autonomous driving.Advances in Neural Information Processing Systems, 37:819–844","venue":null,"work_id":"80392954-3633-48f8-94a3-d6048fd1c205","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:be4ee4978cceadc4733644d4bcae6d713c00cf2c330b0ba6a731610185c9d00b","observation_id":"614c26da-7a16-48d4-a955-66b8eb2ddb1e","resolution":{"observed_at":"2026-05-22T18:26:55.895812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neuroncap: Photorealistic closed-loop safety testing for autonomous driving","venue":null,"work_id":"08b8b3c8-b06d-46ca-b408-ae398ebec54f","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:8c8f42ebf006b038020dbe9316b301e391e66dbc106ca2c5ab0039d79e1b53ba","observation_id":"d200f5b3-fd86-4953-94e1-98f9fdad2570","resolution":{"observed_at":"2026-05-22T18:26:55.877496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A peek into Tesla’s autonomous future: Core tech revealed at ICCV 2025 WDFM-AD","venue":null,"work_id":"44110776-9d7c-4e5f-8de6-9aab21bda455","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:b7a6b05cae46a685feeb7e85f7f59376c57f99cde903e569fcf061cd3502a43a","observation_id":"70d6f7f8-50e3-45b2-b148-7a5b8c620499","resolution":{"observed_at":"2026-05-22T18:26:55.871526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Marius Zöllner","venue":null,"work_id":"2b57316b-7848-4f5d-9b70-23d9ebcde50a","year":2022},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:c99b860fbb2a8b0c4a18b19f9d66f2d094c35b8e2c10ed26b191d4e6aef021d4","observation_id":"508d202f-0fe8-4141-b1ec-52fb6908b9a2","resolution":{"observed_at":"2026-05-22T18:26:55.908822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An image is worth 1/2 tokens after layer 2: Plug-and-play inference acceleration for large vision-language models","venue":null,"work_id":"509aac56-9b4c-41dd-be52-4d25be39798f","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:c6e7390fc88141ce0602fd4b5694f560e7997322ead275151ba9d1575254a107","observation_id":"bd02eec9-22d0-4b10-9aac-7fa6ab207456","resolution":{"observed_at":"2026-05-22T18:26:55.910774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Token merging: Your ViT but faster","venue":null,"work_id":"400a6b4a-7ab9-4cbf-82e8-f99eb320dce7","year":2023},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:1e8df335f4df484839403c3b616a5eeed7b8599e73cd325ad4e48e3df4dfe8de","observation_id":"b30bbe10-6d20-40c1-b655-1cd960827f52","resolution":{"observed_at":"2026-05-22T18:26:55.902465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sparsevlm: Visual token sparsification for efficient vision-language model inference","venue":null,"work_id":"f6d6ae90-c510-4553-9631-a32f98b0127a","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:85a5f10e7fae3455fd716fefc14fa941acb1fad0c0669ba38ded060a8e15283c","observation_id":"8c707ee6-1c76-4134-bb33-7c74a24a7eed","resolution":{"observed_at":"2026-05-22T18:26:55.883928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11494","last_updated":"2025-06-08T08:35:58Z","snapshot_observed_at":"2026-07-06T20:37:37.864423Z","submitted_at":"2025-02-17T06:56:28Z","title":"Stop Looking for Important Tokens in Multimodal Language Models: Duplication Matters More","version":2},"cited_work":{"arxiv_id":"2502.11494","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.11494","snapshot_observed_at":"2026-07-02T21:37:24.192533Z","title":"Stop looking for important tokens in multimodal language models: Duplication matters more","venue":null,"work_id":"7e75ec79-7667-4044-b9eb-4a4f4723e639","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"cited_paper":"/paper/2502.11494","citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:f509591f9ee1fd646449a9ea9fa91164d92550cb694dd710e2cf4b5ea704947c","observation_id":"826d4e66-415c-4436-b9c2-2eb961143e53","resolution":{"observed_at":"2026-05-11T12:46:05.479873Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11501","last_updated":"2025-05-29T09:18:35Z","snapshot_observed_at":"2026-07-06T20:37:37.864423Z","submitted_at":"2025-02-17T07:05:36Z","title":"Token Pruning in Multimodal Large Language Models: Are We Solving the Right Problem?","version":2},"cited_work":{"arxiv_id":"2502.11501","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.11501","snapshot_observed_at":"2026-07-04T07:59:40.278596Z","title":"arXiv preprint arXiv:2502.11501 , year=","venue":null,"work_id":"e464475a-9870-43b1-8060-a9866dce6505","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"cited_paper":"/paper/2502.11501","citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:6dd52e61a9a8087df7619e178f509c6bbe39a4bfdb6630131d05811f8b09115c","observation_id":"aa650f97-d347-4b46-90c9-bc6bdeac4abf","resolution":{"observed_at":"2026-05-11T12:46:05.419065Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fastdrivevla: Efficient end-to-end driving via plug-and-play reconstruction-based token pruning","venue":null,"work_id":"8ebd2813-5e27-4c6a-8a92-c2f7fe08a355","year":2026},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:40fc746253567b6712ef095c365eff4e251cb05849f81fae91a545c58da1c7db","observation_id":"5a04a6f7-8b65-4c4f-ac67-0dab54ba489b","resolution":{"observed_at":"2026-05-22T18:26:55.863631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.13305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T21:37:24.178233Z","title":"Prune2drive: A plug-and-play framework for accelerating vision-language models in autonomous driving","venue":null,"work_id":"bae1c237-5913-4fad-9521-229d67284997","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:7d8f84c242111bb8480bf464989b771de90362e12a9c176b85af70363cdf27e3","observation_id":"b7e03b63-edac-4eb0-8c2c-bdbb44fab03c","resolution":{"observed_at":"2026-05-11T12:46:05.426208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.981576Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"1a247343-7abe-4143-8e5b-c906a73bcf37","year":2022},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:dcad039587fabd2f380e048b2da0b2c0a4764f39278f299fdef3f133dadb9922","observation_id":"f2d06f06-1715-41ec-b3f5-f8d05f1f1e33","resolution":{"observed_at":"2026-05-22T18:26:55.873674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Feedback is all you need: from chatgpt to autonomous driving.Science China Information Sciences, 66(6):1–3","venue":null,"work_id":"66584626-b673-45ef-a3fc-7e89b818b926","year":2023},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:f0542da34c817354d8d6ed5d4eb050acd378447611fc0d383ba9012ddad27dbd","observation_id":"50dcaec1-9fbf-44fa-91d3-080787456204","resolution":{"observed_at":"2026-05-22T18:26:55.865600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01415","last_updated":"2023-12-05T05:26:29Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:57Z","title":"GPT-Driver: Learning to Drive with GPT","version":3},"cited_work":{"arxiv_id":"2310.01415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.01415","snapshot_observed_at":"2026-07-10T00:46:40.273418Z","title":"GPT-Driver: Learning to Drive with GPT","venue":"cs.CV","work_id":"494d528c-1309-40da-a76e-b19cd26efb14","year":2023},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"cited_paper":"/paper/2310.01415","citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:8ede82b1419c36f1893f7862d0d060b6867e6d18399c77f68ca83c34cfe969be","observation_id":"ada2da64-d098-43d0-8f0f-07f7c8c8f5e2","resolution":{"observed_at":"2026-05-15T15:05:32.082062Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Driving with llms: Fusing object-level vector modality for explainable autonomous driving","venue":null,"work_id":"7ea0e9f6-63ee-425c-a146-0f0f2d413d88","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:1407af6ac8b2b2e222845cc9ee4c08b6336bfdc468b9ae0d29f098a32a9457d5","observation_id":"b9cf6316-c58c-4110-bedb-aa6ffe13d5d5","resolution":{"observed_at":"2026-05-22T18:26:55.893839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Waslander, Yu Liu, and Hongsheng Li","venue":null,"work_id":"3c9d0386-e6a3-4fa0-80d7-cec8f95ac3a6","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:76ee2bd9354629378a69c65c859a6dd2ea48f810ba50d22cd8c1ccdf587b6d0a","observation_id":"b25ab475-d7e9-40ba-a71b-271181ec2bef","resolution":{"observed_at":"2026-05-22T18:26:55.885741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22313","last_updated":"2024-10-29T17:53:56Z","snapshot_observed_at":"2026-07-31T01:16:26.372370Z","submitted_at":"2024-10-29T17:53:56Z","title":"Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2410.22313","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.22313","snapshot_observed_at":"2026-07-10T08:36:59.782338Z","title":"Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving","venue":"cs.CV","work_id":"d832f16e-83a0-4311-bc95-39727ba8ccb6","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"cited_paper":"/paper/2410.22313","citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:6b8f868f9bf627b4cd82165ac96ff745af02ca27eba2af1d5841e853c18d4430","observation_id":"8d494005-0a97-4a8b-83ed-700ebf0ccb71","resolution":{"observed_at":"2026-05-15T15:24:24.181007Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Meyer, Siva Karthik Mustikovela, Siddhartha Srinivasa, Eric M","venue":null,"work_id":"d7da39f9-30e9-4d80-b41a-94021b42a6d5","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:f5fd5c608468a9a58207ed7b2490a6a765e52315e3f5d7e0692a32a425704a49","observation_id":"9ce2ae32-ae69-4957-bb10-15472285ab45","resolution":{"observed_at":"2026-05-22T18:26:55.859576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Orion: A holistic end-to-end autonomous driving framework by vision-language instructed action generation","venue":null,"work_id":"51928e4c-649c-4ba4-8c4a-8aab34d4cae0","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:81b7228ae84807351552408170bb2cf08b0d495564a813eaa6c3fc168a448b8c","observation_id":"e97555d7-61c7-430f-9d3a-3a14ca1ba5ae","resolution":{"observed_at":"2026-05-22T18:26:55.861760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Covla: Comprehensive vision-language-action dataset for autonomous driving","venue":null,"work_id":"eeec5b18-8652-4ea1-8156-02a8e4f07614","year":1933},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:c55e31c39cb74ee0a15d9eec9c1080feccd4732560832d82f699522e656fd98e","observation_id":"b6737d63-492c-400d-abc0-0060355f7ca0","resolution":{"observed_at":"2026-05-22T18:26:55.904617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16278","last_updated":"2026-05-18T09:58:49Z","snapshot_observed_at":"2026-08-01T11:49:26.764186Z","submitted_at":"2025-05-22T06:23:04Z","title":"DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2505.16278","doi":"10.48550/arxiv.2505.16278","metadata_source":"pith","pith_arxiv_id":"2505.16278","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving","venue":"cs.CV","work_id":"4ac9d612-065c-475b-80c6-e307b1ae4128","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"cited_paper":"/paper/2505.16278","citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:e4a9ae030a37227175a42779c1bc96bf2581ff9728f7afa0001fc89228776b84","observation_id":"579ee4e2-ce4e-4d49-854c-ce843d13cc60","resolution":{"observed_at":"2026-05-20T00:05:28.917220Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-23T05:52:59.664485+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T05:52:59.664485+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.20794","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:49:42.162490Z","title":"arXiv preprint arXiv:2602.20794 (2026) 10","venue":null,"work_id":"c4ab65e5-d5a3-4ea0-bea1-71848086df12","year":2026},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:69a8163b626b03cc342fc6a9c17f6305c0f8e9ddfebf3bbcd7c4039b2ab3601d","observation_id":"d91bbb87-96c7-40e4-8f6a-878b311f790c","resolution":{"observed_at":"2026-05-11T12:46:05.441083Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mpdrive: Improving spatial understanding with marker-based prompt learning for autonomous driving","venue":null,"work_id":"91353cea-be42-43f4-a019-0367706eb679","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:8d5be1ffe2d05942698f06944e66ce9eeaac70bd2d0019953df7f5a4fcc0bb65","observation_id":"46c5db47-f1f7-4848-9ebe-20c11a6d5583","resolution":{"observed_at":"2026-05-22T18:26:55.888027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.10719","last_updated":"2026-07-12T18:02:23Z","snapshot_observed_at":"2026-08-03T17:07:38.286115Z","submitted_at":"2025-12-11T14:59:07Z","title":"SpaceDrive: Infusing Spatial Awareness into VLM-based Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2512.10719","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.10719","snapshot_observed_at":"2026-07-05T11:41:02.546151Z","title":"SpaceDrive: Infusing Spatial Awareness into VLM-based Autonomous Driving","venue":"cs.CV","work_id":"bcc054b3-d176-439e-b728-eaf20b134494","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"cited_paper":"/paper/2512.10719","citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:5d59a8177585c1bde5bf5bd8e6bcaf91448e2ad64200ab6850108f9d1d48b52a","observation_id":"ba834003-4110-44f5-84df-664a4c6c407a","resolution":{"observed_at":"2026-05-22T02:03:27.523663Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reason2drive: Towards interpretable and chain-based reasoning for autonomous driving","venue":null,"work_id":"4aba8dbb-216c-4247-8189-0368f269120c","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:50a91a033293a6ed158056955c6646566f2b8d23f4352988a67193a1a26d31af","observation_id":"29ef0f31-60b5-4c5c-b815-cb3677c64b37","resolution":{"observed_at":"2026-05-22T18:26:55.869686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.11041","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DynVLA: Learning world dynamics for action reasoning in autonomous driving","venue":null,"work_id":"783dac49-0c4d-4524-bf15-d0ffdae1828d","year":2026},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:97c1955c489e058bd911f19bfee5453d4ecf65b8a62832d7f8a21d43700cc47d","observation_id":"cf7721f2-1a1c-4da4-b0e2-82f3090e2206","resolution":{"observed_at":"2026-05-11T12:46:05.511201Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.02864","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:29:38.018228Z","title":"Accelerating structured chain-of-thought in autonomous vehicles.arXiv preprint arXiv:2602.02864","venue":null,"work_id":"1fc49f02-04ae-4fef-bb74-ed5d66638be9","year":2026},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:98ebe56b4727e850cfc68707cd32556a011005424b780d827332bf5ede90740e","observation_id":"f095c9db-1d57-4f2d-8928-cd46f1b08821","resolution":{"observed_at":"2026-05-11T12:46:05.517998Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07689","last_updated":"2025-08-07T06:38:32Z","snapshot_observed_at":"2026-07-06T20:04:48.422043Z","submitted_at":"2024-12-10T17:27:32Z","title":"RoboTron-Drive: All-in-One Large Multimodal Model for Autonomous Driving","version":5},"cited_work":{"arxiv_id":"2412.07689","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.07689","snapshot_observed_at":"2026-07-05T11:41:02.524680Z","title":"Drivemm: All-in-one large multimodal model for autonomous driving","venue":null,"work_id":"14e301af-a22f-4836-9877-84b297291938","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"cited_paper":"/paper/2412.07689","citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:9a542a8aebe94d2cdf6ebb55edc7a739bc9034bdef4ad42e22ecd225e6cc3be8","observation_id":"cfcaa20e-9a76-4de4-82db-18d8d45e2b6c","resolution":{"observed_at":"2026-05-11T12:46:05.462818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Divprune: Diversity-based visual token pruning for large multimodal models","venue":null,"work_id":"16dfaa36-8c9d-4937-b77c-b835496004d3","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:9e3993a0981c8ce889c656c5590348fa9ee6b1950357c6aed418d4c8c6964bbe","observation_id":"27e5ef07-84f4-480f-999f-24b9fd66755c","resolution":{"observed_at":"2026-05-22T18:26:55.915160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beyond text-visual attention: Exploiting visual cues for effective token pruning in vlms","venue":null,"work_id":"18547f22-edf0-4159-8d47-242d148149c2","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:d922c94671392ab5a6fd6c123b1f0ba7c64f31395abb2b4faa72ea0679c44cd0","observation_id":"7b43d87c-edab-490f-ac59-713155f0c0c1","resolution":{"observed_at":"2026-05-22T18:26:55.891807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pact: Pruning and clustering-based token reduction for faster visual language models","venue":null,"work_id":"2322e7be-fe3f-420f-a68d-246166188ff3","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:65acfdbe7852e9eab4c2570e194398b1a549b296c028a46c4d874705b92c2fe3","observation_id":"c461c981-5028-4e38-a399-77eade894741","resolution":{"observed_at":"2026-05-22T18:26:55.912768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":"99a2b9af-383b-424a-89c0-d68f3ce717aa","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:d9d41a0079fe71917cef9fc279e5e92a7e86d034cfdc2e0c69e1c47e4ca24c42","observation_id":"2eb060c9-00a5-4657-b91e-0886bd3e132e","resolution":{"observed_at":"2026-05-22T18:26:55.867435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lingoqa: Visual question answering for autonomous driving","venue":null,"work_id":"2b1bf9f2-9b10-4f7a-9444-128523f8ba99","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:2d715c41d2a7accbb774a15ba43f2a1eff9874ae372c47b9df36c8bd903c231c","observation_id":"3494b704-9085-405c-b089-09bdf12791f4","resolution":{"observed_at":"2026-05-22T18:26:55.897901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T12:44:53.800908Z","title":"Holistic autonomous driving understanding by bird’s-eye-view injected multi-modal large models","venue":null,"work_id":"014eed05-291e-42c6-8d21-9b372c5d9b4b","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:fd6a39021864146b5a9fb11a297b4629c52da5a4df2275ac90f3115bb1b23c66","observation_id":"5b1d436a-979e-406e-9ab3-76403a9fcfe8","resolution":{"observed_at":"2026-05-22T18:26:55.900462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cda38793-3221-49d6-a1c6-719546f7ca74","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:540a7506c845c19431729c30f4c0c610b03a24610d97ebd28b3c008800a001fe","observation_id":"cc38bf08-196e-49b7-ab37-5ab96d1585c1","resolution":{"observed_at":"2026-05-22T18:26:55.875436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"c7cc513d-ecda-4e7a-bb67-b33fc807bdaf","year":2023},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:0b7ec8735d010002f7dd60d0988968be9785f046797806f7492440deedcfef9b","observation_id":"e2cad3b0-9673-453b-8cda-82ca2031a52a","resolution":{"observed_at":"2026-05-22T18:26:55.906727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:b447ed1a2b45f754354778453f7bfdeea6df4b1c57d6a411eb337feb8d4e0641","observation_id":"7c0225dd-5366-4e44-976c-f94f2758e0d7","resolution":{"observed_at":"2026-05-11T12:46:05.455242Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen3-vl technical report","venue":null,"work_id":"ff601ee7-29a7-420c-bf9e-d332b4f617ce","year":2025},"citing_paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T03:01:22.470554Z"},"links":{"citing_paper":"/paper/2604.19145"},"observation_digest":"sha256:58cf85b4f68bd308c4b8393e4d12f32cf094307db4192b0eb3a350bee092406c","observation_id":"9698e0a4-9060-4735-a5ad-ab07abb6f2e1","resolution":{"observed_at":"2026-05-22T18:26:55.889852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.19145","last_updated":"2026-04-21T06:51:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:51:08Z","title":"ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":12,"verified_fuzzy":33},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2604.19145."}