{"as_of":"2026-08-08T11:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:38736685ebc3f1e1ed90472a12a3a979c03c30546d659fa187fd3374eeb6e202","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:17:59.256014Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.15564/citation-record","integrity":"/paper/2505.15564/integrity","json":"/paper/2505.15564/citation-record.json","paper":"/paper/2505.15564"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:56.835309Z","title":"Meteor: An automatic metric for mt evaluation with improved correlation with human judgments","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:56.835309Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:362b2a5104a442770ceb1a2b435566b210a9dd9079addaa3df54b8131ff660e1","observation_id":"7e64a61a-71e6-4e4c-be3f-662eaad4cd16","resolution":{"observed_at":"2026-08-07T15:17:56.835309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:56.901743Z","title":"Driving with llms: Fusing object-level vector modality for explainable autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:56.901743Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:7cfa824b75f362dfc9dfff4e3d07d3cae4f33dddb7ba8afe136183936e1736df","observation_id":"9fcf04d0-5c10-4474-ad28-1cc727abe1e1","resolution":{"observed_at":"2026-08-07T15:17:56.901743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:57.011789Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.011789Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:e70966514e487edf14e4aeacec2a498fee8dbc5a786893624436ccfe14f99be9","observation_id":"81a3509f-7c9f-4fdd-aaf2-f1548c93f254","resolution":{"observed_at":"2026-08-07T15:17:57.011789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:18:00.428430Z","title":"Unireplknet: A universal perception large-kernel convnet for audio video point cloud time-series and image recognition","venue":null,"work_id":"c0ed4c53-4843-4fcc-9b4b-bc1bc3e69e76","year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.103782Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:4962066ea1f0ef882128e7cfcbfb6e9695350ee71d2e66404853af2ca260859e","observation_id":"4d7fa30c-2bd9-4463-bbe5-4840fa556a73","resolution":{"observed_at":"2026-08-07T15:18:00.548670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T15:17:57.217357Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.217357Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:acf38ef43ce5332f71b5ba72e2bb9cf08cd383f1ecc4f88e83f46e495c510329","observation_id":"ab96dcd8-ffb9-4d12-b42c-18ca802dfe8b","resolution":{"observed_at":"2026-08-07T15:17:57.217357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19838","last_updated":"2024-05-09T03:27:44Z","snapshot_observed_at":"2026-07-06T17:52:50.835744Z","submitted_at":"2024-03-28T21:18:33Z","title":"Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19838","snapshot_observed_at":"2026-08-07T15:17:57.316187Z","title":"Multi-frame, lightweight & effi- cient vision-language models for question answering in autonomous driving.arXiv preprint arXiv:2403.19838, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.316187Z"},"links":{"cited_paper":"/paper/2403.19838","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:6370eebf31707d6b6cc2c761babf81a1dc02539c54739917307c92ae1dac74a0","observation_id":"b2f4eb50-3c55-4160-9cd0-11feb99c8957","resolution":{"observed_at":"2026-08-07T15:17:57.316187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:18:00.239221Z","title":"World models for autonomous driving: An initial survey.IEEE Transac- tions on Intelligent Vehicles, 2024","venue":null,"work_id":"514ad96e-f6e3-498f-a816-325ab1c0f226","year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.433962Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:c75fef81cdcfe2b90016d78562f49e40378adb06b6602607679f7889b46111b2","observation_id":"cc0523e0-2561-4f4f-b7aa-3b56e31c720e","resolution":{"observed_at":"2026-08-07T15:18:00.317010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:18:00.092402Z","title":"Traffic navigation via reinforcement learning with episodic-guided prioritized experience replay.Engineering Applications of Artificial Intelligence, 137:109147, 2024","venue":null,"work_id":"2cd3a674-a485-469d-882f-b733812daf1a","year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.551778Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:69a10963a06c4ca6d24439fc61dd8b1af27dee9e2222ab08055d0b6a563ad097","observation_id":"b2b65d36-4d46-468f-86a0-ccaf1d90e4bd","resolution":{"observed_at":"2026-08-07T15:18:00.157213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:57.647411Z","title":"Lora: Low-rank adaptation of large language models.ICLR, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.647411Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:eea6525d65249cfd95718fd057a8f14f3d99e2a0c6a346eaec698e1bd930fa45","observation_id":"b04098d7-837d-45e3-a4fc-b6e2d66c5290","resolution":{"observed_at":"2026-08-07T15:17:57.647411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:57.745932Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.745932Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:35045b7762857b7c8484c4010f3a21361b3d9b6936e27263946a0109284fc122","observation_id":"adfe776a-2b93-459c-bea3-9178be04ecea","resolution":{"observed_at":"2026-08-07T15:17:57.745932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:57.847632Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.847632Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:58672b24c1ac02f2d67e426523969da459b9ae21596d4a26f440f4889b56de44","observation_id":"d2070f02-8942-400b-9e08-059f04560599","resolution":{"observed_at":"2026-08-07T15:17:57.847632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01415","last_updated":"2023-12-05T05:26:29Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:57Z","title":"GPT-Driver: Learning to Drive with GPT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01415","snapshot_observed_at":"2026-08-07T15:17:57.963862Z","title":"Gpt-driver: Learning to drive with gpt.arXiv preprint arXiv:2310.01415, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.963862Z"},"links":{"cited_paper":"/paper/2310.01415","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:d5798ea7a8138bf9d6aee07668be00d598ee7903073dbb048df338b2b45c0ebf","observation_id":"0a2f6351-13b5-45ad-b891-946d01fd4e1a","resolution":{"observed_at":"2026-08-07T15:17:57.963862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.079631Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.079631Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:911752fbd7a6d709109d1eaab0d9144df4d189459db23d71fccc3b926f69cc6e","observation_id":"ec07915b-3b97-4055-9e13-3edc38e08fb6","resolution":{"observed_at":"2026-08-07T15:17:58.079631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.166227Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.166227Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:7db0f246742cdb4d5ee20b6e44a45665fc30e11473c1718ceba8a297574384c1","observation_id":"e5cecba8-b8b8-4b7f-ab72-1511ade3589c","resolution":{"observed_at":"2026-08-07T15:17:58.166227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.253854Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer.Journal of machine learning research, 21(140):1–67, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.253854Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:d409d5606ec631bbd118a5107de94a2a674e914a90cc7deef07ffa2c5fa59459","observation_id":"854273ff-82f1-4696-8c80-7089090e3d75","resolution":{"observed_at":"2026-08-07T15:17:58.253854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03026","last_updated":"2025-04-15T03:45:30Z","snapshot_observed_at":"2026-07-06T16:27:51.438846Z","submitted_at":"2023-10-04T17:59:49Z","title":"LanguageMPC: Large Language Models as Decision Makers for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03026","snapshot_observed_at":"2026-08-07T15:17:58.371824Z","title":"Languagempc: Large language models as decision makers for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.371824Z"},"links":{"cited_paper":"/paper/2310.03026","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:a5d747e71284b6f14f2e939e8ed033b482b6a11a0d180eee7032312174a537f9","observation_id":"4cf5fb0e-f5f1-4926-b229-8a9391362416","resolution":{"observed_at":"2026-08-07T15:17:58.371824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.471551Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.471551Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:e13c46baba6380f1fc56b5295d7bb9d7756b6dc9eb75a12e9a4c13d6828935ae","observation_id":"8e0f5c14-2aa7-4af8-94d3-8c6fac8f143c","resolution":{"observed_at":"2026-08-07T15:17:58.471551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T15:17:58.583992Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.583992Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:798f096ae6297d223f018112e9eb9c84b7a8b0ec87ed76d6a72a65a022ff8ef1","observation_id":"818514c7-db8a-4eb1-8b44-4a4c8fece003","resolution":{"observed_at":"2026-08-07T15:17:58.583992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:59.839708Z","title":"Labelimg.https://github.com/tzutalin/labelImg, 2015","venue":null,"work_id":"c97ab440-e8c0-4bf5-9e79-1c1a6a4d426c","year":2015},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.674118Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:80d32c325e50859b3d0440fa42d7112d5813a754f18ae43204db2c107e4d2456","observation_id":"a3677b2e-4668-492c-89d9-238c65436696","resolution":{"observed_at":"2026-08-07T15:17:59.896190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.773109Z","title":"Cider: Consensus-based image description evaluation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.773109Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:c3a8906f528509876271fa702c9d3cf5d0c02d10b9500b35a43267aeed89f665","observation_id":"a7584999-7d05-4416-959c-c21d1714d41a","resolution":{"observed_at":"2026-08-07T15:17:58.773109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.860998Z","title":"Drivemlm: Aligning multi-modal large language models with behavioral planning states for autonomous driving.arXiv preprint arXiv:2312.09245, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.860998Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:d86500f2e9f0df60b83f711c4f3465e0aae228b67d850ca0e44f33ca051dda69","observation_id":"321dd4d7-77df-4d14-b9b0-03308254573f","resolution":{"observed_at":"2026-08-07T15:17:58.860998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.960626Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.960626Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:01b7ab2ebc384b2f2220857fc0c9422a906fb2780e66137bdf7db9db94636c5b","observation_id":"158be957-8fc6-47e6-b41e-b78894c8eee9","resolution":{"observed_at":"2026-08-07T15:17:58.960626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:59.055207Z","title":"Drivegpt4: Interpretable end-to-end autonomous driving via large language model.IEEE Robotics and Automation Letters, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:59.055207Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:7bd105dc21a467a26a559182beea63fe5a3ca4035d02c551426416d6714bc4df","observation_id":"3b28f699-4774-45af-84c4-92122cd40474","resolution":{"observed_at":"2026-08-07T15:17:59.055207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07267","last_updated":"2025-05-21T08:38:11Z","snapshot_observed_at":"2026-07-06T19:13:46.489307Z","submitted_at":"2024-09-11T13:43:01Z","title":"MiniDrive: More Efficient Vision-Language Models with Multi-Level 2D Features as Text Tokens for Autonomous Driving","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07267","snapshot_observed_at":"2026-08-07T15:17:59.143731Z","title":"Minidrive: More efficient vision-language models with multi-level 2d features as text tokens for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:59.143731Z"},"links":{"cited_paper":"/paper/2409.07267","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:a4be05f8723e028030473f70b6f35b7fac9531d8a9a878d6698ce86f10a6155d","observation_id":"5d47526d-1234-42ab-842b-a39c6969ca53","resolution":{"observed_at":"2026-08-07T15:17:59.143731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:59.590712Z","title":"Vision language models in autonomous driving: A survey and outlook.IEEE Transactions on Intelligent Vehicles, 2024","venue":null,"work_id":"99465c72-f99c-49a8-ae38-9fef33e5e899","year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:59.256014Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:29298130052e6fd25dcac68bcb84931cb3265172e1d6e12bf6abeb7858c68094","observation_id":"55bd7cbd-df46-461e-9fdd-0238a9df4391","resolution":{"observed_at":"2026-08-07T15:17:59.667823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2505.15564."}