{"as_of":"2026-08-06T17:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:74f97c4afedcd93b3e6d4c8fb7f2a187a07fd77d3800eb629a8c45e1be8627cc","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:57:51.274097Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T14:36:51.973330Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T14:38:21.554254Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"cited_work":{"arxiv_id":"2508.01057","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.01057","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Edge-based multimodal sensor data fusion with vision language models (vlms) for real-time autonomous vehicle accident avoidance","venue":null,"work_id":"919f9be5-cb4e-4b0a-bbcc-ca20ec09aad9","year":2025},"citing_paper":{"arxiv_id":"2605.17123","last_updated":"2026-05-16T19:04:09Z","snapshot_observed_at":"2026-07-06T23:28:12.114488Z","submitted_at":"2026-05-16T19:04:09Z","title":"ATRACT: A Trustworthy Robotic Autonomous system to support Casualty Triage","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T14:36:51.973330Z"},"links":{"cited_paper":"/paper/2508.01057","citing_paper":"/paper/2605.17123"},"observation_digest":"sha256:9ca28ab5cdea135e0c4053e09e7126c83c3f782b134008b73c18c8bb81a0e6da","observation_id":"4256e484-026b-4d74-8f21-533e2049c800","resolution":{"observed_at":"2026-05-20T14:38:21.556024Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.01057/citation-record","integrity":"/paper/2508.01057/integrity","json":"/paper/2508.01057/citation-record.json","paper":"/paper/2508.01057"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.735812Z","title":"Road traffic injuries fact sheet,","venue":null,"work_id":"bb8a7356-2d0d-4ea8-b866-05ff91514925","year":2023},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:50.971291Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:1cdc78268249b56be2d344c1d6ea74761022345baa0fe5cb728dbe814b7af8f2","observation_id":"5c3c0bb5-df86-400f-890c-cfa406e35d02","resolution":{"observed_at":"2026-08-06T05:57:52.740324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.721639Z","title":"Traffic safety facts 2023: A compilation of motor vehicle traffic crash data (annual report),","venue":null,"work_id":"c6ab80cb-3d51-4ab5-8831-e97283778e4a","year":2023},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:50.976118Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:13209094b71a0fe83196e265a39d5a91f1617d76c92330d9c00aab1cf27d39c6","observation_id":"26d76a3d-7d91-412f-8c81-382a0868b8c0","resolution":{"observed_at":"2026-08-06T05:57:52.725996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.707052Z","title":"Distracted driving: Cdc transportation safety,","venue":null,"work_id":"c7b6671b-08ab-431c-af7b-89e49432f410","year":2023},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:50.980346Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:eb1db5941a8e34e8568204d011f8eedef29d38eb78db37a2cc45a0503de3174c","observation_id":"7ba83132-168c-41e2-8549-3e6639176e6c","resolution":{"observed_at":"2026-08-06T05:57:52.711305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.692850Z","title":"Why anticipatory sensing matters in commercial acc systems under cut-in scenarios: A perspective from stochastic safety analysis,","venue":null,"work_id":"51f6df39-9ca9-4418-a010-06cf83536bd9","year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:50.984969Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:df547fc7434e9e309fad2ac5b91c77b56846e0f95ec8be9590bfd2a9cb1bf1cf","observation_id":"d235685b-0037-407c-b79c-ac11b5a6a7dd","resolution":{"observed_at":"2026-08-06T05:57:52.697287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03525","last_updated":"2025-09-02T07:47:30Z","snapshot_observed_at":"2026-07-06T16:28:14.315624Z","submitted_at":"2023-10-05T13:19:48Z","title":"Vehicle-to-Everything Cooperative Perception for Autonomous Driving","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03525","snapshot_observed_at":"2026-08-06T05:57:50.989343Z","title":"V2x cooperative perception for autonomous driving: Recent advances and challenges,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:50.989343Z"},"links":{"cited_paper":"/paper/2310.03525","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:e37d1bc4e8c3fa033f36f314ab6f5d8f939b792fb332d3f1bff142de65ea3186","observation_id":"ad7a5458-0fb9-4f77-ad1a-b51914afaf86","resolution":{"observed_at":"2026-08-06T05:57:50.989343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21743","last_updated":"2025-05-27T20:33:07Z","snapshot_observed_at":"2026-07-06T21:31:44.786368Z","submitted_at":"2025-05-27T20:33:07Z","title":"Simulating the Unseen: Crash Prediction Must Learn from What Did Not Happen","version":1},"cited_work":{"arxiv_id":"2505.21743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21743","snapshot_observed_at":"2026-08-06T05:57:52.119906Z","title":"Simulating the Unseen: Crash Prediction Must Learn from What Did Not Happen","venue":"cs.LG","work_id":"55cf534f-9d94-4817-85b6-0df1fdd6dda7","year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:50.994073Z"},"links":{"cited_paper":"/paper/2505.21743","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:4b20ed43f1ce3573d336d04999cc14bbc972b8aa4b71798342794812ecf83d57","observation_id":"6dc7cd5e-0d55-4ae8-98ce-17b43a2d51bd","resolution":{"observed_at":"2026-08-06T05:57:52.124331Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.678400Z","title":"Advancing vulnerable road users safety: Interdisciplinary review on v2x communication and trajectory prediction,","venue":null,"work_id":"10582b0e-9f9a-4aec-b931-fe26b55a7b3c","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:50.999585Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:c702b37ad510a55d2956306cd6d644db8fcbb8fc87bd0df6bf7b8b2b854724fa","observation_id":"fca59393-0a7c-48b7-80e7-301a3506fb16","resolution":{"observed_at":"2026-08-06T05:57:52.682976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:51.004171Z","title":"Transformers in vision: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.004171Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:e7e029ed2d64dfedd597bfd35e469fbeb8dadc7c4c945072febbef486845c5c4","observation_id":"47ee20c5-f7f5-4f2e-bcfc-be7b2dc753df","resolution":{"observed_at":"2026-08-06T05:57:51.004171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.652867Z","title":"Do vision transformers see like con- volutional neural networks?,","venue":null,"work_id":"83333009-47d5-4b85-8e15-03138d8f8868","year":2021},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.008342Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:f7520474a50cf92b76507909555c65c962d12e40af3fc4b483532ae440a107eb","observation_id":"733e2820-2a95-4931-89ef-9f1014ca8b52","resolution":{"observed_at":"2026-08-06T05:57:52.657930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.638022Z","title":"Cmoa: Contrastive mixture of adapters for generalized few-shot continual learning,","venue":null,"work_id":"aae24389-1928-4b98-b74f-9d0195a5858e","year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.012332Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:6166e08c2045e480cdb1f6b4fc900a4cfbe5dfffe465400d9e58a6bbe58d3216","observation_id":"b9f393c1-3e50-44b9-8f1c-883478c5e55d","resolution":{"observed_at":"2026-08-06T05:57:52.642610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.623440Z","title":"Decision-making driven by driver intelligence and environment reasoning for high-level autonomous vehicles: a survey,","venue":null,"work_id":"cf315bb7-32e8-4738-8691-6dfd59f19eee","year":2023},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.016878Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:5729d0c74bf1462e6ae8c49343b74cb14f742a73e9d9fb7bdb112b617b46005c","observation_id":"381cb235-4979-4727-8cef-4f17d174c890","resolution":{"observed_at":"2026-08-06T05:57:52.627804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.608334Z","title":"Summary and reflections on pedestrian trajectory prediction in the field of autonomous driving,","venue":null,"work_id":"c17ab331-6f5e-41d5-be95-cecd84889da0","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.021224Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:244921de39ef7e72e0d4149919bf5870ccbf9cb319f369fc34fc1fb27cac6a25","observation_id":"47b21a57-f9fd-4c4c-b529-d29350f07af6","resolution":{"observed_at":"2026-08-06T05:57:52.612893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.593836Z","title":"A review on explainability in multimodal deep neural nets,","venue":null,"work_id":"cfa6f6ea-751c-4c2c-b71e-a4072898492a","year":2021},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.025295Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:be1045776a8f1f6ca13bec61652dc05209b1113e82939e2550e4ea6ac06e5064","observation_id":"de16bae4-21ab-477d-b998-709511f34874","resolution":{"observed_at":"2026-08-06T05:57:52.598280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.579583Z","title":"Large language models and multimodal foundation models for precision oncology,","venue":null,"work_id":"e21ce218-fc91-4ed3-a56f-424e405fafcd","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.029635Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:efcfa96b725fd1d3bf3a5d8deb6eb500f65874f1d8cb4c9286d00cc3c5c87691","observation_id":"245e969b-8929-476c-a843-18cfe8dbfecc","resolution":{"observed_at":"2026-08-06T05:57:52.584036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:51.033657Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.033657Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:6bcd8ea0936fdac8e5ea29e083f75456a88ec506b422c9bb51869a6a74ec7033","observation_id":"0ae058ce-5e02-4b24-a7d2-aab0b8dd63bb","resolution":{"observed_at":"2026-08-06T05:57:51.033657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08854","last_updated":"2025-05-13T17:59:20Z","snapshot_observed_at":"2026-08-04T03:27:20.240366Z","submitted_at":"2025-05-13T17:59:20Z","title":"Generative AI for Autonomous Driving: Frontiers and Opportunities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08854","snapshot_observed_at":"2026-08-06T05:57:51.037642Z","title":"Generative ai for autonomous driving: Frontiers and opportunities,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.037642Z"},"links":{"cited_paper":"/paper/2505.08854","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:6f4fc80828d9964b51cb3b1873f2d6f117c23e0884018de7ed0238806beec2df","observation_id":"1ce04a17-3c58-4367-ad62-395bb2c71e54","resolution":{"observed_at":"2026-08-06T05:57:51.037642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.555594Z","title":"Frontiers of emerging ai technologies best practices and workforce develop- ment in transportation: Nsf ai–transportation workshop phase ii,","venue":null,"work_id":"6b1b7e3e-fe68-4b4e-8c29-f30169e5cb8a","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.042348Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:d14083fe55347e96e3905f7d8da03484a3b482f95c1e6c989b3c4d71757b6bfc","observation_id":"fb8c95b6-fbc2-4b1a-ae8f-3ae2bb9f47e4","resolution":{"observed_at":"2026-08-06T05:57:52.560119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17968","last_updated":"2025-04-24T22:27:59Z","snapshot_observed_at":"2026-07-06T21:14:28.688897Z","submitted_at":"2025-04-24T22:27:59Z","title":"Virtual Roads, Smarter Safety: A Digital Twin Framework for Mixed Autonomous Traffic Safety Analysis","version":1},"cited_work":{"arxiv_id":"2504.17968","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.17968","snapshot_observed_at":"2026-08-06T05:57:52.083857Z","title":"Virtual Roads, Smarter Safety: A Digital Twin Framework for Mixed Autonomous Traffic Safety Analysis","venue":"cs.RO","work_id":"1e83b700-2791-4227-9f4f-d6e0a1eef6bd","year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.046322Z"},"links":{"cited_paper":"/paper/2504.17968","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:c516f2a7e1a04b37b195e6d6a03d911010f10fa025a9331e282f3d367af56c24","observation_id":"d0d82861-c0b5-4492-9690-875d2632a9cd","resolution":{"observed_at":"2026-08-06T05:57:52.088555Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06805","last_updated":"2024-01-18T07:31:47Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-10T15:29:21Z","title":"Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06805","snapshot_observed_at":"2026-08-06T05:57:51.050490Z","title":"Exploring the reasoning abilities of multimodal large language models (mllms): A comprehensive survey on emerging trends in multimodal reasoning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.050490Z"},"links":{"cited_paper":"/paper/2401.06805","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:08ab99b8a71987e9353064179c5a7ce8721b582bb15ecc998dea9c053e6c76d5","observation_id":"5ab7640e-addd-4be7-b2f4-2910d7d78817","resolution":{"observed_at":"2026-08-06T05:57:51.050490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.542251Z","title":"A self-supervised multi-agent large language model framework for customized traffic mobility analysis using machine learning models,","venue":null,"work_id":"793ce4e2-fbc4-431f-8b23-e9c82242e73f","year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.055143Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:a572008bdb7b54addeffec58f9d55ab956ca4405ed977abc419ca17c313545f9","observation_id":"906b4383-93d9-4b74-8047-488746130e90","resolution":{"observed_at":"2026-08-06T05:57:52.546470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.527415Z","title":"Vision-language models in remote sensing: Current progress and future trends,","venue":null,"work_id":"b53e679f-b0c3-45b6-8fcb-77d53cf69256","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.059076Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:c503ac9e59c6981cb09e6f5526b710999b659fd04daa63db491d8e8cfaeff3c8","observation_id":"aabcd771-d3cf-46e2-856c-f9ac3b103457","resolution":{"observed_at":"2026-08-06T05:57:52.532049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09251","last_updated":"2025-06-19T05:02:13Z","snapshot_observed_at":"2026-07-06T19:01:58.598116Z","submitted_at":"2024-08-17T16:42:13Z","title":"V2X-VLM: End-to-End V2X Cooperative Autonomous Driving Through Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09251","snapshot_observed_at":"2026-08-06T05:57:51.063058Z","title":"V2x-vlm: End-to-end v2x cooperative autonomous driving through large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.063058Z"},"links":{"cited_paper":"/paper/2408.09251","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:9d52574bb36e6bda72f3205a87c157abd44c025371cbc453761f920e88b6008d","observation_id":"6460ee49-033c-4ed3-ac1c-fbb9ca9201cb","resolution":{"observed_at":"2026-08-06T05:57:51.063058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.02580","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.029477Z","title":"V2x-unipool: Unifying multimodal perception and knowledge reasoning for autonomous driving,","venue":null,"work_id":"68aa52d5-8cee-42ce-9af6-d7e024496880","year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.067303Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:cdddebfe01593378e1b150da935ee3f2b7905b343a1aff0d86a3c2cab36e84da","observation_id":"b160a759-23ea-49da-9978-13a387a4190c","resolution":{"observed_at":"2026-08-06T05:57:52.037700Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.514023Z","title":"Improved zero-shot classification by adapting vlms with text descriptions,","venue":null,"work_id":"20a406a2-1ff4-4f6a-baa3-9f13fa974e3a","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.071212Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:64fb76e1a9a82b46855ab8538a9b5bdf6a0821baf10916529882cae03dad58f9","observation_id":"6e899223-e093-4a4e-b231-98ac2934c547","resolution":{"observed_at":"2026-08-06T05:57:52.518354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.500356Z","title":"Ez-hoi: Vlm adaptation via guided prompt learning for zero-shot hoi detection,","venue":null,"work_id":"6f1b1f80-83ac-404e-b373-240a7429ab90","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.075036Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:2ff21601aee1a2836ef6c1325991cc6133c3ae04139d47fe9ac312b8ae2a8572","observation_id":"9b3280f3-58b4-4a0d-aef6-bc465ae0b1e8","resolution":{"observed_at":"2026-08-06T05:57:52.504408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.486086Z","title":"Interpreting black-box models: a review on explainable artificial intelligence,","venue":null,"work_id":"f39e7c54-7c47-4334-9d47-40902f714771","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.078905Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:5be6bad72012c0fc3d63385da16733d32df466ccfa8c82d126f14d416ca4b5d8","observation_id":"ee1eb027-3985-4daa-9d40-99652f547089","resolution":{"observed_at":"2026-08-06T05:57:52.490487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.472047Z","title":"Explainable ai: A brief survey on history, research areas, approaches and challenges,","venue":null,"work_id":"a6ef32e8-f747-4c6b-94d2-1495c57242a7","year":2019},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.082830Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:cea00e66371ae85271c121873186a372ef8f613fc54929116106520bff696b2c","observation_id":"fe8adc7f-dd7e-4e6d-b424-9d88e01d275c","resolution":{"observed_at":"2026-08-06T05:57:52.476590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.458120Z","title":"Edge intelligence empowered vehicle detection and image segmentation for autonomous vehicles,","venue":null,"work_id":"c47addcc-dadc-43bc-acd6-fa3b809b1efb","year":2023},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.087075Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:707028e052e948485cfa81ca4e48855ca15e9b44c6539277a7d44d2b1ecac37c","observation_id":"40161c8f-45a1-4a60-9805-3fe9eaa1a790","resolution":{"observed_at":"2026-08-06T05:57:52.462488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.444321Z","title":"Deepedgebench: Benchmarking deep neural networks on edge devices,","venue":null,"work_id":"c64a0337-3b4d-4d35-bcce-5076b5ead266","year":2021},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.091111Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:aff46268110e076ace7a39823b9ef77440c416964c530d23ed14b105158d734f","observation_id":"7ab8cfcc-65c1-413f-9da3-8e2fab96d70a","resolution":{"observed_at":"2026-08-06T05:57:52.448405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.431197Z","title":"Prompt engineering in large language models,","venue":null,"work_id":"36924ab9-fe5d-4bde-a399-3a791552edf1","year":2023},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.095086Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:63fb2950bf9cb9219d7000d72e83ce62180d352a6b537911d2cdef4237a2ccf8","observation_id":"4393ea69-39b8-49d4-94d4-9ed1f80b145a","resolution":{"observed_at":"2026-08-06T05:57:52.435137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:51.099148Z","title":"An overview of domain-specific foundation model: key technologies, applications and challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.099148Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:9e8bf7348839f85e8cc9c21725b07b48ab3aff042b0a2ae91da7060ae4737692","observation_id":"3f0cb2aa-3234-4e65-952f-aeec162fb805","resolution":{"observed_at":"2026-08-06T05:57:51.099148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.417559Z","title":"Delving into multi-modal multi-task foundation models for road scene understanding: From learning paradigm perspectives,","venue":null,"work_id":"79046c11-0362-41c6-83ef-9aad8858d62e","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.103214Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:055552d2222e82279e135c318bb45029f6694455f4e3e8c3b2710354563090ea","observation_id":"644f20db-744d-485e-9d62-27430a2d24f7","resolution":{"observed_at":"2026-08-06T05:57:52.422368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12289","last_updated":"2024-06-25T17:55:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-19T17:04:04Z","title":"DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12289","snapshot_observed_at":"2026-08-06T05:57:51.107205Z","title":"Drivevlm: The convergence of autonomous driving and large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.107205Z"},"links":{"cited_paper":"/paper/2402.12289","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:81ce2465a6b59e2afc0fe063f7a5cbd4344aa90cd0352de3d2c9ad8845641d3c","observation_id":"00af9c47-56f5-4d99-a382-9320bfd3eade","resolution":{"observed_at":"2026-08-06T05:57:51.107205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.404109Z","title":"Drivelm: Driving with graph visual question answering,","venue":null,"work_id":"34b617ec-f047-4450-b95a-b0581d16d115","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.111414Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:00e1d8c74f991dd0b4ec4cbf72dc5f96e4b921ced40b285b0cdb56c9e9630b29","observation_id":"4f73c549-65da-4849-b805-2c6d44403d71","resolution":{"observed_at":"2026-08-06T05:57:52.408184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:51.115429Z","title":"Autotrust: Benchmark- ing trustworthiness in large vision language models for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.115429Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:c1d6bc40559e7f7a9c44313bd215647d4591e36efda4a1426f22c4c58b803120","observation_id":"c062f90a-ac3b-43b5-b1a4-033ff5e48032","resolution":{"observed_at":"2026-08-06T05:57:51.115429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.389887Z","title":"Scvlm: Enhancing vision-language model for safety-critical event understanding,","venue":null,"work_id":"93bb3f5e-26a1-46cc-acf4-50dedd209434","year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.119756Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:7d5b37b7f4072055f3b1671e9cb890cd64084c40627cdab47c058f6c842791af","observation_id":"3db96086-f413-4959-972a-51be12d7b448","resolution":{"observed_at":"2026-08-06T05:57:52.394326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:51.124060Z","title":"He-drive: Human-like end-to-end driving with vision language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.124060Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:ff403069c39dd4cf99d6429a1b86c23edd912bb1c57806a7a0e370160f261810","observation_id":"ffa2c44b-43e4-40e6-a794-8baff781b740","resolution":{"observed_at":"2026-08-06T05:57:51.124060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14446","last_updated":"2025-08-29T20:50:08Z","snapshot_observed_at":"2026-08-02T03:23:17.398540Z","submitted_at":"2024-12-19T01:53:36Z","title":"VLM-AD: End-to-End Autonomous Driving through Vision-Language Model Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14446","snapshot_observed_at":"2026-08-06T05:57:51.128078Z","title":"Vlm-ad: End-to-end autonomous driving through vision-language model supervision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.128078Z"},"links":{"cited_paper":"/paper/2412.14446","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:91c336008be49318194f43988e97298efa25a24925c73b9f52fc77635e48f193","observation_id":"12f00d00-6b5e-4655-83a2-8bf62b60b917","resolution":{"observed_at":"2026-08-06T05:57:51.128078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:51.132460Z","title":"Vlm-e2e: Enhancing end-to-end autonomous driving with multimodal driver attention fusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.132460Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:aa0540ce5d2c8c46d6a7804443de2e3621388235393abd0f0660c5ebd879df1d","observation_id":"afe5fbb6-a97a-487b-990e-deb4e8474cb7","resolution":{"observed_at":"2026-08-06T05:57:51.132460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15544","last_updated":"2024-12-20T04:08:11Z","snapshot_observed_at":"2026-07-06T20:10:37.385214Z","submitted_at":"2024-12-20T04:08:11Z","title":"VLM-RL: A Unified Vision Language Models and Reinforcement Learning Framework for Safe Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15544","snapshot_observed_at":"2026-08-06T05:57:51.136342Z","title":"Vlm-rl: A unified vision language models and reinforcement learning framework for safe autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.136342Z"},"links":{"cited_paper":"/paper/2412.15544","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:1634363ca99bb9418fa42f702026abbfdc3b62b4db8915ba913b3e6e314c1302","observation_id":"f0c4480c-62e3-4933-a1c5-481fa5d4ee31","resolution":{"observed_at":"2026-08-06T05:57:51.136342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07689","last_updated":"2025-08-07T06:38:32Z","snapshot_observed_at":"2026-07-06T20:04:48.422043Z","submitted_at":"2024-12-10T17:27:32Z","title":"RoboTron-Drive: All-in-One Large Multimodal Model for Autonomous Driving","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07689","snapshot_observed_at":"2026-08-06T05:57:51.140589Z","title":"Drivemm: All-in-one large multimodal model for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.140589Z"},"links":{"cited_paper":"/paper/2412.07689","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:85bb1624ce31621dce1475070c0e8672401138c6918015b4a9ff42827784ac27","observation_id":"84dd6e00-d60d-481f-bd87-d6e47bab2912","resolution":{"observed_at":"2026-08-06T05:57:51.140589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23262","last_updated":"2025-09-23T04:19:59Z","snapshot_observed_at":"2026-08-05T06:31:46.069300Z","submitted_at":"2024-10-30T17:46:31Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23262","snapshot_observed_at":"2026-08-06T05:57:51.144751Z","title":"Emma: End-to-end multimodal model for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.144751Z"},"links":{"cited_paper":"/paper/2410.23262","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:b076d3c5ce786aaa17f4116758f22833a28b7ecd618c99e3515566513702fe18","observation_id":"af50d16a-e00c-4b7a-a364-53796601456d","resolution":{"observed_at":"2026-08-06T05:57:51.144751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.375489Z","title":"Edgeshard: Efficient llm inference via collaborative edge computing,","venue":null,"work_id":"5f155081-b16a-4e1f-b3db-c10ecfd6fa2a","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.148916Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:7e70bfe7cabfa28a1bca3ba3abf6a1a692d3330b0d30cc30d261b720843992e3","observation_id":"44767a0d-92c6-4724-9b2e-8fb9679b90bb","resolution":{"observed_at":"2026-08-06T05:57:52.380083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.362393Z","title":"An advanced driving agent with the multimodal large language model for autonomous vehicles,","venue":null,"work_id":"9a9b879f-6ea2-47db-b493-a1dfeaac6339","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.153389Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:1bd318081da39c0a944d675208e6651f68d522d3291189bb092901b05b03010f","observation_id":"826ddaac-078b-451d-81c1-cf720ab819cc","resolution":{"observed_at":"2026-08-06T05:57:52.366528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.348984Z","title":"Autoreward: Closed-loop reward design with large language models for autonomous driving,","venue":null,"work_id":"1f2c1fd6-fd49-435a-8435-41470272c8a7","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.157665Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:b7e2cb648c1f89588a633d7076d50567240a368ad3cc6797f1524aac33ed98bf","observation_id":"542999bb-f6ab-4eec-888a-9e798c1e0997","resolution":{"observed_at":"2026-08-06T05:57:52.353104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.335034Z","title":"Senserag: Constructing environmental knowledge bases with proactive querying for llm-based autonomous driving,","venue":null,"work_id":"c39903c6-b876-4907-ba0f-e270c30b784d","year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.161746Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:0dcea0e0bc8a31d5f0068d929048d7e5f80991a54ce632431cb9ba63e58ca1f5","observation_id":"30ece904-9459-4eb5-9387-b79dab3a1c24","resolution":{"observed_at":"2026-08-06T05:57:52.339404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03624","last_updated":"2025-04-24T11:05:58Z","snapshot_observed_at":"2026-08-04T13:57:58.591485Z","submitted_at":"2024-08-07T08:34:48Z","title":"AgentsCoMerge: Large Language Model Empowered Collaborative Decision Making for Ramp Merging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03624","snapshot_observed_at":"2026-08-06T05:57:51.165761Z","title":"Agentscomerge: Large language model empowered collaborative decision making for ramp merging,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.165761Z"},"links":{"cited_paper":"/paper/2408.03624","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:ae9a9d6cfa0d9bb844aec50a18628d78e43ef88c521984179b292b6364d0b200","observation_id":"4b5653ce-f024-4e54-8cca-59b1f8b07de4","resolution":{"observed_at":"2026-08-06T05:57:51.165761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02239","last_updated":"2025-03-04T03:28:30Z","snapshot_observed_at":"2026-08-05T14:40:28.450321Z","submitted_at":"2025-03-04T03:28:30Z","title":"V2X-LLM: Enhancing V2X Integration and Understanding in Connected Vehicle Corridors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02239","snapshot_observed_at":"2026-08-06T05:57:51.170051Z","title":"V2x-llm: Enhancing v2x integration and understanding in connected vehicle corridors,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.170051Z"},"links":{"cited_paper":"/paper/2503.02239","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:b58cf80c20594105bbd61bf98ab5aa6acb73e3eb2b6c50825efd61380eef7af5","observation_id":"e594b4db-02eb-4af6-b99b-62a1a9cdfd6b","resolution":{"observed_at":"2026-08-06T05:57:51.170051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.320466Z","title":"Deep learning with edge computing: A review,","venue":null,"work_id":"da0ac62a-cc38-48ee-9de2-063e15171c33","year":2019},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.174457Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:43a899640961b93874a3206d13271276080217836afbcbea6755846c5b6573b6","observation_id":"d1428946-589a-419b-ad47-8f93b5f5d131","resolution":{"observed_at":"2026-08-06T05:57:52.325432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.305983Z","title":"Edgevla: Efficient vision-language-action models,","venue":null,"work_id":"871b0800-0ada-4683-b316-40dcf4ab6230","year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.178523Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:063a07184c706d8d2bb3bb20b991fbb8e73e57bc6812159f8e0a78bff900d4d2","observation_id":"e0775426-5cc0-4429-aa3b-9879971ea349","resolution":{"observed_at":"2026-08-06T05:57:52.310873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.292011Z","title":"Edgecloudai: Edge-cloud distributed video analytics,","venue":null,"work_id":"ab5b67ac-0226-41aa-a60d-73b7c2574966","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.182701Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:a797a7acab79865636e36c9611a50e9aece362ee7daa772b48baec8847782106","observation_id":"242129a7-4284-440a-ac71-ac7beccf559f","resolution":{"observed_at":"2026-08-06T05:57:52.296436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.277526Z","title":"Generative diffusion-based contract design for efficient ai twin migration in vehicular embodied ai networks,","venue":null,"work_id":"ca74aa6d-f5b6-4e1c-b1a5-8d884c8e8f9c","year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.187093Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:94a2b9954da0a33a99834229ea0607ee0e7bb60baa0fdc176b63027ee9c37cd2","observation_id":"a262fef9-e679-4d39-8453-0d8fda1e1cc8","resolution":{"observed_at":"2026-08-06T05:57:52.282095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10290","last_updated":"2024-06-12T22:58:12Z","snapshot_observed_at":"2026-07-06T18:31:13.039726Z","submitted_at":"2024-06-12T22:58:12Z","title":"MobileAIBench: Benchmarking LLMs and LMMs for On-Device Use Cases","version":1},"cited_work":{"arxiv_id":"2406.10290","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.10290","snapshot_observed_at":"2026-08-06T05:57:51.482552Z","title":"MobileAIBench: Benchmarking LLMs and LMMs for On-Device Use Cases","venue":"cs.CL","work_id":"0ee446ec-08a8-4b8b-92b6-c99a4db99931","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.191050Z"},"links":{"cited_paper":"/paper/2406.10290","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:c2a826fc04f5e65c65d81bcd5dfed7510279169b1f4b2923fe241e9eae6a4062","observation_id":"5fabf948-7a62-46ae-b886-3219b0a7faec","resolution":{"observed_at":"2026-08-06T05:57:51.489118Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-06T05:57:51.195198Z","title":"Minicpm-v: A gpt-4v level mllm on your phone,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.195198Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:c1e41df336590fe28040db32abd5d16969e9044149d43d30724c4c1c6441ad88","observation_id":"add537f2-5dff-4b98-82af-5c3bd2a3caec","resolution":{"observed_at":"2026-08-06T05:57:51.195198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16886","last_updated":"2023-12-30T04:59:21Z","snapshot_observed_at":"2026-07-29T22:12:01.108911Z","submitted_at":"2023-12-28T08:21:24Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16886","snapshot_observed_at":"2026-08-06T05:57:51.199560Z","title":"Mobilevlm: A fast, strong and open vision language assistant for mobile devices,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.199560Z"},"links":{"cited_paper":"/paper/2312.16886","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:069421027bdae6867dab8b2b0ce96c9d5dc2dd0600fa2662958c0d6e7f5181b1","observation_id":"9cb5ae6f-f0ba-420e-ac5c-d1904fbc2810","resolution":{"observed_at":"2026-08-06T05:57:51.199560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03766","last_updated":"2024-02-06T07:16:36Z","snapshot_observed_at":"2026-07-06T17:26:02.434883Z","submitted_at":"2024-02-06T07:16:36Z","title":"MobileVLM V2: Faster and Stronger Baseline for Vision Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03766","snapshot_observed_at":"2026-08-06T05:57:51.203800Z","title":"Mobilevlm v2: Faster and stronger baseline for vision language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.203800Z"},"links":{"cited_paper":"/paper/2402.03766","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:bb69eb10b1614ee1d4bbad14826441b7fa50bad6b96753efea80045f7fe506c0","observation_id":"10e90e2a-2391-46d1-ba25-090cfe54c8e6","resolution":{"observed_at":"2026-08-06T05:57:51.203800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01282","last_updated":"2026-06-02T02:45:47Z","snapshot_observed_at":"2026-07-06T20:00:00.800207Z","submitted_at":"2024-12-02T08:55:19Z","title":"Align-KD: Distilling Cross-Modal Alignment Knowledge for Mobile Vision-Language Model Enhancement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01282","snapshot_observed_at":"2026-08-06T05:57:51.207982Z","title":"Align-kd: Distilling cross-modal alignment knowledge for mobile vision- language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.207982Z"},"links":{"cited_paper":"/paper/2412.01282","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:85df2b80ab6aaa974126ac97bb362606c99f2bc1cf3cabe5be382fd47443685d","observation_id":"b0fe5b92-22bf-4db9-9c5c-b1c88049ad99","resolution":{"observed_at":"2026-08-06T05:57:51.207982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06395","last_updated":"2025-02-10T12:32:21Z","snapshot_observed_at":"2026-07-06T20:33:52.908467Z","submitted_at":"2025-02-10T12:32:21Z","title":"AppVLM: A Lightweight Vision Language Model for Online App Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06395","snapshot_observed_at":"2026-08-06T05:57:51.212487Z","title":"Appvlm: A lightweight vision language model for online app control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.212487Z"},"links":{"cited_paper":"/paper/2502.06395","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:15cfcff66c545db39e61e026e27af047b300600e082a610847e8169d6e929b31","observation_id":"5a5c8f33-cef1-4817-a5ad-f9c83bf1db80","resolution":{"observed_at":"2026-08-06T05:57:51.212487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03913","last_updated":"2024-07-04T13:12:19Z","snapshot_observed_at":"2026-07-06T18:41:31.849952Z","submitted_at":"2024-07-04T13:12:19Z","title":"MobileExperts: A Dynamic Tool-Enabled Agent Team in Mobile Devices","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03913","snapshot_observed_at":"2026-08-06T05:57:51.216606Z","title":"Mobileexperts: A dynamic tool-enabled agent team in mobile devices,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.216606Z"},"links":{"cited_paper":"/paper/2407.03913","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:df1f7c8ec0bc20f00704f68fadd128f4b05a15dc9f0e19321e83d0d6236371f1","observation_id":"f12d363c-c98b-4de8-bf75-2479858520b3","resolution":{"observed_at":"2026-08-06T05:57:51.216606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08144","last_updated":"2024-06-13T11:51:37Z","snapshot_observed_at":"2026-07-06T15:26:58.583640Z","submitted_at":"2023-05-14T12:31:03Z","title":"Mobile-Env: Building Qualified Evaluation Benchmarks for LLM-GUI Interaction","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08144","snapshot_observed_at":"2026-08-06T05:57:51.221104Z","title":"Mobile-env: Building qualified evaluation benchmarks for llm-gui interaction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.221104Z"},"links":{"cited_paper":"/paper/2305.08144","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:f0f33da7d89b2940db176f20a3d75c637d58add0e7b0ab0b33c3b9dcc9ef0c56","observation_id":"6f70c9e8-6284-4479-a245-99ac5f6b3f6a","resolution":{"observed_at":"2026-08-06T05:57:51.221104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.263019Z","title":"End-to-end autonomous driving: Challenges and frontiers,","venue":null,"work_id":"6ff0489f-e8f6-4b59-94d3-9573ab110e0c","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.225372Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:0a753af3c4a2b511dc9f9a380c11ce5742f029a3650c79fde03f52e8fc8c47e2","observation_id":"1cdc6225-fd6c-4677-8a63-f222b11d5749","resolution":{"observed_at":"2026-08-06T05:57:52.267258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.249291Z","title":"Privacy-aware anomaly detection and notification enhancement for vanet based on collaborative intrusion detection system,","venue":null,"work_id":"9332a9ea-63ea-4d0d-aa23-17da6287da4f","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.229446Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:4de75e9cc55badc0f5084ec98ad3b06e889c327cb5bc1737c1526a8fcfbd093d","observation_id":"32bf424f-ff60-4da1-9cd2-3a2de32afef4","resolution":{"observed_at":"2026-08-06T05:57:52.253488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.235445Z","title":"Towards c-v2x enabled collaborative autonomous driving,","venue":null,"work_id":"3b8f2d31-bf7e-4fa1-bf42-dff868b2ea33","year":2023},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.233374Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:5251bc3eb720ad96e8ae79c8b01f3548520a4c1c83899d58e88124b78ef208d0","observation_id":"d2812a34-391c-4dac-ac18-a9417d2979ab","resolution":{"observed_at":"2026-08-06T05:57:52.239694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.220229Z","title":"3d object detection for autonomous driving: A comprehensive survey,","venue":null,"work_id":"f0563659-b94b-4521-b30e-8cdcc21383d0","year":1909},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.237395Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:4df118e8a11ea69601ff2e518f3d933f11a063acd85e108520a79d7d7acd84ef","observation_id":"c384a51f-41f1-43fb-bae4-c19a7b105d25","resolution":{"observed_at":"2026-08-06T05:57:52.224843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.205536Z","title":"Deepaccident: A motion and accident prediction benchmark for v2x autonomous driving,","venue":null,"work_id":"c09a0706-689d-487f-9460-1c5d1099e714","year":2024},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.241496Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:eb5d5decb9e456148fea3a7c95c5a369f2b149a31e6f4511e1c9f2f00b738678","observation_id":"f5126c6d-7e01-40bc-88d0-5432eb407e30","resolution":{"observed_at":"2026-08-06T05:57:52.209856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.191912Z","title":"CARLA: An open urban driving simulator,","venue":null,"work_id":"6ae8d020-2c1c-45e6-8afa-dcc44f218f1a","year":2017},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.245442Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:395f1f204f80894bc062711c764ddb7a98c2768015bd4595ddb4e6898f05e281","observation_id":"d90a7c0c-5159-463e-93b4-b40b4e60535c","resolution":{"observed_at":"2026-08-06T05:57:52.196284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.177628Z","title":"Fiery: Future instance prediction in bird’s-eye view from surround monocular cameras,","venue":null,"work_id":"639a96bb-1363-42d6-81fc-b79be9113635","year":2021},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.249255Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:fa9d7285924976e5dadd569118db5d8c5c5fda9320b1d1b3550fb8e1a7977bd3","observation_id":"9f1e66a2-7080-4d5f-bc29-01a7672133ca","resolution":{"observed_at":"2026-08-06T05:57:52.182053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.163609Z","title":"Disconet: Shapes learning on disconnected manifolds for 3d editing,","venue":null,"work_id":"43ab0284-02be-4785-ad7e-5956a4e6e409","year":2019},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.253482Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:bfa442e7cccf851d66152bffac564ca8d727a5e59b8b9dced9945b02145fc998","observation_id":"84436f13-ef88-44d9-82a4-343827707c86","resolution":{"observed_at":"2026-08-06T05:57:52.167939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:57:52.149486Z","title":"V2x-vit: Vehicle-to-everything cooperative perception with vision transformer,","venue":null,"work_id":"46ceebf6-c019-4e49-8285-973ded7159d0","year":2022},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.257591Z"},"links":{"citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:0e44f0ce982e40573fed7292ec81dae07bd2f184afe3cfb881328a8c34519e8b","observation_id":"057cb3f9-9568-49b7-84e2-dfb30091a161","resolution":{"observed_at":"2026-08-06T05:57:52.153657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02202","last_updated":"2022-09-25T07:19:32Z","snapshot_observed_at":"2026-07-06T13:28:05.405493Z","submitted_at":"2022-07-05T17:59:28Z","title":"CoBEVT: Cooperative Bird's Eye View Semantic Segmentation with Sparse Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02202","snapshot_observed_at":"2026-08-06T05:57:51.261485Z","title":"Cobevt: Cooperative bird’s eye view semantic segmentation with sparse transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.261485Z"},"links":{"cited_paper":"/paper/2207.02202","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:30ac8f5180282dd39be73e793466e63086b78844d945e4d2655829f4321c858d","observation_id":"4892fdec-3923-45bc-a999-e85cf9051a54","resolution":{"observed_at":"2026-08-06T05:57:51.261485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13156","last_updated":"2023-12-29T02:14:15Z","snapshot_observed_at":"2026-07-06T17:06:00.378648Z","submitted_at":"2023-12-20T16:19:47Z","title":"AccidentGPT: Accident Analysis and Prevention from V2X Environmental Perception with Multi-modal Large Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13156","snapshot_observed_at":"2026-08-06T05:57:51.265746Z","title":"Accidentgpt: Accident analysis and prevention from v2x environmental perception with multi-modal large model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.265746Z"},"links":{"cited_paper":"/paper/2312.13156","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:e8ce6f8135815d8249027cc8e7e01b75fac4c422655be46e2a87276641564f1e","observation_id":"4eb50c36-18fc-4393-a333-5cf8570cfb2c","resolution":{"observed_at":"2026-08-06T05:57:51.265746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.09743","last_updated":"2022-05-19T17:55:35Z","snapshot_observed_at":"2026-08-04T03:03:57.465654Z","submitted_at":"2022-05-19T17:55:35Z","title":"BEVerse: Unified Perception and Prediction in Birds-Eye-View for Vision-Centric Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.09743","snapshot_observed_at":"2026-08-06T05:57:51.269914Z","title":"Beverse: Unified perception and prediction in birds-eye-view for vision-centric autonomous driving,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.269914Z"},"links":{"cited_paper":"/paper/2205.09743","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:155eef4362c4a4103006cbc31ef1be614db453e53bd1e3752a074012583e3641","observation_id":"5bc566e4-763f-4c31-9f2b-8d8eea566cf2","resolution":{"observed_at":"2026-08-06T05:57:51.269914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-07-06T12:21:28.059661Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-06T05:57:51.274097Z","title":"Bevdet: High-performance multi-camera 3d object detection in bird-eye-view,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:51.274097Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2508.01057"},"observation_digest":"sha256:0a7752a39bd04d3a85061f48bcc1db597ad86c667be6c257933471ac3512d91e","observation_id":"994ecad8-4e60-469a-9a26-fadaf8c80b7d","resolution":{"observed_at":"2026-08-06T05:57:51.274097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.01057","last_updated":"2025-08-12T12:29:02Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T05:57:50.237296Z","submitted_at":"2025-08-01T20:16:04Z","title":"Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":4,"verified_fuzzy":41},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 1 inbound Pith citation observation for arXiv:2508.01057."}