{"as_of":"2026-08-22T15:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e81f831c6520ebbee55363241fddd6eb15b95b95c1109a17d1616ec938854fd4","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:31:01.705044Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.16134/citation-record","integrity":"/paper/2504.16134/integrity","json":"/paper/2504.16134/citation-record.json","paper":"/paper/2504.16134"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:03.017734Z","title":"Road traffic Injuries","venue":null,"work_id":"0285c4ff-7840-4976-9122-23e1419b9557","year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.484421Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:c86e3439e26df6919ecfcc9aee0daa5f3691a4bb1f406e6b3ddfc47192cda344","observation_id":"bec87bd8-edbc-46f7-99d6-ad18216e9590","resolution":{"observed_at":"2026-08-16T11:31:03.021226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:03.005460Z","title":"Leveraging Deep Learning and Multimodal Large Language Models for Near -Miss Detection Using Crowdsourced Videos,","venue":null,"work_id":"5176b6a9-8ceb-4e52-aee7-a0cfc8042a1d","year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.488489Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:c48a1cb40250933887d34c15bbb6fbb0215c8d7ae85f8efd8e031d44185103fb","observation_id":"428699b3-2481-484a-821e-44ca20787989","resolution":{"observed_at":"2026-08-16T11:31:03.009540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18286","last_updated":"2024-09-26T20:58:11Z","snapshot_observed_at":"2026-08-20T06:35:23.040232Z","submitted_at":"2024-09-26T20:58:11Z","title":"Advancing Object Detection in Transportation with Multimodal Large Language Models (MLLMs): A Comprehensive Review and Empirical Testing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18286","snapshot_observed_at":"2026-08-16T11:31:01.492127Z","title":"Advancing Object Detection in Transportation with Multimodal Large Language Models (MLLMs): A Comprehensive Review and Empirical Testing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.492127Z"},"links":{"cited_paper":"/paper/2409.18286","citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:386749fc432af0d5eae4a659bacde4f89dedabd811b26c6deca1727123ab26fb","observation_id":"200f5897-b26f-4bfe-bce4-ef0c7889cbfc","resolution":{"observed_at":"2026-08-16T11:31:01.492127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s13042-020-01242-z","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-20T11:03:42.707129Z","title":"Adversarial examples: attacks and defenses in the physical world,","venue":"International Journal of Machine Learning and Cybernetics","work_id":"37a6aa35-c4d2-41fd-a33d-124098a85976","year":2021},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.496086Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:8edba33a32f9590310d87c0c72912ff77b7df6d9b1a4779a6944f21648f5cd73","observation_id":"fdfd58cc-4f86-4495-93ac-376f84bb1ab0","resolution":{"observed_at":"2026-08-16T11:31:01.840301Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.992548Z","title":"Using Multimodal Large Language Models (MLLMs) for Automated Detection of Traffic Safety-Critical Events,","venue":null,"work_id":"e92a8b9b-dc8d-4f25-97bf-9e8c96d3fd92","year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.499676Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:17f2dcc34ff2a4180da26f4831ce2d14fe64a5b7b05d6f144ea4a8d54d954816","observation_id":"e6182725-211c-4bc1-94d9-af9fc5c9d467","resolution":{"observed_at":"2026-08-16T11:31:02.996518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21203/rs.3.rs-5270567/v1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.822227Z","title":"A Comprehensive Survey of Multimodal Large Language Models: Concept, Application and Safety,","venue":null,"work_id":"c43df57a-51d5-4fc4-b5d8-dafff9f469c6","year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.508163Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:c10657cf10528dc689bd1abeb5bc48b6806a312830660f224ffe7fb0470f88f8","observation_id":"e024e67f-d25d-48aa-8d74-508e3d7ac5bb","resolution":{"observed_at":"2026-08-16T11:31:01.826386Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.512193Z","title":"Adversarial Sensor Attack on LiDAR-based Perception in Autonomous Driving,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.512193Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:3743803b79094b8d802f724cb4aa589fc623972a52d2197525598f4bd5a542a7","observation_id":"dab1fe92-f988-4b5a-80b5-e800d9ad29ba","resolution":{"observed_at":"2026-08-16T11:31:01.512193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.516035Z","title":"MM -LLMs: Recent Advances in MultiModal Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.516035Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:38e4529a1716c949f432dee5be4ba2259dd40b9916747fa11b2b1dfe18ab9dae","observation_id":"a10d267f-3991-431c-a9cc-35559c27d630","resolution":{"observed_at":"2026-08-16T11:31:01.516035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.520406Z","title":"Integrating LLMs With ITS: Recent Advances, Potentials, Challenges, and Future Directions,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.520406Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:160c58b4e9809628aca3083401b27c669ab1de95d539c6b1c60ee3458b66e3c8","observation_id":"1ce2efe0-5f04-41b7-bcde-fa0165dd818a","resolution":{"observed_at":"2026-08-16T11:31:01.520406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.524310Z","title":"A Review of Current Trends, Techniques, and Challenges in Large Language Models (LLMs),","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.524310Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:dacedb586a5b3a582d44270427b2e96dda8b31ed01fce3cec04f3a5adc850ed0","observation_id":"b06f41c1-9465-44ce-847a-4e498ef2d28c","resolution":{"observed_at":"2026-08-16T11:31:01.524310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.528470Z","title":"Vision meets robotics: The KITTI dataset,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.528470Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:8e18c291cf9a7f0a450c0e7f3767612b935cf50a73dd449421025db97427d3d0","observation_id":"4f38ae54-3c9c-4a88-a8cb-edcd2c5b91f5","resolution":{"observed_at":"2026-08-16T11:31:01.528470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.532518Z","title":"CAFuser: Condition -Aware Multimodal Fusion for Robust Semantic Perception of Driving Scenes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.532518Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:6145dbb7785ff6daf7195b7c830a7d2be9b1131e473730f4fb106938460179cd","observation_id":"24017a3c-4274-4997-8aa4-61b57260c8dc","resolution":{"observed_at":"2026-08-16T11:31:01.532518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.540534Z","title":"A survey of GPT -3 family large language models including ChatGPT and GPT-4,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.540534Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:a8122205ed9071df61d397abf184380d6b7c7acf6f7580bc7a8c5a64831cde92","observation_id":"c3bac6ae-6fc1-4737-bdaa-e388d9814c2d","resolution":{"observed_at":"2026-08-16T11:31:01.540534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.967333Z","title":"MobileVLM V2: Faster and Stronger Baseline for Vision Language Model,","venue":null,"work_id":"26373496-e738-40b7-9130-975adcccc20b","year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.544335Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:a5ffa114cc4735a77c45a064b3e59b0879c098d68d5dcd59c58a5e3d2c5e883c","observation_id":"e759e8b0-9164-480b-8a76-088cb72c342d","resolution":{"observed_at":"2026-08-16T11:31:02.971576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.953590Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications,","venue":null,"work_id":"6fc0aaad-aea0-4993-8d85-8032b66f9baa","year":2017},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.548207Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:4c2c7b2eb7efdc32d42111a431f6de6fcfc3a8f3720bd341f04eb64be83f4222","observation_id":"3ca96a82-9e16-425a-b416-18ba833f09ad","resolution":{"observed_at":"2026-08-16T11:31:02.958127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.939893Z","title":"Dynamic -LLaVA: Efficient Multimodal Large Language Models via Dynamic Vision -language Context Sparsification,","venue":null,"work_id":"3a9670f3-e8c2-4646-b15c-2dd0978ff8d8","year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.552202Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:df5cc9424ed3466325466887651884de928c438c6f439a16295b26ca7de13789","observation_id":"19e71ef3-9f7a-41df-aa9d-f8f9c4a8798b","resolution":{"observed_at":"2026-08-16T11:31:02.944304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.926760Z","title":"Physical Adversarial Attacks on an Aerial Imagery Object Detector,","venue":null,"work_id":"fa2fb553-0b15-49f6-9883-1a24a1fa9f3e","year":2021},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.556008Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:7e8940066b84afd865844e8ef114222a390ffebc19f5500a49098cec45ac342d","observation_id":"6838aa71-110f-482f-b389-f98b6f49f2c2","resolution":{"observed_at":"2026-08-16T11:31:02.931025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.559761Z","title":"On the Adversarial Robustness of Multi -Modal Foundation Models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.559761Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:4afdfe3f36649ec965beb17fb1e122d55d23943d1c45b162f599ad1764fb4a7b","observation_id":"24387492-8a88-4ab0-8936-78519c3dba89","resolution":{"observed_at":"2026-08-16T11:31:01.559761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.563682Z","title":"Visual Reasoning and Multi-Agent Approach in Multimodal Large Language Models (MLLMs): Solving TSP and mTSP Combinatorial Challenges,","venue":null,"work_id":null,"year":1920},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.563682Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:abe186b2f839d59bc69cfcd22d775ba0e2ab79f0d52bf9a6ef966c6e14b69a6a","observation_id":"0abe2a76-6acf-4cae-ba0d-e3815a1a85e8","resolution":{"observed_at":"2026-08-16T11:31:01.563682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.912442Z","title":"Benchmarking LLMs for Real -World Applications: From Numerical Metrics to Contextual and Qualitative Evaluation,","venue":null,"work_id":"47af4e99-bf9e-45e3-9e33-d1c04ef1a8d8","year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.567565Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:7168cacc83a42485a30a53687c47720257bcb599cf3145f4fd8b5ff5fa4cca22","observation_id":"82f934bf-87df-42eb-a398-c2a427569dd6","resolution":{"observed_at":"2026-08-16T11:31:02.917303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.898022Z","title":"Forging Vision Foundation Models for Autonomous Driving: Challenges, Methodologies, and Opportunities,","venue":null,"work_id":"f3f701ff-4630-40e5-aa43-e9714baea58d","year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.571331Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:121a08d76f97303e46511b325dd27da09d7a46fa54ccdc8fcd6ba10869689305","observation_id":"a700fe94-abd7-404f-99ca-fa5cdb61de92","resolution":{"observed_at":"2026-08-16T11:31:02.903035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.883790Z","title":"LLaVA -ST: A Multimodal Large Language Model for Fine -Grained Spatial-Temporal Understanding,","venue":null,"work_id":"7bf44366-fe88-4892-b37f-585d53fc5e74","year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.575079Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:ad7383d0986ce0c794f8ac6704becfec57b8b0906642285b17bbfe893520b669","observation_id":"cc29f8f7-5dad-4913-81fb-6585f4bd5c6b","resolution":{"observed_at":"2026-08-16T11:31:02.888240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.870307Z","title":"ST-Align: A Multimodal Foundation Model for Image -Gene Alignment in Spatial Transcriptomics,","venue":null,"work_id":"9423137e-1f8d-47e0-8f9c-7afd0c18c6bc","year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.578725Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:2909582716a5eed85c848d2a438b20f4924e625b2fda2c03c4d89670a8ee713c","observation_id":"06dc2625-f81c-47b2-a5bf-79b10233e155","resolution":{"observed_at":"2026-08-16T11:31:02.874426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.980109Z","title":"When language and vision meet road safety: leveraging multimodal large language models for video -based traffic accident analysis,","venue":null,"work_id":"8c9e1754-6bf5-48de-87aa-7eb9445e4ec1","year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.582542Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:deb28f84a4da78c6f0442d7563ee29d750bb0038fd1cc45e583dde06872eeba3","observation_id":"3ebac48c-134c-44e7-8d39-596de35db038","resolution":{"observed_at":"2026-08-16T11:31:02.984313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.857766Z","title":"DRAMA: Joint Risk Localization and Captioning in Driving,","venue":null,"work_id":"1095c5ab-4f5f-49ed-a8e3-85b02ef3bbae","year":2023},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.586672Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:aff258857872e4abaf3f45044aedc32bde93d8e8394f1ceffb322dd227f49213","observation_id":"cf43a1f0-4f28-4617-bcae-cb2bfa1c440c","resolution":{"observed_at":"2026-08-16T11:31:02.861893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.590792Z","title":"Driving with LLMs: Fusing Object -Level Vector Modality for Explainable Autonomous Driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.590792Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:59d914aa2ff1a79c9542a9d39e479e5c84b827cdce54c2014f49116c2fc647c3","observation_id":"13938de6-90c7-4e8c-8a5a-9e3d3c67e416","resolution":{"observed_at":"2026-08-16T11:31:01.590792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.594670Z","title":"TrafficGPT : Viewing, processing and interacting with traffic foundation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.594670Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:b278bb224caf8508c2457582f60f4f046e26be19ae1bc59ca5ec166107f7ddcc","observation_id":"92e8afd3-7d7d-4732-b154-ac927dd7500f","resolution":{"observed_at":"2026-08-16T11:31:01.594670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.598424Z","title":"AccidentGPT: A V2X Environmental Perception Multi -modal Large Model for Accident Analysis and Prevention,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.598424Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:947c2a215fd7f73c5919f4a5de2cad6ebf8c1391fc3bf4ec039a6c2967a6b23a","observation_id":"aa5d6216-c4cb-4b2f-a7dc-ab214acdb05a","resolution":{"observed_at":"2026-08-16T11:31:01.598424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.845648Z","title":"Drive As You Speak: Enabling Human-Like Interaction With Large Language Models in Autonomous Vehicles,","venue":null,"work_id":"2db48ec3-adf2-41aa-9d34-940d96006022","year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.602338Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:5cbe8baa321d3486ff5ac40454c4feea500f5d7e0459c76f6182e7aeb657d02c","observation_id":"ee0ef8b7-dda4-4770-a322-9a05b4ad4b88","resolution":{"observed_at":"2026-08-16T11:31:02.849222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.834641Z","title":"Probing the Robustness of Vision-Language Pretrained Models: A Multimodal Adversarial Attack Approach,","venue":null,"work_id":"99e3df95-cfe6-4b51-a303-d18e72e76b55","year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.605980Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:df3a80164c5248c6575e9deee43fb668787fd761a8b7a0676542edc791e7b769","observation_id":"1c386e3c-80cc-456a-bec6-01579849aea0","resolution":{"observed_at":"2026-08-16T11:31:02.838000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.822776Z","title":"Gemini: A Family of Highly Capable Multimodal Models,","venue":null,"work_id":"f329e6e0-d163-4993-8184-84e989d1c006","year":2023},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.609960Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:9c99bd2a2fc9cc38bcc221676e289276807239589f679d9078ff09c4b9bbdaef","observation_id":"2b97f7b6-fc29-4a71-a32e-118c4fa41894","resolution":{"observed_at":"2026-08-16T11:31:02.826694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.810591Z","title":"Visual Instruction Tuning,","venue":null,"work_id":"a3aa3ca7-b9c2-4183-a7bd-8f98edb1a5e1","year":2023},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.613820Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:b5c37cedd491edafc852cb8911d6b68c1caaf7d0f2b7f651eb84eb5f497dddb6","observation_id":"3e36b51a-77d4-4c00-85f8-4f4f5315d5d6","resolution":{"observed_at":"2026-08-16T11:31:02.813905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.798472Z","title":"Hallucination of Multimodal Large Language Models: A Survey,","venue":null,"work_id":"6814b360-15d5-42ab-bcb8-99bb0b346400","year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.617582Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:03d39782ac0aa65fedc7b1d43e36cc12c6de876bb8dd9147138fa3de4002d3ad","observation_id":"f742a049-8151-4960-894a-08d4f20d8aea","resolution":{"observed_at":"2026-08-16T11:31:02.802415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.621663Z","title":"A Cloud -Edge Collaborative Architecture for Multimodal LLMs-Based Advanced Driver Assistance Systems in IoT Networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.621663Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:f7c3e2e19344095db3d7c0d7ef25f72f5ef8f08ed5675d953df5082985343a75","observation_id":"690c435c-5070-4a5b-982e-fac639a62f1b","resolution":{"observed_at":"2026-08-16T11:31:01.621663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.625579Z","title":"SurrealDriver: Designing LLM -powered Generative Driver Agent Framework based on Human Drivers’ Driving -thinking Data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.625579Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:1786ae46fc50928544900e75ec6de1204ea7236ac30695611dc862ee9aa8938f","observation_id":"7f39cbd1-aefd-4a51-a5d3-e6be8763b030","resolution":{"observed_at":"2026-08-16T11:31:01.625579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.785766Z","title":"The Cityscapes Dataset for Semantic Urban Scene Understanding,","venue":null,"work_id":"a1ed4772-ee16-4151-9da0-72fe5151fca9","year":2016},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.629482Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:faceb7719433b57426cefc6fb3dc5eb2ae8cc3f0b2e73fbc651bf778b6e581f4","observation_id":"2511f4b8-563f-4ada-b093-9771faf57c00","resolution":{"observed_at":"2026-08-16T11:31:02.790001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.773214Z","title":"Scalability in Perception for Autonomous Driving: Waymo Open Dataset,","venue":null,"work_id":"1ceae153-5e58-49a2-9e30-59b68dab1901","year":2020},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.633241Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:79c1e45462959b36f14d607302012b729c26860556d96027d5cda3ec4a8d4995","observation_id":"0864276c-f1ff-4eda-931c-4fa3b56f0af7","resolution":{"observed_at":"2026-08-16T11:31:02.777196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.760937Z","title":"Graph neural networks for road safety modeling: datasets and evaluations for accident analysis,","venue":null,"work_id":"ca8dc718-07f4-426d-a162-3ffd9536bad9","year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.637052Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:5fc0cadcc9a9c8290d8cda2ff86668b16f9194ff4b7f89046fc2fe8ddf16e7b1","observation_id":"b54a29a4-79c9-4c2c-8048-449793ee3561","resolution":{"observed_at":"2026-08-16T11:31:02.765006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1155/2023/7812276","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.771727Z","title":"Traffic Condition Classification Model Based on Traffic‐Net,","venue":null,"work_id":"5fbdea6a-bb38-46df-8b15-7187371c95c1","year":2023},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.640773Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:d2c27de138314ce693efa6818e15d4eea94cab2e442369199df401247c30e562","observation_id":"4c2749f5-2e8d-427d-8b1f-576e39324833","resolution":{"observed_at":"2026-08-16T11:31:01.775819Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.644876Z","title":"TrafficMOT: A Challenging Dataset for Multi -Object Tracking in Complex Traffic Scenarios,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.644876Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:1e21a97831446703d006e6e599bfc30b15134137faca93594d3dcf8b0ed3e436","observation_id":"4239e9fd-cbd9-4db9-bf51-a4355f737a5a","resolution":{"observed_at":"2026-08-16T11:31:01.644876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.648068Z","title":"Leveraging Multimodal Large Language Models (MLLMs) for Enhanced Object Detection and Scene Understanding in Thermal Images for Autonomous Driving Systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.648068Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:f978b974c149ed45981f3a6a8cd9235866a25412b76a71b6e824369585ddc470","observation_id":"211613d8-7d01-4e48-b0e0-fcb92e3d4156","resolution":{"observed_at":"2026-08-16T11:31:01.648068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.651463Z","title":"TAD: A Large -Scale Benchmark for Traffic Accidents Detection From Video Surveillance,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.651463Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:f3e3d0e12a21437282358c4a1ccd0241479a2d93ab89604da13f1edb7dc08c45","observation_id":"6ad0769b-24a4-4fbd-bc23-e8dbac1016f0","resolution":{"observed_at":"2026-08-16T11:31:01.651463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.739206Z","title":"Description of the SHRP 2 naturalistic database and the crash, near -crash, and baseline data sets,","venue":null,"work_id":"e0b83156-7ab7-4318-aae2-80bc61e5ff3a","year":2016},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.654578Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:57ba478ddcd03966fbee7ed4277cddbb148e012e1d6136498378a670ba6d6259","observation_id":"a4e72633-dae9-4243-bd5e-8d4bd87fcd60","resolution":{"observed_at":"2026-08-16T11:31:02.743930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.726386Z","title":"ScVLM: Enhancing Vision-Language Model for Safety-Critical Event Understanding,","venue":null,"work_id":"bd408d54-3c02-4dab-b440-fda43ba83b18","year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.657708Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:c1ae014c72e936b052d2b4f16a5be8af882f1aaefc64196da445d97892ed544e","observation_id":"6dbcc49c-e06c-4c6a-974e-21a0929bd2ba","resolution":{"observed_at":"2026-08-16T11:31:02.730368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05566","last_updated":"2025-01-09T20:29:31Z","snapshot_observed_at":"2026-08-22T13:22:20.147502Z","submitted_at":"2025-01-09T20:29:31Z","title":"Vision-Language Models for Autonomous Driving: CLIP-Based Dynamic Scene Understanding","version":1},"cited_work":{"arxiv_id":"2501.05566","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.05566","snapshot_observed_at":"2026-08-16T11:31:01.988189Z","title":"Vision-Language Models for Autonomous Driving: CLIP-Based Dynamic Scene Understanding","venue":"cs.CV","work_id":"f5c9236e-bca7-41b8-955b-7d9e8a76025d","year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.660893Z"},"links":{"cited_paper":"/paper/2501.05566","citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:65a0179afa1ffc9d4ab6859230aa63f31d38eeb100767a8272ed7da2c735685c","observation_id":"5a6006d5-4d7d-4181-8eb0-731e6c394467","resolution":{"observed_at":"2026-08-16T11:31:01.992949Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.664284Z","title":"A Causality -Aware Paradigm for Evaluating Creativity of Multimodal Large Language Models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.664284Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:bd1ebe31ff0f1b986a6a8080a93425931ee67547cda3deabc3c04318aa41af39","observation_id":"dee0e2c8-3c47-4396-acf3-026864b5ed0c","resolution":{"observed_at":"2026-08-16T11:31:01.664284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.712926Z","title":"Large Language Models (LLMs) as Traffic Control Systems at Urban Intersections: A New Paradigm,","venue":null,"work_id":"9e7564c7-927a-4269-a80a-8b8af620b869","year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.668267Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:132c8a1704a67c1a7d2aa72102c1d5bee9934bad5038089d269c8c28bd7b0a09","observation_id":"2d7af377-8dda-4073-97f9-78dbe00b557c","resolution":{"observed_at":"2026-08-16T11:31:02.716946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00948","last_updated":"2024-08-01T23:06:06Z","snapshot_observed_at":"2026-08-22T13:22:25.986587Z","submitted_at":"2024-08-01T23:06:06Z","title":"Leveraging Large Language Models (LLMs) for Traffic Management at Urban Intersections: The Case of Mixed Traffic Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00948","snapshot_observed_at":"2026-08-16T11:31:01.671348Z","title":"Leveraging Large Language Models (LLMs) for Traffic Management at Urban Intersections: The Case of Mixed Traffic Scenarios,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.671348Z"},"links":{"cited_paper":"/paper/2408.00948","citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:bb82b56d76d0c555b6fb65c5fab9a28959a12543a074d421bac4f79232427e8f","observation_id":"897da543-8334-4cfb-b9c6-b365146c4310","resolution":{"observed_at":"2026-08-16T11:31:01.671348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.700705Z","title":"On Fairness of Unified Multimodal Large Language Model for Image Generation,","venue":null,"work_id":"79d2b41f-1467-4bd4-a7cd-ec90d2a75a39","year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.674678Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:badb06cc61f62177de07ae1ca96de948d737a3097a555ef8696d221fd99218f2","observation_id":"79875d26-552f-4cf6-b8a5-c93b12871b84","resolution":{"observed_at":"2026-08-16T11:31:02.704688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.678623Z","title":"MM-SafetyBench: A Benchmark for Safety Evaluation of Multimodal Large Language Models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.678623Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:1242199182cc298e1fb8701a5c5500282c780216f5156b9c2562ee8a2c6d611a","observation_id":"8bcf1016-ac86-429a-8589-d5b127e3a23a","resolution":{"observed_at":"2026-08-16T11:31:01.678623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.682519Z","title":"Shielded Representations: Protecting Sensitive Attributes Through Iterative Gradient -Based Projection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.682519Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:d0502d1e79e973c909a4cf01767028c7baff6bf94aa4e01d76e9899fe9d35259","observation_id":"b7073da2-1d0a-4e13-b760-5f7ce0294a2f","resolution":{"observed_at":"2026-08-16T11:31:01.682519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.686232Z","title":"MLLM -Protector: Ensuring MLLM’s Safety without Hurting Performance,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.686232Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:2f8691412a9202805f5141642388db5f0737ed9d5ec0e22a9233d8df23eca1ce","observation_id":"fbe17f73-2303-4c50-b49d-924e1a020264","resolution":{"observed_at":"2026-08-16T11:31:01.686232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-72661-3_5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":"AdaShield : Safeguarding Multimodal Large Language Models from Structure-Based Attack via Adaptive Shield Prompting,","venue":"Lecture notes in computer science","work_id":"76914c10-c408-430f-a838-11a8ee5d53ba","year":2025},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.690175Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:8f6bf608a915d98f0b13cc016ea51b966b0a199b1d220f5044a38af7fd9ec21a","observation_id":"974e0aaf-4407-4258-9784-6e18050437d2","resolution":{"observed_at":"2026-08-16T11:31:01.738297Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.687852Z","title":"Towards More Robust Retrieval- Augmented Generation: Evaluating RAG Under Adversarial Poisoning Attacks,","venue":null,"work_id":"a3604375-85b5-4b9e-bd5c-e198d7abb5ce","year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.694008Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:f3868ffffe66d758a1fb5ed262c37380674f143e1d1c385a9479d153c811d139","observation_id":"e1fa1abe-021d-459b-a8f6-497827280503","resolution":{"observed_at":"2026-08-16T11:31:02.692389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.675359Z","title":"ACEA Position Paper Artificial Intelligence in the automobile industry,","venue":null,"work_id":"ed75dad1-df4e-40f1-ac20-2c84cd4500bd","year":null},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.697667Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:f34c643303c98b7b2982a667fd7d7b8358ee46b006cf15fda00b458cb55b5d3d","observation_id":"d9dcae9d-8c09-4384-b6e8-9035dbd3577e","resolution":{"observed_at":"2026-08-16T11:31:02.679426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:02.662576Z","title":"Cross-Domain Few- Shot In -Context Learning For Enhancing Traffic Sign Recognition,","venue":null,"work_id":"50bec76f-835f-46b0-8bf3-4ee7688f35b0","year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.701522Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:3c28eab00459110a5cb418a2718ed7eab6b0e037433c44394821edaa3c545e0e","observation_id":"a1d7e4d4-d6e8-4bac-91b8-41939d7aac84","resolution":{"observed_at":"2026-08-16T11:31:02.666774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:31:01.705044Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends","version":1},"reference_index":2570,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:01.705044Z"},"links":{"citing_paper":"/paper/2504.16134"},"observation_digest":"sha256:55ccbe0ca18686911e0041ee391b18c4dc5f0458ff33e35462c23794980da870","observation_id":"92d1c9b0-3c5f-44f7-ba18-ca96096477df","resolution":{"observed_at":"2026-08-16T11:31:01.705044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.16134","last_updated":"2025-04-21T18:48:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T00:09:38.977751Z","submitted_at":"2025-04-21T18:48:35Z","title":"Multimodal Large Language Models for Enhanced Traffic Safety: A Comprehensive Review and Future Trends"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":5,"verified_fuzzy":28},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2504.16134."}