{"as_of":"2026-08-08T09:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1bf9ed262943aaf16bd1022363eeb9d20236d52d622e430b395eb188140d19a0","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:17:57.316187Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T19:58:53.676935Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.19838","last_updated":"2024-05-09T03:27:44Z","snapshot_observed_at":"2026-07-06T17:52:50.835744Z","submitted_at":"2024-03-28T21:18:33Z","title":"Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19838","snapshot_observed_at":"2026-08-07T15:17:57.316187Z","title":"Multi-frame, lightweight & effi- cient vision-language models for question answering in autonomous driving.arXiv preprint arXiv:2403.19838, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-07T15:12:39.462867Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.316187Z"},"links":{"cited_paper":"/paper/2403.19838","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:6370eebf31707d6b6cc2c761babf81a1dc02539c54739917307c92ae1dac74a0","observation_id":"b2f4eb50-3c55-4160-9cd0-11feb99c8957","resolution":{"observed_at":"2026-08-07T15:17:57.316187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19838","last_updated":"2024-05-09T03:27:44Z","snapshot_observed_at":"2026-07-06T17:52:50.835744Z","submitted_at":"2024-03-28T21:18:33Z","title":"Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19838","snapshot_observed_at":"2026-08-06T21:48:54.779005Z","title":"Multi-frame, lightweight & effi- cient vision-language models for question answering in autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01059","last_updated":"2025-06-29T16:41:19Z","snapshot_observed_at":"2026-08-07T17:02:51.977992Z","submitted_at":"2025-06-29T16:41:19Z","title":"Automated Vehicles Should be Connected with Natural Language","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:48:54.779005Z"},"links":{"cited_paper":"/paper/2403.19838","citing_paper":"/paper/2507.01059"},"observation_digest":"sha256:c122a1b27cee7b51d6aec0489459386553cf49a9861763bfe682503f808c0443","observation_id":"1eed6d6d-d34b-4e2b-815d-f21202db4b5c","resolution":{"observed_at":"2026-08-06T21:48:54.779005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19838","last_updated":"2024-05-09T03:27:44Z","snapshot_observed_at":"2026-07-06T17:52:50.835744Z","submitted_at":"2024-03-28T21:18:33Z","title":"Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19838","snapshot_observed_at":"2026-08-06T21:56:05.620616Z","title":"Multi-frame, lightweight & efficient vision- language models for question answering in autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02948","last_updated":"2025-07-13T15:16:06Z","snapshot_observed_at":"2026-08-07T02:31:42.092340Z","submitted_at":"2025-06-28T21:28:01Z","title":"DriveMRP: Enhancing Vision-Language Models with Synthetic Motion Data for Motion Risk Prediction","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:05.620616Z"},"links":{"cited_paper":"/paper/2403.19838","citing_paper":"/paper/2507.02948"},"observation_digest":"sha256:182ca02e0aa4225528cb5ce036cdfae0e7e4a7fb6f215cf012aa9e5183709d26","observation_id":"438a597f-ad10-4258-b2c1-a49f97844f2d","resolution":{"observed_at":"2026-08-06T21:56:05.620616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19838","last_updated":"2024-05-09T03:27:44Z","snapshot_observed_at":"2026-07-06T17:52:50.835744Z","submitted_at":"2024-03-28T21:18:33Z","title":"Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19838","snapshot_observed_at":"2026-08-06T12:43:10.891565Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21585","last_updated":"2025-07-29T08:40:17Z","snapshot_observed_at":"2026-08-08T02:57:50.739326Z","submitted_at":"2025-07-29T08:40:17Z","title":"SafeDriveRAG: Towards Safe Autonomous Driving with Knowledge Graph-based Retrieval-Augmented Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T12:43:10.891565Z"},"links":{"cited_paper":"/paper/2403.19838","citing_paper":"/paper/2507.21585"},"observation_digest":"sha256:77b1291336441640e3dfdb5f40ad5c30746227d48740bba73682b7fb4cc0c24c","observation_id":"1f26e331-b50f-4d91-a108-3e6bf18e7ceb","resolution":{"observed_at":"2026-08-06T12:43:10.891565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19838","last_updated":"2024-05-09T03:27:44Z","snapshot_observed_at":"2026-07-06T17:52:50.835744Z","submitted_at":"2024-03-28T21:18:33Z","title":"Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2403.19838","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.19838","snapshot_observed_at":"2026-07-03T19:58:53.676935Z","title":"arXiv preprint arXiv:2403.19838 (2024)","venue":null,"work_id":"4a6ac5d0-5b96-4101-b68e-4c98f46f0775","year":2024},"citing_paper":{"arxiv_id":"2604.04630","last_updated":"2026-04-06T12:29:49Z","snapshot_observed_at":"2026-07-06T22:53:33.177713Z","submitted_at":"2026-04-06T12:29:49Z","title":"Multimodal Backdoor Attack on VLMs for Autonomous Driving via Graffiti and Cross-Lingual Triggers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T20:30:29.032353Z"},"links":{"cited_paper":"/paper/2403.19838","citing_paper":"/paper/2604.04630"},"observation_digest":"sha256:8bb9c136baf99dc6a433ebbedfea8ddbb1c048d7f494926bda674192df6b5698","observation_id":"3d630d15-1fb3-46c3-bb8d-51d9c5ef4652","resolution":{"observed_at":"2026-05-10T21:55:49.736805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19838","last_updated":"2024-05-09T03:27:44Z","snapshot_observed_at":"2026-07-06T17:52:50.835744Z","submitted_at":"2024-03-28T21:18:33Z","title":"Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2403.19838","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.19838","snapshot_observed_at":"2026-07-03T19:58:53.676935Z","title":"arXiv preprint arXiv:2403.19838 (2024)","venue":null,"work_id":"4a6ac5d0-5b96-4101-b68e-4c98f46f0775","year":2024},"citing_paper":{"arxiv_id":"2605.26038","last_updated":"2026-05-25T17:05:52Z","snapshot_observed_at":"2026-08-06T06:20:36.576402Z","submitted_at":"2026-05-25T17:05:52Z","title":"DRScaffold: Boosting Dense-Scene Reasoning in Lightweight Vision Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T22:53:52.992152Z"},"links":{"cited_paper":"/paper/2403.19838","citing_paper":"/paper/2605.26038"},"observation_digest":"sha256:5f5c1a3ef3c1fa767fce44ebe8c81a33ab628766f3741fb433f3720e8672b95f","observation_id":"4ecdf027-dd4b-4696-915a-5e8691ea5f88","resolution":{"observed_at":"2026-06-29T22:54:00.642046Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19838","last_updated":"2024-05-09T03:27:44Z","snapshot_observed_at":"2026-07-06T17:52:50.835744Z","submitted_at":"2024-03-28T21:18:33Z","title":"Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2403.19838","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.19838","snapshot_observed_at":"2026-07-03T19:58:53.676935Z","title":"arXiv preprint arXiv:2403.19838 (2024)","venue":null,"work_id":"4a6ac5d0-5b96-4101-b68e-4c98f46f0775","year":2024},"citing_paper":{"arxiv_id":"2607.01518","last_updated":"2026-07-01T22:31:10Z","snapshot_observed_at":"2026-08-06T19:26:37.371608Z","submitted_at":"2026-07-01T22:31:10Z","title":"Overthink-Triggered Slowdown Attacks on LVLM-Based Robotic Systems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-03T19:52:11.018335Z"},"links":{"cited_paper":"/paper/2403.19838","citing_paper":"/paper/2607.01518"},"observation_digest":"sha256:bac4ef28a1090c2ea93e44fa99e8e217197237e476e220a9490ba55710226888","observation_id":"0ee4793b-e8c0-4736-b6a8-dbe96887c7a6","resolution":{"observed_at":"2026-07-03T19:58:53.678546Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19838","last_updated":"2024-05-09T03:27:44Z","snapshot_observed_at":"2026-07-06T17:52:50.835744Z","submitted_at":"2024-03-28T21:18:33Z","title":"Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19838","snapshot_observed_at":"2026-08-01T12:01:33.235532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19701","last_updated":"2026-07-22T03:05:32Z","snapshot_observed_at":"2026-08-08T08:25:11.085908Z","submitted_at":"2026-07-22T03:05:32Z","title":"SafeGen: Goal-Conditioned Video Diffusion of Safety-Critical Scenarios for VLM-Based Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T12:01:33.235532Z"},"links":{"cited_paper":"/paper/2403.19838","citing_paper":"/paper/2607.19701"},"observation_digest":"sha256:1b963fd1c945aa2ecc9650e8cd922928a42276c7d820188e0d186388c0767085","observation_id":"fb82333b-ec35-4722-bc0f-66543283ef2f","resolution":{"observed_at":"2026-08-01T12:01:33.235532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.19838/citation-record","integrity":"/paper/2403.19838/integrity","json":"/paper/2403.19838/citation-record.json","paper":"/paper/2403.19838"},"outbound":[],"paper":{"arxiv_id":"2403.19838","last_updated":"2024-05-09T03:27:44Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T17:52:50.835744Z","submitted_at":"2024-03-28T21:18:33Z","title":"Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2403.19838."}