{"as_of":"2026-08-08T13:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:965ff94f5d17351f8fd7222dacd2643cc229e816accd8601639fdac9e16ad00a","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:17:37.155533Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T21:12:28.565090Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T23:02:46.934447Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05883","snapshot_observed_at":"2026-08-02T21:12:28.565090Z","title":"Hmvlm: Multistage reasoning-enhanced vision- language model for long-tailed driving scenarios","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.21172","last_updated":"2026-06-05T21:24:23Z","snapshot_observed_at":"2026-08-08T11:22:10.018312Z","submitted_at":"2026-02-24T18:17:21Z","title":"NoRD: A Data-Efficient Vision-Language-Action Model that Drives without Reasoning","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T21:12:28.565090Z"},"links":{"cited_paper":"/paper/2506.05883","citing_paper":"/paper/2602.21172"},"observation_digest":"sha256:43e14cf046349f870e6d6a61c51752047219acbaa380015edc881d3a47b629e9","observation_id":"f4793115-5db0-4ddb-a436-315f54075697","resolution":{"observed_at":"2026-08-02T21:12:28.565090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"cited_work":{"arxiv_id":"2506.05883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05883","snapshot_observed_at":"2026-06-28T23:02:46.934447Z","title":"arXiv preprint arXiv:2506.05883 , year=","venue":null,"work_id":"4b0d839b-cf2a-4d31-be86-a0aab6efb311","year":2025},"citing_paper":{"arxiv_id":"2605.12622","last_updated":"2026-05-14T17:59:01Z","snapshot_observed_at":"2026-08-02T07:45:26.844246Z","submitted_at":"2026-05-12T18:09:04Z","title":"Action Emergence from Streaming Intent","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-14T20:59:42.456958Z"},"links":{"cited_paper":"/paper/2506.05883","citing_paper":"/paper/2605.12622"},"observation_digest":"sha256:8d4143eee6b2aca2ffe8435b3d8bb912941d4fba21e5a6adb93310902fd4bb79","observation_id":"e26871c1-1573-49e7-9ba9-76229a56de1f","resolution":{"observed_at":"2026-05-14T21:02:59.109706Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"cited_work":{"arxiv_id":"2506.05883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05883","snapshot_observed_at":"2026-06-28T23:02:46.934447Z","title":"arXiv preprint arXiv:2506.05883 , year=","venue":null,"work_id":"4b0d839b-cf2a-4d31-be86-a0aab6efb311","year":2025},"citing_paper":{"arxiv_id":"2605.12622","last_updated":"2026-05-14T17:59:01Z","snapshot_observed_at":"2026-08-02T07:45:26.844246Z","submitted_at":"2026-05-12T18:09:04Z","title":"Action Emergence from Streaming Intent","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-15T05:13:44.795483Z"},"links":{"cited_paper":"/paper/2506.05883","citing_paper":"/paper/2605.12622"},"observation_digest":"sha256:17d61d5e7c5077869bb37a0c36bfdbdf14490f376da5a07090f3707db8af5207","observation_id":"1da9637a-cbdc-42c7-8af0-cd541d13d649","resolution":{"observed_at":"2026-05-15T05:15:02.933927Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"cited_work":{"arxiv_id":"2506.05883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05883","snapshot_observed_at":"2026-06-28T23:02:46.934447Z","title":"arXiv preprint arXiv:2506.05883 , year=","venue":null,"work_id":"4b0d839b-cf2a-4d31-be86-a0aab6efb311","year":2025},"citing_paper":{"arxiv_id":"2605.12624","last_updated":"2026-05-14T17:59:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T18:09:42Z","title":"MindVLA-U1: VLA Beats VA with Unified Streaming Architecture for Autonomous Driving","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-14T20:54:50.887381Z"},"links":{"cited_paper":"/paper/2506.05883","citing_paper":"/paper/2605.12624"},"observation_digest":"sha256:1749390974c78d5fe294d2ed9c18e88fcac5163cad05c2517d4b2b1e0143764e","observation_id":"885f1345-7842-4f9b-8277-6f1ed710cde2","resolution":{"observed_at":"2026-05-14T20:59:28.338032Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"cited_work":{"arxiv_id":"2506.05883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05883","snapshot_observed_at":"2026-06-28T23:02:46.934447Z","title":"arXiv preprint arXiv:2506.05883 , year=","venue":null,"work_id":"4b0d839b-cf2a-4d31-be86-a0aab6efb311","year":2025},"citing_paper":{"arxiv_id":"2605.12624","last_updated":"2026-05-14T17:59:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T18:09:42Z","title":"MindVLA-U1: VLA Beats VA with Unified Streaming Architecture for Autonomous Driving","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-15T05:07:58.953866Z"},"links":{"cited_paper":"/paper/2506.05883","citing_paper":"/paper/2605.12624"},"observation_digest":"sha256:9dcabb6dbaf45ccea59e169ebdd534143bf955b391a4335d83ccfddcfee73e8e","observation_id":"37a9b975-654b-4b0f-a209-1fc136e6f53a","resolution":{"observed_at":"2026-05-15T05:09:45.390320Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"cited_work":{"arxiv_id":"2506.05883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05883","snapshot_observed_at":"2026-06-28T23:02:46.934447Z","title":"arXiv preprint arXiv:2506.05883 , year=","venue":null,"work_id":"4b0d839b-cf2a-4d31-be86-a0aab6efb311","year":2025},"citing_paper":{"arxiv_id":"2605.31116","last_updated":"2026-05-29T10:27:32Z","snapshot_observed_at":"2026-08-02T02:51:10.320818Z","submitted_at":"2026-05-29T10:27:32Z","title":"NTR: Neural Token Reconstruction for Scene Token Bottleneck in End-to-End Driving","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T22:57:01.742536Z"},"links":{"cited_paper":"/paper/2506.05883","citing_paper":"/paper/2605.31116"},"observation_digest":"sha256:77b129bf9783a2217877f7fa19c2ad493b2caf0d33fa72e5d6758dba1cc3440e","observation_id":"e0dada4d-c031-46c6-8470-896fd16e5ef0","resolution":{"observed_at":"2026-06-28T23:02:46.935701Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.05883/citation-record","integrity":"/paper/2506.05883/integrity","json":"/paper/2506.05883/citation-record.json","paper":"/paper/2506.05883"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T10:17:35.974514Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:35.974514Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:13faae58d596c1b17c1948a8e990e64fcc40b4617ec9bf70ec4fefdcbc1e0764","observation_id":"7aaf111c-0015-400e-95b6-195e1789067d","resolution":{"observed_at":"2026-08-07T10:17:35.974514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:17:38.052300Z","title":"Vlmevalkit: An open-source toolkit for evaluating large multi-modality models","venue":null,"work_id":"f40395ce-2f25-40d3-ad0e-fe6c00d94da0","year":2024},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:36.029742Z"},"links":{"citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:b2d36ce3430ed05dedf0171920c809e5afefd380b7ad2e55ebf4333ae97d8f01","observation_id":"234b758d-13b7-4279-bb4f-69ab2e2b4c1b","resolution":{"observed_at":"2026-08-07T10:17:38.126413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23262","last_updated":"2025-09-23T04:19:59Z","snapshot_observed_at":"2026-08-05T06:31:46.069300Z","submitted_at":"2024-10-30T17:46:31Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23262","snapshot_observed_at":"2026-08-07T10:17:36.133717Z","title":"Emma: End-to-end multimodal model for autonomous driving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:36.133717Z"},"links":{"cited_paper":"/paper/2410.23262","citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:ade0a9dae1a4ff24b780eb90c23cc1fc62d9ed7c769af11debeab5963a59e477","observation_id":"498bbcf9-55e1-4e33-a5b3-86479a254546","resolution":{"observed_at":"2026-08-07T10:17:36.133717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:17:36.227403Z","title":"Vad: Vectorized scene representa- tion for efficient autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:36.227403Z"},"links":{"citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:8a586febdcf28a1c130e991601aa41a1d7c03fe991c36d32bac78284fdb3d974","observation_id":"4348ceac-57e5-4328-9fa5-966bd156d144","resolution":{"observed_at":"2026-08-07T10:17:36.227403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22313","last_updated":"2024-10-29T17:53:56Z","snapshot_observed_at":"2026-07-31T01:16:26.372370Z","submitted_at":"2024-10-29T17:53:56Z","title":"Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22313","snapshot_observed_at":"2026-08-07T10:17:36.360513Z","title":"Senna: Bridging large vision-language mod- els and end-to-end autonomous driving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:36.360513Z"},"links":{"cited_paper":"/paper/2410.22313","citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:83fc99955340cac516c598cd74d15666ec98f77770f4575b8cd263bbfcc3824e","observation_id":"19b53aff-7b85-46c1-a293-1a2b827d9b71","resolution":{"observed_at":"2026-08-07T10:17:36.360513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07608","last_updated":"2025-03-10T17:59:42Z","snapshot_observed_at":"2026-08-01T16:55:41.453922Z","submitted_at":"2025-03-10T17:59:42Z","title":"AlphaDrive: Unleashing the Power of VLMs in Autonomous Driving via Reinforcement Learning and Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07608","snapshot_observed_at":"2026-08-07T10:17:36.438890Z","title":"Alphadrive: Unleashing the power of vlms in autonomous driving via reinforcement learning and reason- ing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:36.438890Z"},"links":{"cited_paper":"/paper/2503.07608","citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:b9dc465ae7d70619c6b2e22c797e63238a3b1d03044fee7a7b4635ba14e2436b","observation_id":"a91321a4-5de0-4db9-a954-38ba7e17d20d","resolution":{"observed_at":"2026-08-07T10:17:36.438890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:17:37.840446Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":"2578fba7-1da3-4018-ad56-0e35c1fd577d","year":2023},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:36.520854Z"},"links":{"citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:dfe795a834991a902f7ddd8f02e73c5264620ff3dead3fe56e1485c71c5c30ee","observation_id":"2304d855-f9e5-40ac-b922-144a0fd49286","resolution":{"observed_at":"2026-08-07T10:17:37.929342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:17:37.678114Z","title":"Devel- oping and validating an adaptive multi-layer vehicle trajec- tory reconstruction method for outlier removal","venue":null,"work_id":"00601f64-7b58-4e1b-9090-724bf0f10a89","year":null},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:36.597305Z"},"links":{"citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:97aaf159c4ed5fcf569c35f9adc985d3ba9e5076cc93622adba174aab2ef5443","observation_id":"c22b8cf3-ddea-49d7-9c4f-f521de0ff169","resolution":{"observed_at":"2026-08-07T10:17:37.766009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-07T10:17:36.697142Z","title":"A survey on hallucination in large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:36.697142Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:df57c7fa915d616a4c01fada6e62881f649eef1144d9e516c6c5647c87f0e749","observation_id":"01b998b6-db5c-46e2-ba5c-f471d07c37a1","resolution":{"observed_at":"2026-08-07T10:17:36.697142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:17:37.484881Z","title":"Deepspeed: System optimizations enable train- ing deep learning models with over 100 billion parameters","venue":null,"work_id":"3bb45171-91ac-40e8-a235-52c5ba561b29","year":2020},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:36.774176Z"},"links":{"citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:7bd005a8cf835b71f0047983365ca45cc309d15e5ee1935fa33f3073dc662823","observation_id":"e7f115ff-35e1-4d31-8147-1e959cd0d3c4","resolution":{"observed_at":"2026-08-07T10:17:37.581196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:17:37.333217Z","title":"What is a savitzky-golay filter?[lecture notes]","venue":null,"work_id":"8ef7f6e6-d51e-4c57-8c83-9f69af156825","year":null},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:36.857015Z"},"links":{"citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:dbd0165571d5f3248db0261418e1c25f4f9536e86feb107e691c95482789364a","observation_id":"e3817ae6-5dd3-46b2-b250-d6665932e4ec","resolution":{"observed_at":"2026-08-07T10:17:37.383036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12289","last_updated":"2024-06-25T17:55:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-19T17:04:04Z","title":"DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12289","snapshot_observed_at":"2026-08-07T10:17:36.953338Z","title":"Drivevlm: The convergence of autonomous driving and large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:36.953338Z"},"links":{"cited_paper":"/paper/2402.12289","citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:ce07a52104a988b9d73c728d231ce3025aabd81845f657841d199191531cbff2","observation_id":"52cd9536-bc1e-4d43-9145-a5a67e8ea63b","resolution":{"observed_at":"2026-08-07T10:17:36.953338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:17:37.060777Z","title":"Chain-of-thought prompting elicits reasoning in large lan- guage models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:37.060777Z"},"links":{"citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:81480075fa1a69a49a9f6508891d8761af1ea0d00f1b4ec83837854f8833df93","observation_id":"c65c632d-b867-4fd9-908f-a239a630fecd","resolution":{"observed_at":"2026-08-07T10:17:37.060777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-07T09:36:29.319006Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-08-07T10:17:37.155533Z","title":"Llava-o1: Let vision language models reason step- by-step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:37.155533Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2506.05883"},"observation_digest":"sha256:52a127e9c39940da3051386b0fe0f887f3cf0b1fa29ba39e61e3bcdaa18fe138","observation_id":"57b0c53d-3b16-49f2-b38a-c0d8564911ac","resolution":{"observed_at":"2026-08-07T10:17:37.155533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.05883","last_updated":"2025-06-06T08:51:06Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T10:10:59.259874Z","submitted_at":"2025-06-06T08:51:06Z","title":"HMVLM: Multistage Reasoning-Enhanced Vision-Language Model for Long-Tailed Driving Scenarios"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 6 inbound Pith citation observations for arXiv:2506.05883."}