{"as_of":"2026-08-07T18:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:35abe3db093f9cc34462e84564376cbe23847ef2c9ee30e9c9755e4b87891459","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:03:01.498534Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-05T11:41:02.531094Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-08-07T14:03:01.498534Z","title":"Drivemllm: A benchmark for spatial understanding with multi- modal large language models in autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20223","last_updated":"2025-05-26T17:06:00Z","snapshot_observed_at":"2026-08-07T13:54:37.270545Z","submitted_at":"2025-05-26T17:06:00Z","title":"Chain-of-Thought for Autonomous Driving: A Comprehensive Survey and Future Prospects","version":1},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:01.498534Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2505.20223"},"observation_digest":"sha256:01db1a12176bbdc48899a7b9479fc5f602dddb695f8245a3c3d0f953738bfc3d","observation_id":"b20639d0-f1ba-402c-b8f6-640ef0685b0c","resolution":{"observed_at":"2026-08-07T14:03:01.498534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-08-07T06:02:12.978819Z","title":"DriveMLLM: A Benchmark for Spatial Understanding with Multimodal Large Language Models in Autonomous Driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06218","last_updated":"2025-06-06T16:25:22Z","snapshot_observed_at":"2026-08-07T05:56:07.289023Z","submitted_at":"2025-06-06T16:25:22Z","title":"STSBench: A Spatio-temporal Scenario Benchmark for Multi-modal Large Language Models in Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T06:02:12.978819Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2506.06218"},"observation_digest":"sha256:8b03277d41b0684690f04e1be204e38a7ce47ddb08f61ca97b988a7397bab61f","observation_id":"eebbe239-95f0-44ab-85c8-545ce79f0b2b","resolution":{"observed_at":"2026-08-07T06:02:12.978819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-08-07T04:49:27.407469Z","title":"Drivemllm: A benchmark for spatial understanding with multimodal large language models in autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09557","last_updated":"2025-06-11T09:41:46Z","snapshot_observed_at":"2026-08-07T04:43:14.922978Z","submitted_at":"2025-06-11T09:41:46Z","title":"AD^2-Bench: A Hierarchical CoT Benchmark for MLLM in Autonomous Driving under Adverse Conditions","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:27.407469Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2506.09557"},"observation_digest":"sha256:ec340f2e5184c59ed06ec1076d646680126806dd29d18ce75b9dc64762e1bc5b","observation_id":"8ca8acb1-52dd-469b-81b3-5608c0a4b227","resolution":{"observed_at":"2026-08-07T04:49:27.407469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-08-06T22:22:37.200429Z","title":"International Journal of Computer Vision, 127(4):398–414","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21876","last_updated":"2025-06-27T03:24:29Z","snapshot_observed_at":"2026-08-06T22:14:34.013503Z","submitted_at":"2025-06-27T03:24:29Z","title":"Do Vision-Language Models Have Internal World Models? Towards an Atomic Evaluation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:22:37.200429Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2506.21876"},"observation_digest":"sha256:55c9e9eec8820dcb45431736c33e1a7aabdc6247fabc47caebaea6ebc566ddac","observation_id":"93f01c19-7bb6-40be-94fd-880cabfa4775","resolution":{"observed_at":"2026-08-06T22:22:37.200429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-08-06T21:31:04.449729Z","title":"Drivem- llm: A benchmark for spatial understanding with multi- modal large language models in autonomous driving.arXiv preprint arXiv:2411.13112, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.24044","last_updated":"2025-06-30T16:50:02Z","snapshot_observed_at":"2026-08-07T14:33:37.793120Z","submitted_at":"2025-06-30T16:50:02Z","title":"A Survey on Vision-Language-Action Models for Autonomous Driving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:31:04.449729Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2506.24044"},"observation_digest":"sha256:99805721c886e885cdb29fae887d41d3057207449d5a8c6d313744e763cf3350","observation_id":"cbe35daa-af34-47e7-9f69-a5ff07a714ed","resolution":{"observed_at":"2026-08-06T21:31:04.449729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":"2411.13112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-07-05T11:41:02.531094Z","title":"Surds: Benchmarking spatial un- derstanding and reasoning in driving scenarios with vision language models","venue":"cs.CV","work_id":"f4ca6aea-f1e8-4324-8d9b-eb9f9da7bc3e","year":2024},"citing_paper":{"arxiv_id":"2511.13397","last_updated":"2026-05-14T14:41:56Z","snapshot_observed_at":"2026-07-06T22:36:00.635873Z","submitted_at":"2025-11-17T14:12:22Z","title":"Descriptor: Distance-Annotated Traffic Perception Question Answering (DTPQA)","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T21:43:30.762291Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2511.13397"},"observation_digest":"sha256:f1172c2d4f426ac7518a241dfd6d5b67c0429cabfa179e51c9262d2997e034eb","observation_id":"aa0a3c5e-1280-4dab-90ea-ba742cf20f41","resolution":{"observed_at":"2026-05-17T21:45:17.951962Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":"2411.13112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-07-05T11:41:02.531094Z","title":"Surds: Benchmarking spatial un- derstanding and reasoning in driving scenarios with vision language models","venue":"cs.CV","work_id":"f4ca6aea-f1e8-4324-8d9b-eb9f9da7bc3e","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:83ba09e3b89a35cb1ec9e46d46ec18d44ee564337022643295e3591216c2ce33","observation_id":"7449410f-6457-4048-a8a8-a6799a105b49","resolution":{"observed_at":"2026-05-16T22:38:37.804166Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-08-02T21:19:52.060215Z","title":"Surds: Benchmarking spatial understanding and reasoning in driving scenarios with vision language models[J]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.20575","last_updated":"2026-07-18T07:58:59Z","snapshot_observed_at":"2026-08-07T11:27:35.926728Z","submitted_at":"2026-02-24T05:57:18Z","title":"An interactive enhanced driving dataset for autonomous driving","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T21:19:52.060215Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2602.20575"},"observation_digest":"sha256:7c55490f71e47d9d6b4d1b59ade09b72937156d4a5fbc54ee9756704549e5d1c","observation_id":"624c840c-8a1e-4105-b78e-053479912634","resolution":{"observed_at":"2026-08-02T21:19:52.060215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":"2411.13112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-07-05T11:41:02.531094Z","title":"Surds: Benchmarking spatial un- derstanding and reasoning in driving scenarios with vision language models","venue":"cs.CV","work_id":"f4ca6aea-f1e8-4324-8d9b-eb9f9da7bc3e","year":2024},"citing_paper":{"arxiv_id":"2603.26788","last_updated":"2026-04-07T12:54:16Z","snapshot_observed_at":"2026-07-29T19:31:37.171779Z","submitted_at":"2026-03-25T09:07:32Z","title":"ReMemNav: A Rethinking and Memory-Augmented Framework for Zero-Shot Object Navigation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T01:10:04.549713Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2603.26788"},"observation_digest":"sha256:fa17b2e93ff9078310838cc8da5d404e6ba783ea0fc19cbd9233425522476b7e","observation_id":"c2dc931a-51bd-4fee-a5ca-062f53ae03e1","resolution":{"observed_at":"2026-05-15T01:13:26.291769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":"2411.13112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-07-05T11:41:02.531094Z","title":"Surds: Benchmarking spatial un- derstanding and reasoning in driving scenarios with vision language models","venue":"cs.CV","work_id":"f4ca6aea-f1e8-4324-8d9b-eb9f9da7bc3e","year":2024},"citing_paper":{"arxiv_id":"2604.18483","last_updated":"2026-07-01T12:23:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-20T16:35:57Z","title":"Steadily moving semi-infinite fracture in plane poroelasticity","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-05T11:39:05.686584Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2604.18483"},"observation_digest":"sha256:cceb4ed8b1d2e735edbb56dfa19d350e2e9ffea97f3fcb78f23c78d9ea91d014","observation_id":"918ab193-8b0f-4eb9-905a-3b306e50bcc2","resolution":{"observed_at":"2026-07-05T11:41:02.533066Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":"2411.13112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-07-05T11:41:02.531094Z","title":"Surds: Benchmarking spatial un- derstanding and reasoning in driving scenarios with vision language models","venue":"cs.CV","work_id":"f4ca6aea-f1e8-4324-8d9b-eb9f9da7bc3e","year":2024},"citing_paper":{"arxiv_id":"2604.18484","last_updated":"2026-04-20T16:37:16Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T16:37:16Z","title":"XEmbodied: A Foundation Model with Enhanced Geometric and Physical Cues for Large-Scale Embodied Environments","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T05:46:36.865150Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2604.18484"},"observation_digest":"sha256:eb41e2b6c9e5e2dbf34cd9e51f1d9cfe0f10a790c6dc947802be9569b1e2736f","observation_id":"3df79033-181c-4197-b12f-4cc3916e3d33","resolution":{"observed_at":"2026-05-10T05:51:10.345677Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":"2411.13112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-07-05T11:41:02.531094Z","title":"Surds: Benchmarking spatial un- derstanding and reasoning in driving scenarios with vision language models","venue":"cs.CV","work_id":"f4ca6aea-f1e8-4324-8d9b-eb9f9da7bc3e","year":2024},"citing_paper":{"arxiv_id":"2605.27038","last_updated":"2026-05-26T13:56:31Z","snapshot_observed_at":"2026-07-06T23:36:48.467513Z","submitted_at":"2026-05-26T13:56:31Z","title":"TPS-Drive: Task-Guided Representation Purification for VLM-based Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T17:42:49.902997Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2605.27038"},"observation_digest":"sha256:4ed9e98b453e4ceae13253bc8e04e37a67f00ed6414a43c8a33ea27dc6d095aa","observation_id":"1a4c4179-c0d0-4476-b469-3c0481d825ea","resolution":{"observed_at":"2026-06-29T17:43:45.768968Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":"2411.13112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-07-05T11:41:02.531094Z","title":"Surds: Benchmarking spatial un- derstanding and reasoning in driving scenarios with vision language models","venue":"cs.CV","work_id":"f4ca6aea-f1e8-4324-8d9b-eb9f9da7bc3e","year":2024},"citing_paper":{"arxiv_id":"2606.02774","last_updated":"2026-06-01T18:36:46Z","snapshot_observed_at":"2026-08-06T21:46:55.137951Z","submitted_at":"2026-06-01T18:36:46Z","title":"GeoDrive-Bench: Benchmarking Region-Specific Multimodal Reasoning in Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T14:45:54.904876Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2606.02774"},"observation_digest":"sha256:1a2b520ef9665411723f908146641aadabe193639247fe17f8c59e4e35060723","observation_id":"4ced8d38-0d57-4da6-b6bc-480907a4a2c7","resolution":{"observed_at":"2026-07-01T23:06:19.751088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":"2411.13112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-07-05T11:41:02.531094Z","title":"Surds: Benchmarking spatial un- derstanding and reasoning in driving scenarios with vision language models","venue":"cs.CV","work_id":"f4ca6aea-f1e8-4324-8d9b-eb9f9da7bc3e","year":2024},"citing_paper":{"arxiv_id":"2606.30378","last_updated":"2026-06-29T14:38:20Z","snapshot_observed_at":"2026-07-07T00:04:15.048683Z","submitted_at":"2026-06-29T14:38:20Z","title":"OmniCoT: A Benchmark for Global and Multi-Step Panoramic Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T06:11:09.693576Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2606.30378"},"observation_digest":"sha256:f2116efcf333a5326b07827467005fa96c560867677077168d2df511bd10638c","observation_id":"8ac895a7-775b-4f57-9b14-430feb713e20","resolution":{"observed_at":"2026-06-30T06:14:19.093831Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-08-06T00:08:21.164171Z","title":"Drivemllm: A benchmark for spatial under- standing with multimodal large language models in autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01535","last_updated":"2026-08-02T23:02:06Z","snapshot_observed_at":"2026-08-06T23:26:59.580246Z","submitted_at":"2026-08-02T23:02:06Z","title":"STAR-VLM: Spatiotemporal Grounding Vision-Language Models for Motion and Velocity Estimation via Automotive Radar Supervision","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:08:21.164171Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2608.01535"},"observation_digest":"sha256:52777e572c62b6a3f0a4133b7339c05b12ef0d0a92f282602ccdfcf01a2d5bd9","observation_id":"a667e433-03bf-4d1e-b049-b539811a5124","resolution":{"observed_at":"2026-08-06T00:08:21.164171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.13112/citation-record","integrity":"/paper/2411.13112/integrity","json":"/paper/2411.13112/citation-record.json","paper":"/paper/2411.13112"},"outbound":[],"paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2411.13112."}