{"as_of":"2026-08-08T18:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:32be5512f8e34b17dbf1acb1b5f5d37c7fad715cf428a2172749b1e536ac4738","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T19:34:24.666268Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16938/citation-record","integrity":"/paper/2607.16938/integrity","json":"/paper/2607.16938/citation-record.json","paper":"/paper/2607.16938"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:20.116517Z","title":"Geiger, P","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:20.116517Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:1a1d996cdc9503a6f6b53936a0121953eb8596d8ba77b5fd79747556f3ac840c","observation_id":"8271537e-40cd-4efd-a7df-52bcec64b9a2","resolution":{"observed_at":"2026-08-01T19:34:20.116517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:20.189143Z","title":"Caesar, V","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:20.189143Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:afcd6d8145665001091a044de923a2e30f5d6bb98c69d5c58158df42adbd9360","observation_id":"ba40a61b-b26d-4c54-a89e-932e98453e9e","resolution":{"observed_at":"2026-08-01T19:34:20.189143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:20.286307Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:20.286307Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:d5649ccbe8a71663d7e2141d2a64941f1222b66c48ce294591951d233bc26ec8","observation_id":"5f035aad-de0a-47ea-aaef-132d3126bae8","resolution":{"observed_at":"2026-08-01T19:34:20.286307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:20.409854Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:20.409854Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:a0e3f0b6a84a4f0432dfa4193ac78e073f6507c6ca0b7c6d266d1e0c3d44ee5a","observation_id":"cc919111-8e2b-4805-acaf-ebb25f0079a7","resolution":{"observed_at":"2026-08-01T19:34:20.409854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:20.526699Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:20.526699Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:0c73fafac6c5a19f4e821e3f410cd663503a1ef8788ddda94ecf7e44f50fc61c","observation_id":"c04578cb-7546-4966-b84a-e06fed04f49b","resolution":{"observed_at":"2026-08-01T19:34:20.526699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:20.603799Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:20.603799Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:30ab9953c7b0c27a3c53f00d38ba2d2d1e934e223df7a9e60b8b977ee7c05c36","observation_id":"cf4b3e37-f6ba-48d0-9155-2e37426f32d4","resolution":{"observed_at":"2026-08-01T19:34:20.603799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:20.662423Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:20.662423Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:cbcd8ccb2c2a656b45c558a4cc2282c08761a121473d459e7c35434cef522f38","observation_id":"bf10c83b-bb21-44c2-a6f0-160bdc9751ed","resolution":{"observed_at":"2026-08-01T19:34:20.662423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:20.759953Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:20.759953Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:67d14d2684226c5d428a88e32b4c949d09d1a3ed8003bd32153a48ba8501a405","observation_id":"3aea71dc-0b12-45ac-84f6-35a9c5f4e64a","resolution":{"observed_at":"2026-08-01T19:34:20.759953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:20.859924Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:20.859924Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:3a9c63c3eef852089ac761acb78466384296170621cceff3846b8a595f0a68c0","observation_id":"c8dfc3cc-5b2c-4179-8e15-6d3b3b704a73","resolution":{"observed_at":"2026-08-01T19:34:20.859924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:20.932272Z","title":"EMMA: End-to-end multimodal model for autonomous driving, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:20.932272Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:cd9747501a3e7c2460dd3999a2e4cd502442e35628d9f1f4e6af8378540ca13b","observation_id":"93aed823-989c-4808-bdbc-7a4a96ee3337","resolution":{"observed_at":"2026-08-01T19:34:20.932272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:21.004691Z","title":"de Haan, D","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:21.004691Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:875b7dacb8a8277168880846ac230803e9f4a9bc5b9c72539e814a3b3bb6b2bf","observation_id":"580cd4c1-21eb-4e1f-85a4-b27c2342ed6e","resolution":{"observed_at":"2026-08-01T19:34:21.004691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:21.116346Z","title":"Bansal, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:21.116346Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:fc0ac940a88fe0ea5304b2fdfe1e959316a53551c4450db04a714e2e945eea01","observation_id":"a87c3828-e785-42f1-8be4-a81281d80d4f","resolution":{"observed_at":"2026-08-01T19:34:21.116346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:21.249090Z","title":"Roelofs, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:21.249090Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:a6d58f80077fecc96a1f0796a93a524fe7c2a0802e36c6eedb47e6b2d57b29c3","observation_id":"3ce73b01-c684-4830-95f7-26f722ff4d7d","resolution":{"observed_at":"2026-08-01T19:34:21.249090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6034","last_updated":"2014-04-19T11:54:52Z","snapshot_observed_at":"2026-07-06T03:31:30.452356Z","submitted_at":"2013-12-20T16:45:54Z","title":"Deep Inside Convolutional Networks: Visualising Image Classification Models and Saliency Maps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6034","snapshot_observed_at":"2026-08-01T19:34:21.329443Z","title":"Simonyan, A","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:21.329443Z"},"links":{"cited_paper":"/paper/1312.6034","citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:cd515e8d4131aa05c67fca5612f23b481410015e09bf7724dd7118b1e31130c5","observation_id":"2c8ebc9d-7dcf-4abf-b4c8-4e797328a6e2","resolution":{"observed_at":"2026-08-01T19:34:21.329443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:21.441018Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:21.441018Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:4616256305218ba100fa63eb0759cf39b90652521f5fbcce0ff637796438cc96","observation_id":"a5095898-fcac-4206-b1aa-da5c31dca7fd","resolution":{"observed_at":"2026-08-01T19:34:21.441018Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:21.581713Z","title":"Petsiuk, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:21.581713Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:c12530790f02c88713adb4e0a2c5f533f0f24bc96f372e83c5e7faec7f4c74ae","observation_id":"34b5bd8b-85cf-42f2-b220-824aa9919b43","resolution":{"observed_at":"2026-08-01T19:34:21.581713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07874","last_updated":"2017-11-25T03:53:32Z","snapshot_observed_at":"2026-07-06T05:43:42.722222Z","submitted_at":"2017-05-22T17:38:10Z","title":"A Unified Approach to Interpreting Model Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07874","snapshot_observed_at":"2026-08-01T19:34:21.661079Z","title":"Lundberg and S.-I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:21.661079Z"},"links":{"cited_paper":"/paper/1705.07874","citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:2c0722a4cc6331bbf7c9521446a4d78ad86d0bdab80087d6032e1dc243b21454","observation_id":"7914dd93-49e0-41d7-8fce-4524a094503b","resolution":{"observed_at":"2026-08-01T19:34:21.661079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:21.722187Z","title":"Greer, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:21.722187Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:b4355614a62a9abdb903c00e69ca03771d154f2f8093384ec87f2fe062fc6b7e","observation_id":"5b9c144a-18f8-42ce-b1df-befcc879df4e","resolution":{"observed_at":"2026-08-01T19:34:21.722187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:21.781751Z","title":"Greer, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:21.781751Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:52710bfcc3b3ae8a039abc22d0c57a611c74bb823ad4c769c0bd3f5565e9a235","observation_id":"03386a9b-bddd-4848-8bb9-45f03c95d1d9","resolution":{"observed_at":"2026-08-01T19:34:21.781751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:21.860663Z","title":"Greer, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:21.860663Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:ded31b6fcec86f140d6cd385f7d5c2c644671e252961fbef46b99996f94b2138","observation_id":"acf94a9a-4f80-4390-9acf-ce73dde38dd2","resolution":{"observed_at":"2026-08-01T19:34:21.860663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:21.956117Z","title":"Chang, E","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:21.956117Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:1e60d1ce80506f32b676e721b9181c103d4dcaafbb024f09f3df739a42fd28ea","observation_id":"201201ac-46cb-4e73-94d5-f77ba340cda4","resolution":{"observed_at":"2026-08-01T19:34:21.956117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v34i07.6982","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Zhang, W","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"a9ad54d2-a56b-44c9-a8a5-5155aaeef560","year":2020},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:22.035060Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:ac2be4305c3ddb07eaf18f7bd04d2eb39d89fe43de57017f1a0d772be9ae336c","observation_id":"cc18edd1-206e-43b3-bd9d-63a28cb05501","resolution":{"observed_at":"2026-08-01T19:38:43.073160Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07161","last_updated":"2021-11-11T01:58:26Z","snapshot_observed_at":"2026-08-07T21:00:48.945681Z","submitted_at":"2021-09-15T08:54:29Z","title":"Resolution-robust Large Mask Inpainting with Fourier Convolutions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07161","snapshot_observed_at":"2026-08-01T19:34:22.129212Z","title":"Suvorov, E","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:22.129212Z"},"links":{"cited_paper":"/paper/2109.07161","citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:7c1d43cc31a5aa6624d1e238c8d6cc41f0814e4d8ac589c6a4fa59c0cd211557","observation_id":"796b5949-d6f4-4f94-a4ac-e76414f6352d","resolution":{"observed_at":"2026-08-01T19:34:22.129212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-01T19:34:22.219284Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:22.219284Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:8e18b9299a67d9ee30c091469320c5ea888f75f294aff47ff09f50ce16838e31","observation_id":"ffe3da43-1365-4ab2-80d2-af16863c6375","resolution":{"observed_at":"2026-08-01T19:34:22.219284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:22.291408Z","title":"Greer, N","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:22.291408Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:b73763954ce5fa97c1985ace3fe936e988e0c9c8ec7fc7f292951940f3be1b89","observation_id":"5adb61e6-8995-4bc3-aef1-12baaff420ca","resolution":{"observed_at":"2026-08-01T19:34:22.291408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:22.360791Z","title":"Elhage, N","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:22.360791Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:6352ca9fe3ff7aafbe5deb2512bd094d6d051becffb6572ad5741f5cdfbc8611","observation_id":"10a6ac54-d6a3-48c2-b28a-19a9e18acebd","resolution":{"observed_at":"2026-08-01T19:34:22.360791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:22.460076Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:22.460076Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:3acc1d61380af5be14d4b1e866b02f205fd6c2e14a0d10f779d1ebb32a293433","observation_id":"950219bb-1f11-455a-a0db-863dad372bf7","resolution":{"observed_at":"2026-08-01T19:34:22.460076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:22.543677Z","title":"Bricken, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:22.543677Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:785d05da6d56382374a3217151a31e466be44bd9d3ef80ed2bb1e651de7f7f6a","observation_id":"782fc07f-e3eb-4879-8bec-438701dc129b","resolution":{"observed_at":"2026-08-01T19:34:22.543677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:22.694078Z","title":"Cunningham, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:22.694078Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:8607470a483521161813ab07382b4d7bbbbb682339d1315f22d922c3205d16e6","observation_id":"29c89ce5-9325-48e0-bc7a-0ee13266845c","resolution":{"observed_at":"2026-08-01T19:34:22.694078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:22.757703Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:22.757703Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:5a877aa745e8ffaa5bdd2d355f979aa74a5ad83f73428db3c9f17b02f8446646","observation_id":"1a5c92c2-c515-4397-9f7a-efbe54832461","resolution":{"observed_at":"2026-08-01T19:34:22.757703Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:22.831579Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:22.831579Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:bdd2533849fac852043e859bce01fecd9af608bf657f4e8947de3d1af80e3720","observation_id":"bc1eba0f-1187-4c17-ad57-cbf30e85427c","resolution":{"observed_at":"2026-08-01T19:34:22.831579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:22.937202Z","title":"Zhang, Z","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:22.937202Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:c519f3c08836b4e9bce8d2463e210345553ee4b0f5480ef1860ae5e2ccbc6086","observation_id":"dc531b04-9074-4be3-8d7f-a09bb04e9cb6","resolution":{"observed_at":"2026-08-01T19:34:22.937202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:23.119157Z","title":"Alpamayo-R1: Bridging reasoning and action prediction for generalizable autonomous driving in the long tail, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:23.119157Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:5bccbb5f3d657fdf7f8426678a2bb84567f1e5af3971aa613e72461aa78ec9ba","observation_id":"a4ec5622-ba77-4732-8bba-278433217db2","resolution":{"observed_at":"2026-08-01T19:34:23.119157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:23.273579Z","title":"NVIDIA Alpamayo: Open reasoning vision-language-action models for au- tonomous vehicle development.https://developer.nvidia.com/drive/alpamayo, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:23.273579Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:9e215f767882f0c0a8fe203af78398d311aa6cffbca66d29f0aaae8e6f56c780","observation_id":"d6fc080d-82e8-4fe9-96b2-67162d537d7e","resolution":{"observed_at":"2026-08-01T19:34:23.273579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:23.404625Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:23.404625Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:109677035f2a29aedc836404f08bbf7d4d3d8d36506d665b7fce2925c9db0dee","observation_id":"31a75ac6-bbce-4512-b9f2-e00df6eb623c","resolution":{"observed_at":"2026-08-01T19:34:23.404625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:23.533442Z","title":"Goldshmidt","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:23.533442Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:e6af02bfb7368a9dfc8943769abf0bbc855f7b7ea4024df175e8e4096799f6ed","observation_id":"5938fe8d-d88d-4ccd-acbe-2a12d5633af6","resolution":{"observed_at":"2026-08-01T19:34:23.533442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16320","last_updated":"2025-02-07T20:56:08Z","snapshot_observed_at":"2026-07-06T18:35:49.991098Z","submitted_at":"2024-06-24T05:13:19Z","title":"What Do VLMs NOTICE? A Mechanistic Interpretability Pipeline for Gaussian-Noise-free Text-Image Corruption and Evaluation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16320","snapshot_observed_at":"2026-08-01T19:34:23.641134Z","title":"Golovanevsky, W","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:23.641134Z"},"links":{"cited_paper":"/paper/2406.16320","citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:98a6c17b63c6bab4aad39e6d98fcc317964ad2baa14b5ffcd3a667dc50b8de6c","observation_id":"bf8d34d4-5244-45c0-b470-6d083ddf2223","resolution":{"observed_at":"2026-08-01T19:34:23.641134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:23.813763Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:23.813763Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:052c104b47172738fdaa2d1f9821671cf90c5d311cb6a4b77324550ed52b0553","observation_id":"2fdeae6f-3c67-44bc-9a3c-89d0828038e5","resolution":{"observed_at":"2026-08-01T19:34:23.813763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:23.940252Z","title":"Jocher, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:23.940252Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:a698ec34bf6ea302127d374f052126f137a45b5be0578b4a91aebbb68e55bd6d","observation_id":"097f57a4-d590-4fae-96ae-dbb98fe33bcf","resolution":{"observed_at":"2026-08-01T19:34:23.940252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:24.077883Z","title":"Gemini image generation and editing.https://deepmind.google/ technologies/gemini/, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:24.077883Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:9a1573e15212f9c83248967f9bc3d461f6f22cf2b08f623f062c3d3dfee9e990","observation_id":"f43ffaa2-5442-4263-ad94-5e530a4693b8","resolution":{"observed_at":"2026-08-01T19:34:24.077883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:24.216856Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:24.216856Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:1f07378c0e1a04959b4eb3bf4efcac315bd4807b8f7a6534aa84065fc44d9352","observation_id":"2dcd5c95-6234-4e35-a0a9-653a5ab8e6b2","resolution":{"observed_at":"2026-08-01T19:34:24.216856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:24.329428Z","title":"Palit, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:24.329428Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:cabf04c31d0960d3b23bbe51f22bf7a0fedb4bc2e0b0caa28421670272722e85","observation_id":"c39be317-c672-49e2-ae30-f8f8c1963f8b","resolution":{"observed_at":"2026-08-01T19:34:24.329428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-07T20:47:24.920552Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-08-01T19:34:24.408268Z","title":"H ¨aon, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:24.408268Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:371b4da568bbcbee4a0d8e10aef345aa845501e63c155ae3f3fa528e9eeb9307","observation_id":"54089362-2ad1-4a2c-987a-061ef16fd07d","resolution":{"observed_at":"2026-08-01T19:34:24.408268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:24.564693Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:24.564693Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:2d35598b676e8f681ac6f191b8a441d4b9a855796eb35116432195143a3eccc3","observation_id":"ed8baad2-d30d-4130-9197-7807a523de95","resolution":{"observed_at":"2026-08-01T19:34:24.564693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:34:24.666268Z","title":"Interpreting gpt: The logit lens.https://www.lesswrong.com/posts/ AcKRB8wDpdaN6v6ru/interpreting-gpt-the-logit-lens, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T19:34:24.666268Z"},"links":{"citing_paper":"/paper/2607.16938"},"observation_digest":"sha256:bac3077bd16df659df2695e3d07bd473aea4937bd43a7b77f6647abb31c1b46f","observation_id":"f8c9550c-4ca6-4858-b720-ab84305064c9","resolution":{"observed_at":"2026-08-01T19:34:24.666268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16938","last_updated":"2026-07-18T19:20:16Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T20:47:51.804388Z","submitted_at":"2026-07-18T19:20:16Z","title":"What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2607.16938."}