{"as_of":"2026-08-08T23:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:093737c87e752435c2900f5ecacda579638f9c99ebb247fea1b7c8c156782f6f","coverage":[{"denominator":102,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:54:44.708764Z","state":"measured"},{"denominator":105,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":105,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:05:39.011067Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T07:40:29.033821Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23088","snapshot_observed_at":"2026-08-06T18:05:39.011067Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09174","last_updated":"2025-07-12T07:46:51Z","snapshot_observed_at":"2026-08-06T17:59:50.157396Z","submitted_at":"2025-07-12T07:46:51Z","title":"RAMA: Retrieval-Augmented Multi-Agent Framework for Misinformation Detection in Multimodal Fact-Checking","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:05:39.011067Z"},"links":{"cited_paper":"/paper/2506.23088","citing_paper":"/paper/2507.09174"},"observation_digest":"sha256:de495fa3699423fc9f8fca04fa78ab61ea552d55cf38a6d7aca0571a0cd9d083","observation_id":"06fa43f2-ad5b-4b03-a15f-9eacfc1c6bfe","resolution":{"observed_at":"2026-08-06T18:05:39.011067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"cited_work":{"arxiv_id":"2506.23088","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23088","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Where, what, why: Towards explainable driver attention prediction","venue":null,"work_id":"b37c667d-b612-4f04-8b37-f6d77477c2df","year":2025},"citing_paper":{"arxiv_id":"2508.12043","last_updated":"2025-08-16T13:37:11Z","snapshot_observed_at":"2026-08-02T08:29:05.396468Z","submitted_at":"2025-08-16T13:37:11Z","title":"Talk Less, Fly Lighter: Autonomous Semantic Compression for UAV Swarm Communication via LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T07:37:38.901354Z"},"links":{"cited_paper":"/paper/2506.23088","citing_paper":"/paper/2508.12043"},"observation_digest":"sha256:11e192dc63954b6bfea901158311cd0d84b5296ec8369365a9b772a00f144ba5","observation_id":"97d17781-0799-4788-b535-eea387d61604","resolution":{"observed_at":"2026-05-25T07:40:29.036810Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"cited_work":{"arxiv_id":"2506.23088","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23088","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Where, what, why: Towards explainable driver attention prediction","venue":null,"work_id":"b37c667d-b612-4f04-8b37-f6d77477c2df","year":2025},"citing_paper":{"arxiv_id":"2508.13998","last_updated":"2026-04-06T03:29:44Z","snapshot_observed_at":"2026-08-03T11:31:47.613184Z","submitted_at":"2025-08-19T16:50:01Z","title":"Embodied-R1: Reinforced Embodied Reasoning for General Robotic Manipulation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-18T22:04:34.235731Z"},"links":{"cited_paper":"/paper/2506.23088","citing_paper":"/paper/2508.13998"},"observation_digest":"sha256:0dd02a9ad0fe4f30007a0f92945a7e76e811240259e4f85cee7b7dc84eea3667","observation_id":"9bbf6d4c-7617-4d1a-be6b-49776948cd1c","resolution":{"observed_at":"2026-05-18T22:06:51.611452Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"cited_work":{"arxiv_id":"2506.23088","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23088","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Where, what, why: Towards explainable driver attention prediction","venue":null,"work_id":"b37c667d-b612-4f04-8b37-f6d77477c2df","year":2025},"citing_paper":{"arxiv_id":"2605.07859","last_updated":"2026-05-08T15:20:20Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T15:20:20Z","title":"EyeCue: Driver Cognitive Distraction Detection via Gaze-Empowered Egocentric Video Understanding","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-11T02:27:32.532275Z"},"links":{"cited_paper":"/paper/2506.23088","citing_paper":"/paper/2605.07859"},"observation_digest":"sha256:bc1bd6ea5547ef797d29dbea4bbeae0708c0577f4b2dbd80196567394c2a64f8","observation_id":"3a8f3583-6d87-4098-960b-5a2c044b4e22","resolution":{"observed_at":"2026-05-11T03:30:57.770958Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23088","snapshot_observed_at":"2026-08-01T01:04:36.563566Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25962","last_updated":"2026-07-28T16:45:52Z","snapshot_observed_at":"2026-08-06T09:14:07.805736Z","submitted_at":"2026-07-28T16:45:52Z","title":"LaP-Forensics: Latent-Pixel Consistency Guided Multimodal Reasoning for Deepfake Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T01:04:36.563566Z"},"links":{"cited_paper":"/paper/2506.23088","citing_paper":"/paper/2607.25962"},"observation_digest":"sha256:542ca2d686653d56159b85285d7f874c9d3bad66567d488b27c64433c761132f","observation_id":"5204747e-15bb-492a-8218-1422d45b83ae","resolution":{"observed_at":"2026-08-01T01:04:36.563566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.23088/citation-record","integrity":"/paper/2506.23088/integrity","json":"/paper/2506.23088/citation-record.json","paper":"/paper/2506.23088"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.141881Z","title":"Hammerdrive: A task-aware driving visual attention model","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.141881Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:a16f8c83dd1db352a1efd1fe2eda61f4419c5e10b95cdc357b4f7b7aeb49d67f","observation_id":"b049a423-c3f0-4b52-bbd7-9d91945b147c","resolution":{"observed_at":"2026-08-06T21:54:44.141881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.147239Z","title":"Aragan: A driver attention estimation model based on conditional gen- erative adversarial network","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.147239Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:e1bcea8507e833c5851a97433e5ea54d2d647ec424078c41c73cf73f423b2cc6","observation_id":"f4e9c582-5f65-4f86-b6e4-e0cd65abf2c0","resolution":{"observed_at":"2026-08-06T21:54:44.147239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.152039Z","title":"Medirl: Predicting the visual attention of drivers via maximum entropy deep inverse re- inforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.152039Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:b7cf11a39bfa7ae67357b98c873394de7d20ca28d31da0ad20f64da4da61b72f","observation_id":"42e25dba-f570-4625-911f-273a611b7060","resolution":{"observed_at":"2026-08-06T21:54:44.152039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.157087Z","title":"Drive: Deep reinforced accident anticipation with visual explanation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.157087Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:5d52578c93faefe9d2cac631e22667829148841dbb99fc5950579d75fc905907","observation_id":"f97cfec2-f401-4b62-9cc9-f799fe51d3cb","resolution":{"observed_at":"2026-08-06T21:54:44.157087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.161540Z","title":"Re- current mixture density network for spatiotemporal visual at- tention","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.161540Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:8468a02c692afbcdf6181ab62bf16dc87392195e6df82c2bc247debb27eb3c88","observation_id":"f402f321-e0d9-4d7b-9830-826655d2a11e","resolution":{"observed_at":"2026-08-06T21:54:44.161540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.166053Z","title":"The devil is in the fine- grained details: Evaluating open-vocabulary object detec- tors for fine-grained understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.166053Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:6d62eb2d6d2b59b9696cddd12a4794bf955e023f081b9934683eb22b6026a9d1","observation_id":"b25add0d-ff24-4d50-857c-e3c5846a4a9e","resolution":{"observed_at":"2026-08-06T21:54:44.166053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.170769Z","title":"Trends, applications, and challenges in human attention modelling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.170769Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:3d257c5e0bde1a780d9bfed2c8a214965e1f3a862137fa37bcee5bdf96f8d697","observation_id":"f89498cb-3606-48ef-a8ed-f1e89445c528","resolution":{"observed_at":"2026-08-06T21:54:44.170769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.181293Z","title":"Sharegpt4video: Improving video understand- ing and generation with better captions.NeurIPS, 37:19472– 19495, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.181293Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:feae89a6d40efa752eb40ebe82e71a6cff5089123e124bf6fc632f4a9ec64bca","observation_id":"8d1e3c03-7b2c-482f-87db-ac827298ecd7","resolution":{"observed_at":"2026-08-06T21:54:44.181293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.188186Z","title":"Air: At- tention with reasoning capability","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.188186Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:6febdf8edbf446f7439527d23bd510e8246f0c7622f0abce1e23b9a768edba40","observation_id":"3f739249-8b0b-405e-a512-40d962802869","resolution":{"observed_at":"2026-08-06T21:54:44.188186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.194381Z","title":"Gazexplain: Learn- ing to predict natural language explanations of visual scan- paths","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.194381Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:29ad534b0ee0bee93e2b223a294f1035ccbcd31f99aa414968a4f2e99c981e24","observation_id":"9039b1c1-c39e-401b-b6e0-231cd90266f4","resolution":{"observed_at":"2026-08-06T21:54:44.194381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.200943Z","title":"Fblnet: Feed- back loop network for driver attention prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.200943Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:ccf3f2134d8b3d8362382741bc3fdfc1215725180f4a03aec2b8aec45f6cf2f5","observation_id":"fa3db6d1-915a-4f04-8afa-e66ca902494d","resolution":{"observed_at":"2026-08-06T21:54:44.200943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.205400Z","title":"What do you see in vehicle? comprehensive vi- sion solution for in-vehicle gaze estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.205400Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:56d0cdad4560fa3a393981f64b5b19fd340f9cd87d89ec45212b7b3dcd682b4f","observation_id":"fb72018a-8ddb-4fcf-b501-2e24ac760b02","resolution":{"observed_at":"2026-08-06T21:54:44.205400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.209992Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.209992Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:087b2e666cebefe4443ba97a90825285460296d8360eafc9fe2222903f530797","observation_id":"9d1b0718-a4cc-4c99-8e07-060775584eff","resolution":{"observed_at":"2026-08-06T21:54:44.209992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.220522Z","title":"A survey on multimodal large language models for autonomous driving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.220522Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d6aae8bda4dba689c97de10c885338d285302dd3c581c81c9bbe19ce24118972","observation_id":"88af4eaa-3701-4aae-ba3d-0ad575c8aebf","resolution":{"observed_at":"2026-08-06T21:54:44.220522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.225629Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.225629Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:fd89c3dbb15db348033ba637a9a3c721853746ad0e7bdc47f0390623af249e05","observation_id":"80ef0ea1-1cd2-4c59-aee1-0192b087a3b3","resolution":{"observed_at":"2026-08-06T21:54:44.225629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.230387Z","title":"Driving vi- sual saliency prediction of dynamic night scenes via a spatio- temporal dual-encoder network","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.230387Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:bfe98e76df1434015cfcb389a72c41cc4af63e01d12764994bc1424859770e84","observation_id":"c17f3591-d798-477e-9920-f55b39e894fc","resolution":{"observed_at":"2026-08-06T21:54:44.230387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.233930Z","title":"Fbnet: Feedback- recursive cnn for saliency detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.233930Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:21e02ec0a568b5a64114a95fd3aeb6ced33b0254f6d0a26fe9a787474c3e35c3","observation_id":"1d66e6fa-b170-4c62-936c-0d988a791a60","resolution":{"observed_at":"2026-08-06T21:54:44.233930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.246616Z","title":"Visual saliency predic- tion using a mixture of deep neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.246616Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:8923ae8c19dfb850fe42ed3ede055cadfd67dd2215c3b11cbc79673f40400474","observation_id":"6a28db98-cb5c-4e92-8c85-b447339f9863","resolution":{"observed_at":"2026-08-06T21:54:44.246616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.250892Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.250892Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:fa845dab6a84c641b395fb293234b649fb51c634089f70c534279cf2032866c5","observation_id":"20de09e0-2af1-4a56-9054-b9b9b840367c","resolution":{"observed_at":"2026-08-06T21:54:44.250892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.255406Z","title":"Dgaze: Driver gaze mapping on road","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.255406Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:a5f9682ed78276a7f6524524e8cd8d11149e0160becc099eeb6cadf9c92782a7","observation_id":"5bdbbaee-ec34-41f8-a64e-4fb7ef15666a","resolution":{"observed_at":"2026-08-06T21:54:44.255406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.260179Z","title":"Dada-2000: Can driving accident be predicted by driver attentionƒ analyzed by a benchmark","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.260179Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:7c5b8727d09957aeac3514f9a863008fac59f32d8d38958a49b306e646f2b79b","observation_id":"bc112f50-667e-42ab-851a-0087ccdbca8e","resolution":{"observed_at":"2026-08-06T21:54:44.260179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.265618Z","title":"Dada: Driver attention prediction in driving accident scenarios","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.265618Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:33dacd79d6658a6021050dcc5248005301449fdc45f4e8015825e6934279df05","observation_id":"89ae88b2-f908-4e55-85c0-f20a6454fe32","resolution":{"observed_at":"2026-08-06T21:54:44.265618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:46.095513Z","title":"Driver attention pre- diction based on convolution and transformers","venue":null,"work_id":"7464e37f-70ba-492b-8b8e-40cb986490a0","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.269949Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:21ad2176d924cf79f4bc3437513857d0666f0879df37e8c46d844b7f113e051d","observation_id":"7e47df24-3d8c-49ce-b4bf-76e23d3b8210","resolution":{"observed_at":"2026-08-06T21:54:46.099060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:46.048514Z","title":"Cascade learning for driver facial monitoring","venue":null,"work_id":"106157d3-9e46-474a-a4cb-637a6c2f3290","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.274654Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:8838b5edc7b8ea4e880d980aad28400ce76a3193cb1d9ae07b03c396f7130c53","observation_id":"1a3df834-ef26-42c8-b19e-38104cbc46c2","resolution":{"observed_at":"2026-08-06T21:54:46.066528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:46.022790Z","title":"Graph- based visual saliency","venue":null,"work_id":"218cc68d-d2d5-4593-8216-ca7f28993b8d","year":2006},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.280463Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:dd40701b79aa1c26670a4c59e099081a6b474787aeb1243ff980cf006ec73310","observation_id":"54a751a2-2190-4282-bea2-f003b25237ff","resolution":{"observed_at":"2026-08-06T21:54:46.037112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.971606Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"98791db7-43f4-449c-a351-572f803453d2","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.290795Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:cb371b4690d9ac1c30a89c53e1815f8e7a9d4830bf99a4b79b9f33d228020d0c","observation_id":"7f248076-f684-4952-a91e-d0eb017e7707","resolution":{"observed_at":"2026-08-06T21:54:45.981085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.955372Z","title":"Data-driven estimation of driver attention us- ing calibration-free eye gaze and scene features","venue":null,"work_id":"8fc55a31-ec9c-4803-9452-c218256594bf","year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.295838Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:f1256e0c2dea1b61d0379a87310c99761cfa7cf5d49b9024f64d4132523bb8e0","observation_id":"6e7a7786-8679-4744-ab68-77f31ffc19db","resolution":{"observed_at":"2026-08-06T21:54:45.958793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.945314Z","title":"A novel heterogeneous network for modeling driver attention with multi-level visual content","venue":null,"work_id":"c90c0985-7709-45d0-8d5b-70906d7fb9e4","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.301877Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:847b4a0aa44e09c4f34e560a731ab4268469f91558d3cc705a8b2a4a7d5a2c00","observation_id":"fc1b4b57-a3dc-44b0-a09d-363f8d835fb0","resolution":{"observed_at":"2026-08-06T21:54:45.948673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.935212Z","title":"Predicting gaze in egocentric video by learning task- dependent attention transition","venue":null,"work_id":"d5d689a0-b909-404a-b7dc-0016c0231f47","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.305929Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:3b8997e64452943480072e74900773172cb0075045059fd878254ad6ef40380c","observation_id":"3de02d1f-846f-4e50-946d-373943223d27","resolution":{"observed_at":"2026-08-06T21:54:45.938486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.924470Z","title":"Task-oriented scanpath prediction with spatial-temporal information in driving scenarios","venue":null,"work_id":"d4c988e7-a7a5-4c4c-9154-89d4631a0da5","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.310441Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:c9c971edc0c25026c0bb3a2a549636e27419158d218fe6e16a6041c047f21ce1","observation_id":"b471f1d8-f245-4acc-acd6-74de3aa065a3","resolution":{"observed_at":"2026-08-06T21:54:45.927754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.914121Z","title":"Driver scanpath prediction based on inverse reinforcement learning","venue":null,"work_id":"a0dc2cc1-ec53-4186-bebb-dabe85eab3af","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.314583Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:84af09e42e0dee535d5af4d71d898f88428e8087d6c555ba5463141afef2ada2","observation_id":"6f58656d-5856-41ba-93e5-9ed270c8c8b5","resolution":{"observed_at":"2026-08-06T21:54:45.917871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.903825Z","title":"A model of saliency-based visual attention for rapid scene analysis","venue":null,"work_id":"e14ee142-0de5-4879-bf30-2fc181ed348c","year":1998},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.319112Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:0fe4ed4bcdb7749aef8ac500f3cc047574d8866afb614710c57fe9828acad564","observation_id":"04f3d564-6548-4003-8f08-612ef3120757","resolution":{"observed_at":"2026-08-06T21:54:45.907219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.889762Z","title":"Mtsf: Multi-scale temporal–spatial fusion network for driver attention predic- tion","venue":null,"work_id":"1dec0425-d48a-417f-8b4b-c1b47d8305bf","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.323289Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:edcbe69508e1cc2b7e70f31ceefd2a3c940dceb9fbb6ba4c1b09f8bdc4c09054","observation_id":"63b4b38d-fbec-46f8-9e01-ef83d247fa4c","resolution":{"observed_at":"2026-08-06T21:54:45.893372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.876898Z","title":"Look both ways: Self-supervising driver gaze estimation and road scene saliency","venue":null,"work_id":"4822f322-a387-461e-ba9f-16070b681667","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.327855Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:6d7f80be3349fc233b069322fdbe09e320ccb988e16b2feef5baed2a937f632f","observation_id":"36d10da3-da3a-490b-9ad1-ba2fa7e94202","resolution":{"observed_at":"2026-08-06T21:54:45.881023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.866550Z","title":"Attention for vision- based assistive and automated driving: A review of al- gorithms and datasets","venue":null,"work_id":"71eda705-be90-4d60-9bcb-336a560a6180","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.332148Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:bcaa3cc65999abc19c822826b04b4cc9171e955d9d9617d956ac6447c44f12b6","observation_id":"d5dc8cce-b521-48c3-8d25-7439ac4498c4","resolution":{"observed_at":"2026-08-06T21:54:45.870013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.856994Z","title":null,"venue":null,"work_id":"c1f53eac-570f-49fc-a04c-8e8aa1159877","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.337321Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d12b1d028f17760fc162813d341b0034b2fb23a2f989d597632eec1efbdb21e8","observation_id":"dc66b36b-62a6-44f0-811b-ece695c538bd","resolution":{"observed_at":"2026-08-06T21:54:45.860223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.847118Z","title":null,"venue":null,"work_id":"91c878a4-64b3-4249-b5ba-a44b7398c7ee","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.341614Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:922139dd2fb7b1dc17c049c5b5d7c36d7348a2ce1843b3c5fcdbf209c3e25684","observation_id":"dd8d3282-5289-4342-99a8-036bb676717f","resolution":{"observed_at":"2026-08-06T21:54:45.849965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.836772Z","title":"Deep gaze I: boosting saliency prediction with feature maps trained on imagenet","venue":null,"work_id":"983d8b0d-be61-40c2-8e7b-51a6e124fd56","year":2015},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.359755Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:7809432f3ccaa8851b3a1ddd088f95c35d0e46c78b9d89a74d2ad2b1babab548","observation_id":"1b924d11-73d4-43ec-8b87-442b2fabf772","resolution":{"observed_at":"2026-08-06T21:54:45.839972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.370824Z","title":"Lisa: Reasoning segmenta- tion via large language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.370824Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:07022981c294a0f7e0c25694e14b18221d874c8e3a21abe8c9f78c35fa8c6dec","observation_id":"9fbe9f17-ab0f-431d-884f-65c5635d8fa6","resolution":{"observed_at":"2026-08-06T21:54:44.370824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.384226Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.384226Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:eb9c6c5a31561df31b49fb6a3f8d9d6e10315be2ead25e3e7b5b7aa22b34b686","observation_id":"4d10f130-362f-4f92-9c2a-a175afa641a8","resolution":{"observed_at":"2026-08-06T21:54:44.384226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.809869Z","title":"Adaptive short-temporal induced aware fusion network for predicting attention regions like a driver","venue":null,"work_id":"feba00be-4be0-41a5-b586-d834c2c5471d","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.388547Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:063a9c3b88a19e223fd2a9bd86babc74ca2466bc422e67aaf2126550644991c1","observation_id":"62d80d2d-9b23-4de5-9779-8e79ba406d35","resolution":{"observed_at":"2026-08-06T21:54:45.813492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.798372Z","title":"Lmeye: An interactive perception network for large language models.IEEE T-MM, 26:10952–10964, 2024","venue":null,"work_id":"13e21c44-841a-44f3-93ab-159d4a4af1c1","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.392863Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:4fb938e8b06a1b7be00626ec975882a657d64c19113fb0550cb5a60b21f9ffd6","observation_id":"ecff9b98-6fa9-405c-b631-a8338059f811","resolution":{"observed_at":"2026-08-06T21:54:45.802370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-07T15:49:03.741523Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04921","snapshot_observed_at":"2026-08-06T21:54:44.397750Z","title":"Perception, reason, think, and plan: A survey on large multimodal reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.397750Z"},"links":{"cited_paper":"/paper/2505.04921","citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:3d425a919eb5d51d2a490f623c54b00ce377ddb31f941d26a68245efce53684b","observation_id":"8bb93239-230e-44fd-a208-d7405e69ce61","resolution":{"observed_at":"2026-08-06T21:54:44.397750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.785835Z","title":"Airvista: Empowering uavs with 3d spatial reasoning abilities through a multimodal large language model agent","venue":null,"work_id":"4e2cc413-c17c-451e-85be-75026d7bbf53","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.404740Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:f8de160c239c37838d0e449f4f08b1e9fadb3a9dbeeead29abf96488ca508185","observation_id":"6870f5da-20b4-482a-83eb-3bbfa1b3acbf","resolution":{"observed_at":"2026-08-06T21:54:45.789642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.772233Z","title":"Deepgaze iie: Calibrated prediction in and out- of-domain for state-of-the-art saliency modeling","venue":null,"work_id":"569e02a7-e1b0-444d-8afd-67ac21c12cd0","year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.409062Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:6a7288704b0c736369860269333dbdf441ea387ec1318d704a8c4e35f25c4d30","observation_id":"8f4ec173-0804-4759-9245-fdf382400fc9","resolution":{"observed_at":"2026-08-06T21:54:45.776757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.756843Z","title":"Visual instruction tuning","venue":null,"work_id":"2694d736-204d-40e0-beff-5c20390e2f58","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.413033Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:bb5b542be8af22d050d3c1033e6a9ef9fec061d0198f15172c5c0d8499de52a4","observation_id":"3b3861d4-d21d-40bc-8971-72e47f204a60","resolution":{"observed_at":"2026-08-06T21:54:45.761434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.417212Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.417212Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:9ecd15d68fa8133b27d16e59da0aa836273d0bc5172c903c647106ab8c2d5cee","observation_id":"e75aefff-8425-42f3-b062-f1606deb299b","resolution":{"observed_at":"2026-08-06T21:54:44.417212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.736809Z","title":"Goal-oriented gaze estimation for zero-shot learning","venue":null,"work_id":"acd62b9e-85c5-4e07-b4f3-092839d9b2fe","year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.422689Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:094dab4dff1544cef510ab3323b573b163f7d1b82a20652dedd2fdf638f5396b","observation_id":"e07f0767-cdd8-4ae4-9b0e-13c5d9f620f0","resolution":{"observed_at":"2026-08-06T21:54:45.740253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.726377Z","title":"A convnet for the 2020s","venue":null,"work_id":"5f0494c0-3bc1-48d1-95e6-a30713cd9b99","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.427088Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:65493eecec55b760319efc1b98f39e3988aa7b95aa3fb3e593eb256bd789445d","observation_id":"9badef32-cc9b-4d5b-9219-c72efea54d34","resolution":{"observed_at":"2026-08-06T21:54:45.729942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.706408Z","title":"Robollm: Robotic vision tasks grounded on multimodal large language models","venue":null,"work_id":"09acdd51-23b5-4bd1-b40c-174c1ad57ab8","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.431477Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:a396f631f0394b6edc45dc65e7bbceb6ef1666c1fec18fb006aa6b45c930a9c8","observation_id":"306a245d-8c51-4678-a190-dc89458a55b1","resolution":{"observed_at":"2026-08-06T21:54:45.710903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T21:54:44.436055Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.436055Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:a60b27e544d23580773535f2b290533c8721618cc46d5e92680f381ed320969c","observation_id":"91971b2b-a0c0-49b4-b778-53660c65f5ad","resolution":{"observed_at":"2026-08-06T21:54:44.436055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.691700Z","title":"Gaze and eye- tracking solutions for psychological research","venue":null,"work_id":"5a32f0b8-2b7e-4cb5-84cc-220e72b8b620","year":2012},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.440853Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:12791087bdac60a0029cc90766233afae68c453ee9f2f402f2bdc4ffb1d71200","observation_id":"84838941-97c9-4eec-80b6-125e20dc395f","resolution":{"observed_at":"2026-08-06T21:54:45.696789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.677864Z","title":"” looking at the right stuff”-guided semantic-gaze for au- tonomous driving","venue":null,"work_id":"eb33aab8-b3ef-464e-a67e-8604a0eaf5dd","year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.444977Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:2720f03bbe2249d11ad13e64f027f5e4f421ab827ee039ffd717e77c5e5b7f1a","observation_id":"9c8bc8ce-0f79-4ee7-8006-4942198e7a22","resolution":{"observed_at":"2026-08-06T21:54:45.681808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.665413Z","title":"Predicting the driver’s focus of attention: The dr(eye)ve project","venue":null,"work_id":"460fc8f0-81f9-4495-9e57-6388b2fd49d6","year":2019},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.449579Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:750cc990034055e3dd2e5920f2c66ee34ef60fcb6c4f87db44a3da764e99120b","observation_id":"bdc1beee-94ac-44be-842e-5770cff1fefd","resolution":{"observed_at":"2026-08-06T21:54:45.671022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.654000Z","title":"Multi-scale interactive network for salient object detection","venue":null,"work_id":"9727440a-114f-4e6a-8b3b-302c9d35fe1d","year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.454167Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:f23e920292f80ef972a3a3bec9173b5e043357574991b199e5299d7c09a94da1","observation_id":"fe9038c6-f9cb-4ead-a5ee-8fb8944b948c","resolution":{"observed_at":"2026-08-06T21:54:45.657858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.639476Z","title":"Human generalization of in- ternal representations through prototype learning with goal- directed attention","venue":null,"work_id":"27e04971-b70c-4e20-959b-a3961ac560d8","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.458500Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:09ccc837eed3ac4c5b03219c4ea0f7f8cbcd9540d658c85443ba1e94a3a7d7dd","observation_id":"e4452014-1fcb-4688-acde-7287beb21c3c","resolution":{"observed_at":"2026-08-06T21:54:45.643861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.627651Z","title":"The attention sys- tem of the human brain","venue":null,"work_id":"dfa4a98d-1bbf-4452-8f1b-0f6e49e003ec","year":1990},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.463166Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:7ab959c1e451f4b219c9539fe87c3012ba769b5fd24de5ab5beb32a946025d2f","observation_id":"1b7af59e-0227-4e68-8f30-ca724916857f","resolution":{"observed_at":"2026-08-06T21:54:45.632070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.613975Z","title":"U2-net: Go- ing deeper with nested u-structure for salient object detec- tion","venue":null,"work_id":"bf89f7e9-838d-4cf1-8ec1-18651ab0c06a","year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.467943Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:b74feafec37c635211a08003a4f51c8bf48da8eef255fa462a0e9d305a64e376","observation_id":"019f6a9d-3150-4f34-b125-2529b18c2b53","resolution":{"observed_at":"2026-08-06T21:54:45.619477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.602061Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"94267e3b-e1f1-45d3-b735-75e88b84b884","year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.475388Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:cc331e9f4f654bf467178f895c8244f1e7304badfec675027dda20d77bfeed38","observation_id":"e56c61c2-a998-4eb8-9964-82d6443aa36a","resolution":{"observed_at":"2026-08-06T21:54:45.605542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.582386Z","title":"Deepspeed: System optimizations enable train- ing deep learning models with over 100 billion parameters","venue":null,"work_id":"908aa0c0-eb19-438e-bfa4-6253c720bf29","year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.484081Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:3722828663b6ee58134fbe4a7109a139fd4073b5c8325cc2a4050117f5845f56","observation_id":"22d1aa9a-8b3d-472b-a68f-159ccb90ffff","resolution":{"observed_at":"2026-08-06T21:54:45.588857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.557883Z","title":"Pixellm: Pixel reasoning with large multimodal model","venue":null,"work_id":"7712d3ae-854d-4d0f-b30c-db679121589f","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.493000Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:ec1fc1f2ddce8d3b1c572a703bb291d724781bf1356857df4b34185dcebbd9f3","observation_id":"950306ac-6ef9-4a97-a0dc-b5c5f54729e6","resolution":{"observed_at":"2026-08-06T21:54:45.565437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.538981Z","title":"Weakly supervised fixated object de- tection in traffic videos based on driver’s selective attention mechanism","venue":null,"work_id":"da940df1-b93b-4dff-911f-19cf657fb856","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.498070Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:b53aae0278af8ee84301a3468359016b60085a7c4df6d16f80ea70a260c5b4db","observation_id":"0aa343c6-5ba4-43cd-9735-96f35d3d0ebc","resolution":{"observed_at":"2026-08-06T21:54:45.542462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.525569Z","title":"Fixated object detection based on saliency prior in traffic scenes","venue":null,"work_id":"b60eb379-526d-49ee-a7c1-a64359720200","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.503189Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:23c7d2c34035647e08eeb0a2dc6cef9e83fbf72ac13ebc3fa8006340c481438b","observation_id":"fef69091-3117-40cf-8dde-db2c1f0482dc","resolution":{"observed_at":"2026-08-06T21:54:45.529339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.507766Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.507766Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:48334fb8c1092b011d3ebbfec5d7f1e2b278ef003cdabf171f765c6c6193d39e","observation_id":"46052145-756a-4902-aacc-3ca678f71655","resolution":{"observed_at":"2026-08-06T21:54:44.507766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.507054Z","title":"Vitgaze: gaze following with interaction features in vision transformers","venue":null,"work_id":"69033310-d0c0-4e10-9b07-a2762dc69218","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.512761Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:0f8d26f8a37de6017d0e02d95cfe2e70ee7e924b0baf98efa84cd0070ac68784","observation_id":"cab3639d-c77d-4818-8586-87ab5b259610","resolution":{"observed_at":"2026-08-06T21:54:45.510485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.493957Z","title":"From gaze perception to social cognition: The shared- attention system","venue":null,"work_id":"bbc6b893-aefc-4a25-9908-5a675f00bcb7","year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.517285Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:b7c828296ad30a992bd19265326c141e77336c51e7fbdafe3b4be38622fa6778","observation_id":"10a34077-6cc4-4f60-95b9-1f77e319de16","resolution":{"observed_at":"2026-08-06T21:54:45.498167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.479226Z","title":"Driving as well as on a sunny day? predicting driver’s fixation in rainy weather conditions via a dual-branch visual model","venue":null,"work_id":"b81e2226-342c-4ef3-9f5c-3b68305d00f7","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.521757Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:b3f2136f7b54e918cf190f2cd7cfcaa831f8a78554b22321e63215f976317698","observation_id":"370bb2b4-6473-43b9-bc8f-0bffb72e69af","resolution":{"observed_at":"2026-08-06T21:54:45.485732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.450624Z","title":"Drivevlm: The convergence of autonomous driving and large vision-language models","venue":null,"work_id":"b4e40cca-1282-4a61-ab2c-784fcad429be","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.526974Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:c9553c48e6d3bf34e8a21bc198aa016518dfa05a5e9e9bee6925c38ebed15c8b","observation_id":"5f6ebc63-00a0-4523-9d1a-626a8cf04d72","resolution":{"observed_at":"2026-08-06T21:54:45.458971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02341","last_updated":"2025-03-25T15:55:33Z","snapshot_observed_at":"2026-08-01T22:19:58.635790Z","submitted_at":"2025-01-04T17:32:12Z","title":"UAVs Meet LLMs: Overviews and Perspectives Toward Agentic Low-Altitude Mobility","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02341","snapshot_observed_at":"2026-08-06T21:54:44.530817Z","title":"Uavs meet llms: Overviews and perspectives toward agentic low-altitude mobility","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.530817Z"},"links":{"cited_paper":"/paper/2501.02341","citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:cde71b15966b86b466fc985313540e158a1805fa43e1be3e6fa8a5bd7b1abf87","observation_id":"6066adc1-b3c8-4ffa-a8af-7f8561261a5d","resolution":{"observed_at":"2026-08-06T21:54:44.530817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.437372Z","title":"Next-gpt: Any-to-any multimodal llm","venue":null,"work_id":"f2452145-1c72-4b1b-aa12-a7adb397bb87","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.535548Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:86dcf2fd56f31e9fd464b59e10e14416db264bb0a62194cef68cd67fac6ca9f7","observation_id":"d4f59f64-f440-4cd8-840b-13bf5b14b6ec","resolution":{"observed_at":"2026-08-06T21:54:45.441076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.426759Z","title":"Predicting driver attention in critical situations","venue":null,"work_id":"6af0bfc0-ce27-41a3-ae77-b068c0951d5c","year":2019},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.540153Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:1e8a07819716f23811faa30e2b87a35c3842f789494430718960b0f5074e37e1","observation_id":"5d6f4106-16bc-4861-ae0d-5d2c6d2b43f0","resolution":{"observed_at":"2026-08-06T21:54:45.430147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.415725Z","title":"Gsva: Generalized segmentation via multimodal large language models","venue":null,"work_id":"83ef47f4-367b-4e10-98f0-ec99dc42516a","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.545053Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:4d54f07ca4b80b395bf479fd0546d5cd2d9356c928d1b8ed00c85fd864cfea97","observation_id":"9291d7e7-e413-4dbd-9f4d-e46ad58d657a","resolution":{"observed_at":"2026-08-06T21:54:45.419000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.405816Z","title":"Pyramid grafting network for one- stage high resolution saliency detection","venue":null,"work_id":"00265c05-6271-43bd-bd9e-a659c88ada37","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.549422Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:59cac79e669dd778b152b97e973924f2e7dfeb6470ae88e94911cb9af1103a8a","observation_id":"e0372360-af20-437c-b9de-8b1b0ef71c91","resolution":{"observed_at":"2026-08-06T21:54:45.409325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.394541Z","title":"Transconvnet: Perform perceptually relevant driver’s visual attention predictions","venue":null,"work_id":"3fc11ada-a3ca-4fc5-b80a-8044914c3fc9","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.554686Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:560fc56c31b49a34c3bca3b4cec0f0531ee823cc941ce4fc0304d19f20a86797","observation_id":"1d6d90fc-d6b2-40d6-9ebb-b66f5c1b0d4c","resolution":{"observed_at":"2026-08-06T21:54:45.398196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.370435Z","title":"V oila-a: Aligning vision-language models with user’s gaze attention","venue":null,"work_id":"1455e3e2-c8b8-4423-88ea-8e4497d2c794","year":1918},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.559347Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:349179e2125fd031c25204588b11168703aa190445a6dfc6cbb12988aad0c03c","observation_id":"164c9033-1f92-4574-a163-09919c696f90","resolution":{"observed_at":"2026-08-06T21:54:45.380753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T21:54:44.564724Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.564724Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:fe07ddbf8ec9295dab5113b6f2a0e166c80460f837218c0cbf7b8cf673e21824","observation_id":"a334305d-1024-4107-8664-3ae272bc466a","resolution":{"observed_at":"2026-08-06T21:54:44.564724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.346588Z","title":"Progres- sive adapting and pruning: Domain-incremental learning for saliency prediction","venue":null,"work_id":"a0578a81-5561-4fd5-b419-ea23297259c6","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.569548Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:03f4f7237b41a7f7c83c4bc002f4986f9e79c7626dfeec77072ecb98e53e911c","observation_id":"80d35fea-a602-4f8a-b83b-5bbb5b33c354","resolution":{"observed_at":"2026-08-06T21:54:45.356959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.317138Z","title":"Continual learning with bayesian model based on a fixed pre-trained feature extrac- tor","venue":null,"work_id":"2ec1b2f7-7b30-4ed4-b856-673541553c4b","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.574798Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:45defe4dd084cf930df94393c3456ce34644767c50397647b87ca9b33d5ea631","observation_id":"98a82185-79bb-4072-be07-61b92b7c05fe","resolution":{"observed_at":"2026-08-06T21:54:45.331574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08548","last_updated":"2026-04-05T00:57:47Z","snapshot_observed_at":"2026-07-06T21:23:14.666121Z","submitted_at":"2025-05-13T13:20:46Z","title":"From Seeing to Doing: Bridging Reasoning and Decision for Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08548","snapshot_observed_at":"2026-08-06T21:54:44.585590Z","title":"From seeing to doing: Bridging reasoning and decision for robotic manipulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.585590Z"},"links":{"cited_paper":"/paper/2505.08548","citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:8310f717295609daf4729fc1b3db4a09f88a948955963798d7c2297d078fb2c7","observation_id":"ef3d09d7-f497-4577-82a8-847830dce81d","resolution":{"observed_at":"2026-08-06T21:54:44.585590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.294111Z","title":"Contextual object detection with mul- timodal large language models","venue":null,"work_id":"a4116d73-ee2e-49b9-a310-d63c472fee6b","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.591060Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:a95559e8cf22e438ce3e795a770b74d1b66695df319b0d33637aa808e775ceec","observation_id":"b6684dba-fb82-407f-8d66-f1b496c62b22","resolution":{"observed_at":"2026-08-06T21:54:45.301203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.258327Z","title":"Da-bev: Depth aware bev transformer for 3d object detection","venue":null,"work_id":"685ee64b-cde0-4d20-a741-05937a2f1180","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.595775Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:9802f35691ce9fb15282b0e01bd409dcdaab2a09aa73a2b1330c149b0be759eb","observation_id":"38e10db4-c9e5-4506-8851-4e3edc207b2c","resolution":{"observed_at":"2026-08-06T21:54:45.262728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.220828Z","title":"Llava-grounding: Grounded visual chat with large multimodal models","venue":null,"work_id":"8f9ac167-e4cb-41ab-8a17-8a9d7ce95110","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.600597Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:851d3b32071d47731e12042bdec633b7c0c65be3ab8fcda13a40d7ba4124b929","observation_id":"169c3061-baab-4a56-b592-8001d0d49204","resolution":{"observed_at":"2026-08-06T21:54:45.235455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.203713Z","title":"Human gaze assisted artificial intelligence: A review","venue":null,"work_id":"1ab584c4-97af-42e8-9ec2-ec416f229b02","year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.606358Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:bfce81207234e24a0ef0fb0932b3353854b5707abf0e6071c9bbd2b6470285ca","observation_id":"36f5fa3b-fea7-40b2-90f3-6c4282aeb66c","resolution":{"observed_at":"2026-08-06T21:54:45.208857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.177487Z","title":"Salm 2: An extremely lightweight saliency mamba model for real-time cognitive awareness of driver at- tention","venue":null,"work_id":"01c630e2-fbcb-43e5-b695-364bdd89b677","year":2025},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.610759Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d9cb4f368e351fbfcdfe2f55b9665413801fb05f1a2689be5e77f6f26befcf0c","observation_id":"1f614c2c-5c4b-431e-aab5-337bcd4472e0","resolution":{"observed_at":"2026-08-06T21:54:45.191337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.148389Z","title":"Learning from easy to hard pairs: Multi-step reasoning net- work for human-object interaction detection","venue":null,"work_id":"01770a5a-e85c-43af-a4a3-577e2742ee5c","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.614951Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:c38ea5c846ae16006c2f9834ef952e88dd025abe90693e3e68ca3540f9ec35cc","observation_id":"5dae4df3-646e-473b-94f1-e13e8a6e881a","resolution":{"observed_at":"2026-08-06T21:54:45.155705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.135705Z","title":"Pit: Progressive interaction transformer for pedestrian crossing intention prediction","venue":null,"work_id":"dba0d85d-3c94-44b7-9688-29338c4f3c7a","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.619453Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:03e4d440a3d8497d68c27d92c10b5693d7ead67a04818dd74cdbe0c0302abd40","observation_id":"a2e13276-819c-456b-8d98-ed15d1d512eb","resolution":{"observed_at":"2026-08-06T21:54:45.140318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.114885Z","title":"Learning from observer gaze: Zero-shot attention prediction oriented by human-object interaction recognition","venue":null,"work_id":"95832206-4d82-4588-9471-d581abdf98d4","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.623813Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:8e62ee331045712a5110dca23df6090d153580d3dbfcb7a91f5a7a71c2953e7c","observation_id":"1b0a98c9-12c4-4f25-8ef5-30d10c87c989","resolution":{"observed_at":"2026-08-06T21:54:45.127918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.088259Z","title":"Hktsg: A hierarchical knowledge-guided traffic scene graph representation learning framework for intelligent vehi- cles","venue":null,"work_id":"4081c7e6-553c-4419-8b11-357fe0daabde","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.627225Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:2cd177a07622226115722d3f58cd41120c89d154f3a8251ec8e6c16804729bd3","observation_id":"c43fe3a8-de0a-48a0-8248-64d179e58f84","resolution":{"observed_at":"2026-08-06T21:54:45.092545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.073938Z","title":"Behavior-aware knowledge-embedded model for driver attention prediction","venue":null,"work_id":"4c36b418-3b63-4e72-8672-9e406d371c18","year":2025},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.632018Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:617710c90f6bb80a7f2bcaafeb14f7fbc6cf37c3249d77c38b5b6018262f818d","observation_id":"60dd76c5-ca3c-46e9-8b7f-8548688748c4","resolution":{"observed_at":"2026-08-06T21:54:45.078981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.055298Z","title":"Unsupervised self-driving attention prediction via un- certainty mining and knowledge embedding","venue":null,"work_id":"41115d86-ace3-4e2c-947a-97429e265c59","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.636808Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:4e66e8a2cb5940c607c0fec2e73b32b173e0ae94833c8201848ea9afc7fd014f","observation_id":"644f177b-9166-4c05-9799-9c8246e69717","resolution":{"observed_at":"2026-08-06T21:54:45.064755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.041349Z","title":"Dataset Comparisons To highlight the advantages of W³DA, we compare it with existing driving attention datasets, as shown in Table 4","venue":null,"work_id":"498df04a-f52d-4a5e-8de0-46368fa92713","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.641824Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:72f3f1b539f8854193702dce63cde09fd89b1a05415250b68fb8d76db42af750","observation_id":"2623f5f0-0ece-46d3-ba68-72a87b5a19b9","resolution":{"observed_at":"2026-08-06T21:54:45.046030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.025215Z","title":"road ahead","venue":null,"work_id":"56a5a4e2-6b27-4dbc-9fee-0a932d3bb27b","year":2000},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.646512Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:3dde31b33ecef1d5de94eff1cdb38f186aa1a4bab1f04c26f96b812b4a111219","observation_id":"0af0ad5b-7b32-40da-b466-a8bcca0579e1","resolution":{"observed_at":"2026-08-06T21:54:45.032042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.002951Z","title":"The image shows your visual attention distribution","venue":null,"work_id":"daaa6e4b-1180-4c55-8715-72032805d673","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.652368Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:a97c88c7a10b9d90dc8df068888fdb6f577059a1d4bb0e4f3b12d8b00da60e3a","observation_id":"1d447fc1-ee9d-4fb9-94f2-5d0144744f5c","resolution":{"observed_at":"2026-08-06T21:54:45.014518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.944286Z","title":null,"venue":null,"work_id":"b0908ea4-596a-4044-91e3-e62d7f51fd0d","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.665747Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:3e547d55054fc4ec15b42d27b95059b16ff3ae045e5fa65f9d454c96b625b12c","observation_id":"dec0f8b0-9a08-44bc-a032-f03032019496","resolution":{"observed_at":"2026-08-06T21:54:44.948238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.894899Z","title":null,"venue":null,"work_id":"d61c3dd5-48c8-43ea-99c0-69e9ea09d4bf","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.681087Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:671a53e8111618772225c67eb5bd1c369190b9e8cf62df2673a5822a36e90369","observation_id":"2b03a403-db9a-4dc5-a84d-f27924dc85c4","resolution":{"observed_at":"2026-08-06T21:54:44.925554Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.877704Z","title":null,"venue":null,"work_id":"a8956169-9032-40ce-9f74-7ed7e76302a5","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.685369Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:34b716f43755dccee04d4bc670bd7f42d14ed7909faa60408df749fb26536ea5","observation_id":"f833263c-0ef5-45b0-8632-7962b24fe845","resolution":{"observed_at":"2026-08-06T21:54:44.882596Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.861987Z","title":"{context_description}","venue":null,"work_id":"b4227cfc-e16b-4449-bae3-0aa61f543e8e","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.693606Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:175e3af45883707f4d1fd5c5a8094a15bd74a8e5d766ae3b065ad5fc91d29379","observation_id":"8bc9bcd6-74cd-490a-80a0-e37cc8b22a38","resolution":{"observed_at":"2026-08-06T21:54:44.867479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.843128Z","title":null,"venue":null,"work_id":"0a402081-0877-44c8-8109-1dac76dd338d","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.698703Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d8fc85c485ee041fc79e797b49260939b9026f6b0399c526f2df5fef6dc9a3cc","observation_id":"17acad4d-bd01-465d-b7d7-8646d77dbfbf","resolution":{"observed_at":"2026-08-06T21:54:44.847328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.828380Z","title":"Prompt templates for MLLM annotation in traffic accident scenarios","venue":null,"work_id":"1aab399d-eb5a-4acd-978d-24fba1680439","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.704606Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:0757dc36c46681eb6166f3076d580a965787c2fcbb5a8ef8551f0303b036d9e1","observation_id":"4d6a283a-f6fa-4042-95e4-a79b670d52ae","resolution":{"observed_at":"2026-08-06T21:54:44.834292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.974031Z","title":null,"venue":null,"work_id":"0cea1ca7-8b4d-4ab1-84d9-5621a1a8f39c","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.708764Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:2581137f0c7166833bc232ac8062e5ce1857e98b5b76b74deef2ef94ac097e4e","observation_id":"522d1564-6a7e-4dbb-9f59-64803517b17a","resolution":{"observed_at":"2026-08-06T21:54:44.983908Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T21:47:51.496552Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":62},"total_outbound_references":102},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 102 outbound references and 5 inbound Pith citation observations for arXiv:2506.23088."}