{"as_of":"2026-08-19T18:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a1776fabc852eadcedbe7b2b8172726cbd643877dfa262adb60f3b0d400320c4","coverage":[{"denominator":132,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:58:25.334464Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03084/citation-record","integrity":"/paper/2608.03084/integrity","json":"/paper/2608.03084/citation-record.json","paper":"/paper/2608.03084"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.857267Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.857267Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:af2d4fa90a7ec87e0c63aa3208a2006f95ff0b88cc461afa16fdde5e9de8bf60","observation_id":"826ad9af-3ff2-469a-8a13-7d5aea371c61","resolution":{"observed_at":"2026-08-15T14:58:24.857267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.861803Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.861803Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:3b471c62961977c82944b590b7b3e471282d925099977529b2849e3b0e00d712","observation_id":"5879f4d1-1cbd-4504-a484-dc141a207604","resolution":{"observed_at":"2026-08-15T14:58:24.861803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.865807Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.865807Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:05da4307760b7c0c51ce5b85c42d5df55b47c1280b1a396b75f26e061e8820b3","observation_id":"dec986af-2e1c-4ab9-a0b6-9bb4d1aeffcd","resolution":{"observed_at":"2026-08-15T14:58:24.865807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.869811Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.869811Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:274f541c514286c9ee97beb2cc8de248c8e9077095d882a3f927cd8664d33679","observation_id":"d479f3ab-8bd6-42d0-9ab1-27fb02e5d8a2","resolution":{"observed_at":"2026-08-15T14:58:24.869811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.873763Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.873763Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:f8bf3138b55dfe629ca6ec3b46159d51f9b37236170a6d6a4ab4c9e07c3ab4f2","observation_id":"a1d4f090-4a27-4c28-b1ca-fc0f75e443b4","resolution":{"observed_at":"2026-08-15T14:58:24.873763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.877705Z","title":"2026 , url=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.877705Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:80b524e048abcea56c4830ff024073bc0ac658225169d586b4764e12020e6987","observation_id":"90f92bee-6f2b-43ba-a204-310a9ff3b449","resolution":{"observed_at":"2026-08-15T14:58:24.877705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.882009Z","title":"2025 , issn=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.882009Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:b9eb16cbb542db1b8be656a7f81cf826f888c92a98a0a60f1784a02fa5e541ec","observation_id":"09cde7fb-fd37-4f49-91cf-eedab59fb1c1","resolution":{"observed_at":"2026-08-15T14:58:24.882009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.886736Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.886736Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:20ad3cb97c949fc79a704b54c9725d21f0a7edbc3eaff5346d1158eb60901081","observation_id":"22489210-663d-4f65-8470-db33e9deac97","resolution":{"observed_at":"2026-08-15T14:58:24.886736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.890586Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.890586Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:3aed56636988ddb3b9d1cc8d85c2fd901a7dd3c81a00847d936816587468bc8f","observation_id":"119d8644-11fc-4ddf-ac1d-011d91165ddf","resolution":{"observed_at":"2026-08-15T14:58:24.890586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.894477Z","title":"Planning-","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.894477Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:194562d4cc63c482d0422e677a8ef869367411559ff554303ceff53ce410ed00","observation_id":"4023bc7b-7932-4fb0-bc8d-c809a0c176cc","resolution":{"observed_at":"2026-08-15T14:58:24.894477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.898253Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.898253Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:394b65f1dbb1ebe2fd365aec69644a14fee28b65636e96878e17ca2829afc722","observation_id":"73a2cb8f-8818-4216-921f-1a9cb6c7561b","resolution":{"observed_at":"2026-08-15T14:58:24.898253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.901993Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.901993Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:895afc937a879572afe857b0d32fda8aec6071edb93f62c3a523619d02700a07","observation_id":"ea9abbfa-02c5-490b-b1bc-13267a7bbb21","resolution":{"observed_at":"2026-08-15T14:58:24.901993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.906286Z","title":", booktitle=CVPR, year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.906286Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:b6d5d19b52b159f3ca79f98bcbefb80c05c6a4ad494d434d1be3d24d851e9c7b","observation_id":"0c2838d2-1a3f-40fd-b436-ad49eec1ec25","resolution":{"observed_at":"2026-08-15T14:58:24.906286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10430","last_updated":"2023-10-22T02:45:33Z","snapshot_observed_at":"2026-07-06T15:28:49.253125Z","submitted_at":"2023-05-17T17:59:11Z","title":"Rethinking the Open-Loop Evaluation of End-to-End Autonomous Driving in nuScenes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10430","snapshot_observed_at":"2026-08-15T14:58:24.910155Z","title":"Rethinking the Open-Loop Evaluation of End-to-End Autonomous Driving in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.910155Z"},"links":{"cited_paper":"/paper/2305.10430","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:f823b31361c094eb624a2063dac5784ee5b4ce1c2406322b98a41b77cf90c5dd","observation_id":"022dd276-ad61-438c-b4f4-da33c4f2119a","resolution":{"observed_at":"2026-08-15T14:58:24.910155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.914610Z","title":"2024 , doi=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.914610Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:05ef370494de43cf91b81595f1ff60713e7f1c2b740003e1a0324d9b5d348810","observation_id":"b6aa08b5-985d-4453-ac3d-b6a29d5c8c2e","resolution":{"observed_at":"2026-08-15T14:58:24.914610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.922822Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.922822Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:510b2781fb8adbef77a3fad578290ed071f2cd38577c21c1168962d02bffa405","observation_id":"307de340-ad60-4992-b529-0523a3c7ca53","resolution":{"observed_at":"2026-08-15T14:58:24.922822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.926994Z","title":"2025 , url=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.926994Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:ed31ef6732fb86331d2186b143cdd7cfffd14d4a073362633b1eb70078463706","observation_id":"4bf2d36f-e801-48d6-81a5-5559b9ec0ce0","resolution":{"observed_at":"2026-08-15T14:58:24.926994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.930971Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.930971Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:75bb7a31b299137e8e9c7a75b416cb9c9a58f436c0acd4aef896fa2cf149ff44","observation_id":"c11ab8b0-616b-4b5e-9c53-eabeab7b71a8","resolution":{"observed_at":"2026-08-15T14:58:24.930971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.934977Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.934977Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:817ae7625cac93d5818145b322795ecf300e4ee0536a01acf7e61ed75d25c2af","observation_id":"10b25295-7cf8-444b-86e2-81f6d5482be5","resolution":{"observed_at":"2026-08-15T14:58:24.934977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.939289Z","title":"2022 , doi=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.939289Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:d565dd46ed981210cf57397659481be508fda2bac4fe1bd536f1596d81e697ec","observation_id":"4fce65f1-c2b7-460b-9c70-9d3b68b3f560","resolution":{"observed_at":"2026-08-15T14:58:24.939289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.947090Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.947090Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:90ae26f2baeb9ac692b65c19c3e82499e7ec88c1091f820f1e26742ce623f752","observation_id":"3914614f-2bf5-4349-8979-76f9d1040f31","resolution":{"observed_at":"2026-08-15T14:58:24.947090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.950986Z","title":"2024 , doi=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.950986Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:54eacb37f7ccdcfedec7556437017a14ad9a62f50718f2d0d27264e9b7e6f362","observation_id":"c8932e3a-728a-4c4b-95d4-9c5be2028ab0","resolution":{"observed_at":"2026-08-15T14:58:24.950986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.954744Z","title":"2024 , doi=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.954744Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:e282821a0d9cf21b936faaf6c4160ceeea33c2343c9349b9b25a9843c5b7c2b3","observation_id":"4c537e56-dca2-476b-a03c-e8d0df1aaf13","resolution":{"observed_at":"2026-08-15T14:58:24.954744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.958366Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.958366Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:82a36e3f76540cec7f7291b29dcfe428d883836fa1fdfbdb4c9da9c1d5486be5","observation_id":"83058718-2c21-48e7-9668-3a8d7d535b09","resolution":{"observed_at":"2026-08-15T14:58:24.958366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.961984Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.961984Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:ecd7562d5b2fcc0cd5fde564731c6029a2231508fb55b2c4bfa6b0280d06eb02","observation_id":"01dae626-0a5f-409e-bfc2-1053cad6d116","resolution":{"observed_at":"2026-08-15T14:58:24.961984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.965466Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.965466Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:c18abc2ad1131abe2da3e63c231cdb23d9e087ecc69cff48c3618a392e86550f","observation_id":"a7f023ff-e47c-481d-9f9e-ecfd05f85dd0","resolution":{"observed_at":"2026-08-15T14:58:24.965466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.969099Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.969099Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:8fa0b935b9cb2eeab6415e6d2656b99d3cd58b5c1fb40360d166b9d59807dda7","observation_id":"23cc3d62-a04a-482e-b373-59a3382e1b2a","resolution":{"observed_at":"2026-08-15T14:58:24.969099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.972743Z","title":"2025 , doi=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.972743Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:288d54b64b9fe4636364c94d384952b28069e4db42af293e88b9ae6728588e34","observation_id":"1236bb59-88da-486a-897e-0da591b09aef","resolution":{"observed_at":"2026-08-15T14:58:24.972743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.976390Z","title":"2024 , doi=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.976390Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:fe27a89fe21401c8eee5ddadfb503003e9dcba8389b6edacc2770519860afdee","observation_id":"abae6f70-c9c1-4867-80bc-0612beb90c0a","resolution":{"observed_at":"2026-08-15T14:58:24.976390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.980058Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.980058Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:7e3a0a1629844af136d753bdc92bbef864c2f9be77b97c2cec761cb38ebc6cc3","observation_id":"b294ae77-ca4a-4377-9814-348c216d3397","resolution":{"observed_at":"2026-08-15T14:58:24.980058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.983689Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.983689Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:3a6c2f6337ef1d45b5ebaa9ae0ca4e99e706fbd5de09b3c33f00ca75a2d07426","observation_id":"f1d3beb0-28be-4971-bd86-2001bece7d1b","resolution":{"observed_at":"2026-08-15T14:58:24.983689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.987382Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.987382Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:e92ee0a01886493455fea8470b28b93f881104081fd878dfba39af6133830551","observation_id":"93f2dea6-827e-46ff-9e2c-d6446eb945eb","resolution":{"observed_at":"2026-08-15T14:58:24.987382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:24.990947Z","title":"doi:10.1109/LRA.2026.3678836 , url=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:24.990947Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:ca1bb51ab60a4fa1f8e57064187e45fcc6cb24dd833cea8aa737538708ca3004","observation_id":"3610b118-ac48-47b3-8d6e-2a7290338750","resolution":{"observed_at":"2026-08-15T14:58:24.990947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.006801Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.006801Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:4a31b214e4dcddaef558f3497b6005243dc59e5c8103b913ef09e41f923a565d","observation_id":"96b764b8-79c2-460a-9bab-6a34eba9c5f9","resolution":{"observed_at":"2026-08-15T14:58:25.006801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.015082Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.015082Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:a7877b264db7463650d5d3ac518e14bc83aff2bb1ec191eee03bf3e5a2146d11","observation_id":"609a948c-6780-4aff-b5b5-d9ffa68df3e5","resolution":{"observed_at":"2026-08-15T14:58:25.015082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.018969Z","title":"2024 , doi=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.018969Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:6e61a1da493366a5cec42493507d587cad53ddff0fd91c61f61a340f1ba566ea","observation_id":"611a94d6-b23d-471d-a17a-4ab91830ac82","resolution":{"observed_at":"2026-08-15T14:58:25.018969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.022895Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.022895Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:6b1d1f39e717259b302dfb836afa5cc45da0415c1a93b4cf3541343594ca5f01","observation_id":"8d607b76-f88b-4d11-8158-26929f695b70","resolution":{"observed_at":"2026-08-15T14:58:25.022895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.026732Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.026732Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:c144c3e36cef7aa0991c0d856400057857b7c55cfe81178fc30f62f3fb040472","observation_id":"233bf64d-eed6-4bc0-b925-4f63cf9c346c","resolution":{"observed_at":"2026-08-15T14:58:25.026732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.25892","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:26.177829Z","title":"2603.25892 , archivePrefix=","venue":null,"work_id":"8fe6ce25-3640-44de-8e82-82889da6f978","year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.030584Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:c9208529c19ad410bdf477b56ebac6d57d4ac8674e8d8f3fbda2b96fe559e203","observation_id":"ab778c43-24d9-4ce0-9d45-0b6550557026","resolution":{"observed_at":"2026-08-15T14:58:26.185160Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.034232Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.034232Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:e6c349e8bbc4770de8353d91ca1a5c1933365a2d3e8b2f8e8d4a4976f0f12f03","observation_id":"c0010d21-db90-483d-b35c-5e4b0615cd6a","resolution":{"observed_at":"2026-08-15T14:58:25.034232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.042967Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.042967Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:b14c035795f9d4968a336eade5aa4a464eac360d36cd7da11939b128953b059c","observation_id":"31d5709f-6111-4b55-b67c-3f55fc019ea6","resolution":{"observed_at":"2026-08-15T14:58:25.042967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.054154Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.054154Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:a137d3c5f5250047b8a56043da7c54d6453abbd7943be8d915ea9813cd043d75","observation_id":"317721dd-73e1-4ea7-b337-7cb5bf78da64","resolution":{"observed_at":"2026-08-15T14:58:25.054154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.061566Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.061566Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:c4d0e1b4c4b38dc5e11599cc535f5d0359f322e6de9e4a03907e94139ab19eae","observation_id":"43523387-2c3a-46fd-a349-7c8af04ace08","resolution":{"observed_at":"2026-08-15T14:58:25.061566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.069453Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.069453Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:f0b767ae1677719442c48cfc486303b17905a95b20da93abe72bddaa809c253a","observation_id":"1a449537-9e78-4557-b36d-da3420da47f1","resolution":{"observed_at":"2026-08-15T14:58:25.069453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15120","last_updated":"2026-05-15T11:07:11Z","snapshot_observed_at":"2026-08-12T19:26:11.644798Z","submitted_at":"2026-05-14T17:32:18Z","title":"CLOVER: Closed-Loop Value Estimation and Ranking for End-to-End Autonomous Driving Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15120","snapshot_observed_at":"2026-08-15T14:58:25.073362Z","title":"2605.15120 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.073362Z"},"links":{"cited_paper":"/paper/2605.15120","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:8831ea08adf46de1cfb8fcf42e2bca83044a560b0b8b8b52d888a37a684bd73a","observation_id":"7ca1c6aa-191e-4cbf-91e2-7f58eb341366","resolution":{"observed_at":"2026-08-15T14:58:25.073362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.077470Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.077470Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:58692e921c28d9b79531cd684a2efdb919aaa8acf34780bcd5d3eadd03f60757","observation_id":"fbcc0c46-20ab-48d4-a607-eebf4c4d595a","resolution":{"observed_at":"2026-08-15T14:58:25.077470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.081195Z","title":"2025 , doi=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.081195Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:eacb86c414c4b9053017de8301a19731026c9782d2aa39593ddd39fc9c0a6397","observation_id":"8ea5e8a8-f1a2-4ae1-ace9-00a8f8ca2934","resolution":{"observed_at":"2026-08-15T14:58:25.081195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.084898Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.084898Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:5dde0d646a9a17b0e4c5e23858549fafa13d65b0b86cfedc1a3911d27a82f672","observation_id":"aa679c6a-94c6-47a5-8e07-fd289336968f","resolution":{"observed_at":"2026-08-15T14:58:25.084898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.092293Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.092293Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:45fa3cf59ab30a53479642518e49a4c69eb891a6017cd4a2b8ce83c16fe2785e","observation_id":"b932229e-2635-4bc3-8e17-0c23d88578de","resolution":{"observed_at":"2026-08-15T14:58:25.092293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.095905Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.095905Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:4eb73ebf0810fd1e5c98f1bbc8051a6200b29992d0d9ca009f6c0874efa183b1","observation_id":"0eca09be-fef2-45e6-9a32-fa7019ca9eb7","resolution":{"observed_at":"2026-08-15T14:58:25.095905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.099515Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.099515Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:d3cd1be96f5ebff3abbb3e8828323e839f45f71f77b620b2bb5196c1eea72088","observation_id":"1073bb2f-680a-4cc8-a996-986b9a3e99fd","resolution":{"observed_at":"2026-08-15T14:58:25.099515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.112138Z","title":"and Wu, Zuxuan , booktitle=AAAI, year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.112138Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:796177faa1dcbbbdf9ebb65646434b337212b116b6610c8a0cc43d3e54f1df00","observation_id":"f48232d7-3857-4cbf-9c45-9aa199dc7b41","resolution":{"observed_at":"2026-08-15T14:58:25.112138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.119545Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.119545Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:d62e24ccf88a47c40fd31b7fb90d76732bdd16ae25485560a12edac850af2505","observation_id":"3505c39c-f7d2-403e-955d-d6d1e1e7d1be","resolution":{"observed_at":"2026-08-15T14:58:25.119545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.123228Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.123228Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:5d3712ee9cde74570c270919e3ac8a68fb58ba315bc101770da8c6944fa50747","observation_id":"2685931d-60ad-4f2f-9c66-bb1264146296","resolution":{"observed_at":"2026-08-15T14:58:25.123228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.126910Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.126910Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:86d48a71928d0619c45ed9d0d1400b8ef65a88619986e17bb58304152e6ef7f7","observation_id":"a1f6d678-9263-4d8b-95b6-044519f6d30b","resolution":{"observed_at":"2026-08-15T14:58:25.126910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.130462Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.130462Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:7a3677d7da0d4bfbe3044df1a747f9fed20c776685825f4330136b1daa50aed9","observation_id":"a00f4dbc-2218-44e4-b3d4-f958770dfa13","resolution":{"observed_at":"2026-08-15T14:58:25.130462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.766038Z","title":null,"venue":null,"work_id":"e87339ab-e9a9-4fe6-8f9e-a9b04c2179e8","year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.134263Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:affc1d284dda733d5f635b88e92d75b643db12b68b4e889b34f418a8129adf7e","observation_id":"c41a0109-2c41-4021-a11a-05d8c96ba3bf","resolution":{"observed_at":"2026-08-15T14:58:27.771156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.700718Z","title":null,"venue":null,"work_id":"2f9c6fb2-ba47-4ea0-9a36-d8006a88012d","year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.138125Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:7bf230b37f8ab8780f24ee978d89322d6269acddf8e064b23d2268fcac6f6410","observation_id":"ee770dc7-b1d8-4e1c-bdd7-eedc1e5df9ba","resolution":{"observed_at":"2026-08-15T14:58:27.730259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.662284Z","title":null,"venue":null,"work_id":"022250bb-2bb8-4852-bc62-e318b86866f6","year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.141816Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:22f206d5508298cf26ec7d750d77f71b664acc0a1ed5295b1d7fa615715547c3","observation_id":"ebc2128d-9f13-44ac-8866-a940eb24ae2f","resolution":{"observed_at":"2026-08-15T14:58:27.666961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.647106Z","title":null,"venue":null,"work_id":"249a6dfc-29d0-43eb-85a1-fc3fbbb65681","year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.153988Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:4980f8a40f5353a3dbac119efcee1f8589e575095e5c9f6a47305c35067b6630","observation_id":"3dc029aa-ad02-4c16-b072-79d2e4ab8d60","resolution":{"observed_at":"2026-08-15T14:58:27.652145Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.631773Z","title":null,"venue":null,"work_id":"3331f260-c426-48c7-89a6-e911e8b868bc","year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.157819Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:cb3281c518e0a27ec7065c08263669df71fe02785bb65496dda1cfc1cbe801c0","observation_id":"8aa9b1df-010a-41cb-9e9a-8eecedb5c6ff","resolution":{"observed_at":"2026-08-15T14:58:27.637060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.617441Z","title":null,"venue":null,"work_id":"c80a8284-3b4b-48c7-8867-346ece24a92d","year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.161501Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:7ce69ccbc3b20e31469204ed5a649d096fca5af62267bd91dc150e84201d50ab","observation_id":"622e4b3b-f3ed-4252-9b58-aff7d2e1851a","resolution":{"observed_at":"2026-08-15T14:58:27.622002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.602856Z","title":null,"venue":null,"work_id":"2dbbd94a-7c4a-4bf9-850a-c0909ea7721b","year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.165552Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:575b97f80c30788c06bd70a6b08f0da4f2bea9473497f0a19189de6d462faf98","observation_id":"25ce3404-60bf-4d84-b0a7-5f2f50a3ce7c","resolution":{"observed_at":"2026-08-15T14:58:27.607524Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.588772Z","title":null,"venue":null,"work_id":"6f56d911-c23f-4440-a73d-db40ce3bb7b6","year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.169260Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:c55076139c02bf7dddfce54bbef0e26282f3e866de9b7b35fb077895da7eec2e","observation_id":"0a161ee1-5ef9-460b-99c5-4750169010c4","resolution":{"observed_at":"2026-08-15T14:58:27.593469Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.574251Z","title":null,"venue":null,"work_id":"cdfea77f-ec95-4d5a-9a76-ab171c31f742","year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.173598Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:4a9e8caf6ae62fa98df66ef5e79fda34e712ca21b02da13ca2f10f8004455a14","observation_id":"a99cd7d2-49c5-4ce2-8b8b-f57f4ea50646","resolution":{"observed_at":"2026-08-15T14:58:27.579138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.12624","last_updated":"2026-05-14T17:59:31Z","snapshot_observed_at":"2026-08-11T15:34:29.901545Z","submitted_at":"2026-05-12T18:09:42Z","title":"MindVLA-U1: VLA Beats VA with Unified Streaming Architecture for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.12624","snapshot_observed_at":"2026-08-15T14:58:25.177235Z","title":"2605.12624 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.177235Z"},"links":{"cited_paper":"/paper/2605.12624","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:7552a29d5a3e7561205d2235af27b81781fe1cb363ed874e965487a3cbeae051","observation_id":"7118b84e-bda4-44da-a3df-3b3cdfc64ea8","resolution":{"observed_at":"2026-08-15T14:58:25.177235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.539798Z","title":null,"venue":null,"work_id":"f826db0d-a720-4c9a-a425-d2429cc0ce07","year":null},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.194190Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:6c63add1e6edf1fc1221ac2a3618e44812bf5a324dffb66ae79795961efec869","observation_id":"8d1066c2-d0e3-4ca5-9396-4f3ef87c8a0c","resolution":{"observed_at":"2026-08-15T14:58:27.561842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.471892Z","title":null,"venue":null,"work_id":"765d3347-784c-4138-8831-dd90cad92d8f","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.197948Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:d3f62c31f8b9628eec5d55654e67d096c41985b07f596dc63bf85e61e57b4d48","observation_id":"2b448022-ba77-4aa3-a75a-a4a8532e5ef9","resolution":{"observed_at":"2026-08-15T14:58:27.499829Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.409883Z","title":null,"venue":null,"work_id":"d7bdeacd-31ca-4e2c-a07f-60482bb808d1","year":2025},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.201959Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:7bfadc43ccd6d34d1df5b7865878cd3f7b262c2bb20f5d77eec87e50066b686c","observation_id":"a47880f1-8ec1-4265-8a8f-374bfea8a031","resolution":{"observed_at":"2026-08-15T14:58:27.432849Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.394592Z","title":null,"venue":null,"work_id":"512d5818-5e17-4e05-93a9-87c76c50a769","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.205702Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:994756d710e6aa8ee4c2999cf957de21d449064dc01c47e69d67328a396c381c","observation_id":"ae48fc40-c20e-4e90-a75e-e55dd9068a7d","resolution":{"observed_at":"2026-08-15T14:58:27.399723Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.379724Z","title":null,"venue":null,"work_id":"2e5c7226-01bd-4dbd-a55d-f16ab2d43932","year":2025},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.209602Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:97c1ae1a306c83b6661ca539567641975b6741319b87420a533854f8c82ce101","observation_id":"30b6af96-cb37-46d4-9afd-8952946e4e56","resolution":{"observed_at":"2026-08-15T14:58:27.384444Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.329617Z","title":null,"venue":null,"work_id":"ab423727-8e4c-43f4-baa3-6572cb3ac73d","year":2023},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.213292Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:2b82b18017c00f939ef0edfe451717ce5676b992c21e4b70ef18270a2afa2314","observation_id":"f019a5b9-67e6-4991-a9c8-6402bf3ac027","resolution":{"observed_at":"2026-08-15T14:58:27.356830Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.297495Z","title":null,"venue":null,"work_id":"5249859d-a3df-45c4-adc3-b102050b0321","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.217032Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:64ed16f12dacd302faa2d3391a22c902b295b4529594e002c240201d1cc3ba30","observation_id":"7238a36f-2901-47fa-bb13-f4672c9b4b47","resolution":{"observed_at":"2026-08-15T14:58:27.301549Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.283980Z","title":null,"venue":null,"work_id":"038f1fce-ea42-4473-8f3e-0f5c8becfb80","year":2024},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.220874Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:a2cd44e1afe7a5c782259beca2b0a2cf4a678930747e2067aace5f9171d5947b","observation_id":"78c501fb-af0e-4737-8937-748bcb4b38be","resolution":{"observed_at":"2026-08-15T14:58:27.288164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20329","last_updated":"2026-06-03T18:02:24Z","snapshot_observed_at":"2026-07-06T23:06:49.210284Z","submitted_at":"2026-04-22T08:23:48Z","title":"Image Generators are Generalist Vision Learners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.20329","snapshot_observed_at":"2026-08-15T14:58:25.224677Z","title":"T.; Genova, K.; Kannen, N.; Ben, S.; Li, Y.; Guo, M.; Yogin, S.; Gu, Y.; Chen, H.; Wang, O.; Xie, S.; Zhou, H.; He, K.; Funkhouser, T.; Alayrac, J.-B.; and Soricut, R","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.224677Z"},"links":{"cited_paper":"/paper/2604.20329","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:d6754e3906437df817b7a71cd183b5815f28108350fa675a6623e17552714c9d","observation_id":"90179be2-551b-435e-997b-80b6c74ad5ad","resolution":{"observed_at":"2026-08-15T14:58:25.224677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.269807Z","title":null,"venue":null,"work_id":"a71d9437-e597-4aef-9a0c-993363254942","year":2024},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.228850Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:32f9e31b4383828a4c0382584fb1a37dc1cbb39a4747470a1fbc6f5cf7ac397d","observation_id":"6ca920f3-b019-4828-93fa-93aec1e96800","resolution":{"observed_at":"2026-08-15T14:58:27.274104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26694","last_updated":"2026-05-07T11:23:39Z","snapshot_observed_at":"2026-07-06T23:12:19.460065Z","submitted_at":"2026-04-29T14:01:54Z","title":"Unified 4D World Action Modeling from Video Priors with Asynchronous Denoising","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26694","snapshot_observed_at":"2026-08-15T14:58:25.232779Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.232779Z"},"links":{"cited_paper":"/paper/2604.26694","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:1e179d48b483b3fbba50f18cccade6acb5196327a339889e12bf79e3f9af1d62","observation_id":"67590e49-e912-4cb7-9ad7-023c7692114d","resolution":{"observed_at":"2026-08-15T14:58:25.232779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06560","last_updated":"2026-07-07T17:58:33Z","snapshot_observed_at":"2026-08-15T08:35:30.089617Z","submitted_at":"2026-07-07T17:58:33Z","title":"Vision as Unified Multimodal Generation","version":1},"cited_work":{"arxiv_id":"2607.06560","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.06560","snapshot_observed_at":"2026-08-15T14:58:25.549562Z","title":"Vision as Unified Multimodal Generation","venue":"cs.CV","work_id":"47db6654-045e-4909-90f3-3be131be692b","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.236569Z"},"links":{"cited_paper":"/paper/2607.06560","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:3363bfb2da1e88488d9b9bdeb8f93399185a93b24ea97e3bbceb8b20a72e6da0","observation_id":"4f85fa86-4c9d-4222-a0ed-2bcec8a93d8d","resolution":{"observed_at":"2026-08-15T14:58:25.556240Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.09701","last_updated":"2026-05-10T18:45:21Z","snapshot_observed_at":"2026-08-15T04:01:20.368385Z","submitted_at":"2026-05-10T18:45:21Z","title":"DriveFuture: Future-Aware Latent World Models for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.09701","snapshot_observed_at":"2026-08-15T14:58:25.240393Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.240393Z"},"links":{"cited_paper":"/paper/2605.09701","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:46c7cd7590b634950fd4d7b4dcac2d59a17bd6401f9d7577069e985b71a87c4a","observation_id":"cf3ebefb-e13f-496f-893a-c5e6fddcf79c","resolution":{"observed_at":"2026-08-15T14:58:25.240393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00080","last_updated":"2026-04-30T14:35:31Z","snapshot_observed_at":"2026-08-04T20:02:32.182599Z","submitted_at":"2026-04-30T14:35:31Z","title":"World Model for Robot Learning: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.00080","snapshot_observed_at":"2026-08-15T14:58:25.243822Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.243822Z"},"links":{"cited_paper":"/paper/2605.00080","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:d8c00297403961d47678efd8f7095b90bc9f526f72bb208f807ee56be7bd7015","observation_id":"c7f546f3-e1c3-4ecd-b03c-6314ca576c0b","resolution":{"observed_at":"2026-08-15T14:58:25.243822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-15T14:58:25.247849Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.247849Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:25eed5d553a9161ce3c18470a78d6c8479a8422248de84ca3281f6f691026e5a","observation_id":"9c5a780d-be37-4a35-a947-e29d793ebcea","resolution":{"observed_at":"2026-08-15T14:58:25.247849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.254845Z","title":null,"venue":null,"work_id":"708197c9-e8d5-4fdf-a7d1-169bcab143f4","year":2023},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.251404Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:c719858815af0ba0beca84bfd437e76e1247199e77b2244e651b4c46bd49ad43","observation_id":"9fcd654e-0cde-4ba8-be54-a2a5ce563286","resolution":{"observed_at":"2026-08-15T14:58:27.259596Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.240780Z","title":null,"venue":null,"work_id":"164217c9-647e-4cc7-99b2-a8fd02e73afd","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.255234Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:164be85a92c1949eea90323afcd6b1fe5940a84493d7366b14a8e2f910f94718","observation_id":"188e2b2f-66cb-41c0-8a7e-d1db64890d7e","resolution":{"observed_at":"2026-08-15T14:58:27.245206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.226185Z","title":null,"venue":null,"work_id":"e9665dc8-82b6-4901-af92-31fb029b3acc","year":2025},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.259117Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:129157fd58f526ecc47c3c7ca0a51e98461606cbb21edcec21fe69f2c3753154","observation_id":"683276ea-c000-4deb-acec-184137699d2c","resolution":{"observed_at":"2026-08-15T14:58:27.230901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.212558Z","title":null,"venue":null,"work_id":"4ef84b35-438a-45de-835d-51d1369d8f8c","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.263112Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:688e6a89f310603c5c20780939fc3802f0866131f7c2188fd3d0a0c9e3ca67e5","observation_id":"33309f34-5a46-47c3-b690-0aa26d32f27e","resolution":{"observed_at":"2026-08-15T14:58:27.217109Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06571","last_updated":"2025-08-15T05:19:30Z","snapshot_observed_at":"2026-08-14T18:50:37.854746Z","submitted_at":"2025-08-07T06:30:05Z","title":"IRL-VLA: Training an Vision-Language-Action Policy via Reward World Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.06571","snapshot_observed_at":"2026-08-15T14:58:25.267074Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.267074Z"},"links":{"cited_paper":"/paper/2508.06571","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:d136a7bab0648a74cdbace15e7449540249b1dce1162212358c10293d444830a","observation_id":"569447a6-a2a8-41e0-ac32-76e1a030b569","resolution":{"observed_at":"2026-08-15T14:58:25.267074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22313","last_updated":"2024-10-29T17:53:56Z","snapshot_observed_at":"2026-07-31T01:16:26.372370Z","submitted_at":"2024-10-29T17:53:56Z","title":"Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22313","snapshot_observed_at":"2026-08-15T14:58:25.274750Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.274750Z"},"links":{"cited_paper":"/paper/2410.22313","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:5389f1a804fe54b2f1a693a3dcdf934d2a9f8cf6434d00113d940e961b1cd7f9","observation_id":"bb9876bb-c8a4-46ad-92e8-446eeaae8fd6","resolution":{"observed_at":"2026-08-15T14:58:25.274750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.141514Z","title":null,"venue":null,"work_id":"c93491d7-c920-41a5-af9e-b58f47a9f1cd","year":2023},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.279040Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:8c79db89aa3e30419d254bf817c5104e460fdf0871ebf6ba59c80631e47643a8","observation_id":"6ee67281-7b71-4e3d-98b4-0415cbf1b0ef","resolution":{"observed_at":"2026-08-15T14:58:27.170209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:25.282966Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.282966Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:f4e0ce889fde3ff896ecc4ef0fec3bef871ce03a52b7c79b78c5d5bd39cbb5a1","observation_id":"05a10245-7927-420f-b2e1-9b19a824de47","resolution":{"observed_at":"2026-08-15T14:58:25.282966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.086433Z","title":null,"venue":null,"work_id":"d5db56ed-d5fc-4066-9090-7f41174bfc42","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.286673Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:45924d13d94ab908434c39fc810dfe470242e3e3b37e5ce89f6dace84f1099c7","observation_id":"21b529d8-63ce-408d-ae93-e861695ec53a","resolution":{"observed_at":"2026-08-15T14:58:27.100732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.071956Z","title":null,"venue":null,"work_id":"34a57b60-7006-4f12-b2b9-7e21d9a08b27","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":110,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.290423Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:111d74e97379afcf46e9893748674c34c2b3107010cfaaa45fa83ccb2cde7d97","observation_id":"77709934-e88c-47fb-815b-50e548603065","resolution":{"observed_at":"2026-08-15T14:58:27.076184Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12820","last_updated":"2025-03-17T04:58:09Z","snapshot_observed_at":"2026-08-16T12:49:29.383641Z","submitted_at":"2025-03-17T04:58:09Z","title":"Hydra-MDP++: Advancing End-to-End Driving via Expert-Guided Hydra-Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12820","snapshot_observed_at":"2026-08-15T14:58:25.294174Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.294174Z"},"links":{"cited_paper":"/paper/2503.12820","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:545c4b68ed075fc3a912727c0f51e2ee90da39a74de8bfa5eaa9e484ad059ebe","observation_id":"b89f74e3-7272-4c59-afcd-2c7b359da0a3","resolution":{"observed_at":"2026-08-15T14:58:25.294174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.057660Z","title":null,"venue":null,"work_id":"930386e8-e36d-448f-810b-6366c55f642a","year":2025},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.298213Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:73064eee0521781473128f431c0004ee08e57d35df56017f6061c2da82f5d34c","observation_id":"0e33b8f1-061b-4fc9-abcb-9614448238a8","resolution":{"observed_at":"2026-08-15T14:58:27.061941Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.044093Z","title":null,"venue":null,"work_id":"fd7eb4e1-2ab6-4470-ab01-6c4479a4ac0e","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":113,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.302069Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:237de9a29745936581718d8c82b2b9791eb71a99febcf05b58e3c1287401bea1","observation_id":"1fed9965-b49d-4960-ae63-7648816594d7","resolution":{"observed_at":"2026-08-15T14:58:27.048308Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.14048","last_updated":"2026-07-07T05:53:33Z","snapshot_observed_at":"2026-08-15T00:12:52.298182Z","submitted_at":"2026-06-12T02:49:34Z","title":"WAM4D: Fast 4D World Action Model via Spatial Register Tokens","version":3},"cited_work":{"arxiv_id":"2606.14048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.14048","snapshot_observed_at":"2026-08-15T14:58:26.290376Z","title":"WAM4D: Fast 4D World Action Model via Spatial Register Tokens","venue":"cs.CV","work_id":"e16478b6-c399-4ff2-9ad8-cf6da1e55fcd","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":114,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.314751Z"},"links":{"cited_paper":"/paper/2606.14048","citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:99af422030d243aaec089e582491aee93e8ea2dc91e2b9ab7dcb635ec92f4342","observation_id":"0b3a8ab3-7175-4de9-9535-b20fd66f4080","resolution":{"observed_at":"2026-08-15T14:58:26.296776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.031128Z","title":null,"venue":null,"work_id":"8c22e258-fa55-4005-a47c-3e67e4b61a3e","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":115,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.319395Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:b5c4df1efef775b93fd271d3ea52e364fb534486cfccc227465bed6ee1e1511d","observation_id":"b13e2191-4b70-4bcf-9751-4be9b9bf8bc7","resolution":{"observed_at":"2026-08-15T14:58:27.035227Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.017345Z","title":null,"venue":null,"work_id":"cc47d740-c77b-40a4-8935-189bee42fe7e","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.323346Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:f21ad435ef37b529bb15ab4471fed6d55bbac3e1797cf44587154462d8b061be","observation_id":"48c0643e-6466-4a8b-b9de-0b28f15ac487","resolution":{"observed_at":"2026-08-15T14:58:27.021615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:27.004158Z","title":null,"venue":null,"work_id":"f99c7fc7-7027-4ed8-9fab-c5b9f7666945","year":2025},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":117,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.327199Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:07c91a49c31ca634f5eb2397c4e87bd10bbb388cc95621257987fc06dc7b1852","observation_id":"9034e7e5-eec8-4239-91d8-78df9ed8e586","resolution":{"observed_at":"2026-08-15T14:58:27.008190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:26.990246Z","title":null,"venue":null,"work_id":"cdcda528-c357-4939-980a-bb6ae59d33a8","year":2025},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.330933Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:beeecb361b0fafd912765fe7e16b188c55e7e277357fcdb31ce0b42170925d75","observation_id":"c6225100-2140-401c-8347-a047831ffc95","resolution":{"observed_at":"2026-08-15T14:58:26.994417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:58:26.898051Z","title":"H.; Chen, D","venue":null,"work_id":"6a87fd40-81ae-40fa-a34d-9449a606b702","year":2026},"citing_paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving","version":1},"reference_index":119,"source":"arxiv_source","source_observed_at":"2026-08-15T14:58:25.334464Z"},"links":{"citing_paper":"/paper/2608.03084"},"observation_digest":"sha256:99eb8468eb80df2ff6905783f8793bc6f8aafef5773f76bc9831da0acb305d65","observation_id":"9d3f9c28-40eb-4932-99ba-e2a1b042b79c","resolution":{"observed_at":"2026-08-15T14:58:26.946690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03084","last_updated":"2026-08-04T03:51:53Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T04:07:54.112494Z","submitted_at":"2026-08-04T03:51:53Z","title":"SUV: Future Scene Understanding as Video Generation for End-to-End Driving"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":96,"verified_exact":3,"verified_fuzzy":1},"total_outbound_references":132},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 100 of 132 outbound references and 0 inbound Pith citation observations for arXiv:2608.03084."}