{"as_of":"2026-08-19T15:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf442086d3b817cd796facc309038857e8031c3f45918213252e27c0caac1fc3","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:16:23.493262Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.11302/citation-record","integrity":"/paper/2506.11302/integrity","json":"/paper/2506.11302/citation-record.json","paper":"/paper/2506.11302"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:28.399549Z","title":"Statewide visual geolocalization in the wild","venue":null,"work_id":"6118e57b-1196-41a0-9e76-cbb8d5871b31","year":2024},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:18.406000Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:1af0a96b687ee1841cb6eb85ea8b527a464184ddf58964328bc0f432d44fc530","observation_id":"1c5fba8e-019f-4492-be73-65a2442c5f84","resolution":{"observed_at":"2026-08-07T04:16:28.404840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:28.381221Z","title":"Geoclip: Clip-inspired alignment between locations and images for effective worldwide geo-localization.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"7d1c9965-1f87-46da-9dba-c72896dfccca","year":2024},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:18.463028Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:eefa0a970f31e0598d718cf6087b35d24b0808c590d4fe720246eba26d2fc22c","observation_id":"04e4be37-4d37-4c77-a4ef-388c255fa73f","resolution":{"observed_at":"2026-08-07T04:16:28.386991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:28.362022Z","title":"Pigeon: Predicting image geolocations","venue":null,"work_id":"d7499118-f21c-4254-9b6d-abe298518933","year":2024},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:18.558904Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:0d25bceb6e875c1f6761de30dffaef79055236d2db8d1a0ba9f9b6406c5aec10","observation_id":"1448e4e4-26c9-4771-9827-d5cc1ed944e8","resolution":{"observed_at":"2026-08-07T04:16:28.368291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:18.688496Z","title":"Video generation models as world simulators, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:18.688496Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:ab295ada18d38f4ad0ea6233b3a623f0ee0c948b8404e872a70073cd42f0e9df","observation_id":"dc79d10b-96a2-45be-bd82-3622721a3f0a","resolution":{"observed_at":"2026-08-07T04:16:18.688496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14125","last_updated":"2024-06-04T17:25:20Z","snapshot_observed_at":"2026-08-14T12:12:01.418974Z","submitted_at":"2023-12-21T18:46:41Z","title":"VideoPoet: A Large Language Model for Zero-Shot Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14125","snapshot_observed_at":"2026-08-07T04:16:18.792377Z","title":"Videopoet: A large language model for zero-shot video generation.arXiv preprint arXiv:2312.14125, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:18.792377Z"},"links":{"cited_paper":"/paper/2312.14125","citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:3ccf41df96207a4008ff09087c7b98c06508a8626eadd96d41afbed940553f6a","observation_id":"f6bd4c8c-b112-4801-ab68-6a0e6550ac1e","resolution":{"observed_at":"2026-08-07T04:16:18.792377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-08-12T19:21:15.526321Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-07T04:16:18.884644Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers.arXiv preprint arXiv:2205.15868, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:18.884644Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:94ba04dca091830de313c726f1060c8814fc1b1918211cf791ea29144cef0f50","observation_id":"4b222b6a-3874-4657-849c-8cd83b298ea3","resolution":{"observed_at":"2026-08-07T04:16:18.884644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:28.328349Z","title":"Align your latents: High-resolution video synthesis with latent diffusion models","venue":null,"work_id":"a44b6f8b-32d2-4dc4-8b09-37069f0f4d9d","year":2023},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:19.010118Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:21ba64e2c16144a5671494f69cb8853c0aa2031b15dca39c09efcba3c95af358","observation_id":"9020d3a2-0b75-4415-84f7-57ff80fee889","resolution":{"observed_at":"2026-08-07T04:16:28.335706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:28.305196Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":"d08ce9b5-5888-490a-9d84-d00ce272624d","year":2023},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:19.122079Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:2f6b3456b1c63bfa2bf9045895c5b035979a99695fa0d43947d83c8bf191ad50","observation_id":"da437b05-6d30-44b3-8add-64bf1eaadf3f","resolution":{"observed_at":"2026-08-07T04:16:28.313982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03572","last_updated":"2025-04-11T19:20:22Z","snapshot_observed_at":"2026-08-16T19:44:01.189794Z","submitted_at":"2024-12-04T18:59:45Z","title":"Navigation World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03572","snapshot_observed_at":"2026-08-07T04:16:19.213858Z","title":"Navigation world models.arXiv preprint arXiv:2412.03572, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:19.213858Z"},"links":{"cited_paper":"/paper/2412.03572","citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:dd600052c3ce7c2ed4e46ffa70a3400ffef4e2ddad0f90345ce992bd80cff480","observation_id":"660da63f-05e8-47fe-9d3d-b2c758460781","resolution":{"observed_at":"2026-08-07T04:16:19.213858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-07T04:16:19.297717Z","title":"Gaia-1: A generative world model for autonomous driving.arXiv preprint arXiv:2309.17080, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:19.297717Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:34464384a6b092f3bb840d74e0305c7a6571bbe2f54d2934ac2cc98c3a667558","observation_id":"1bf37812-8ed6-4d67-9e31-88047536c8a0","resolution":{"observed_at":"2026-08-07T04:16:19.297717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14837","last_updated":"2025-04-24T03:03:57Z","snapshot_observed_at":"2026-08-14T07:06:06.462400Z","submitted_at":"2024-08-27T07:46:07Z","title":"Diffusion Models Are Real-Time Game Engines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14837","snapshot_observed_at":"2026-08-07T04:16:19.389020Z","title":"Diffusion models are real-time game engines.arXiv preprint arXiv:2408.14837, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:19.389020Z"},"links":{"cited_paper":"/paper/2408.14837","citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:3b15457cdedb19b28c9b434e5080555bc7b9bf968af72ad2f25909028eea7d5d","observation_id":"cc13b71f-a2a7-4878-91ed-35132d8f541d","resolution":{"observed_at":"2026-08-07T04:16:19.389020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:19.462231Z","title":"Dream to control: Learning behaviors by latent imagination","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:19.462231Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:e640ef660945d52e71cb4b72e36ba5154390ec6ef7a5ff08083d98b194fc9076","observation_id":"bc9a3295-fc34-4eef-ac58-2357f5efa967","resolution":{"observed_at":"2026-08-07T04:16:19.462231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:19.579266Z","title":"Genie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:19.579266Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:548df45b0ee22d601508454d6f8d84b85e0439f3fe30465f5e8fbdfdbf2194b7","observation_id":"65861231-864b-4ae8-a6df-4f3bfebf5af2","resolution":{"observed_at":"2026-08-07T04:16:19.579266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:28.260178Z","title":"Planet dump retrieved from https://planet.osm.org","venue":null,"work_id":"1ff9032d-baaf-4b77-a86f-e6e0d86f2ad3","year":2017},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:19.656229Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:4126d24f0bbad0d2aa6f0a59dce420e7af6a1e48f274dee98cddb778f8502f0b","observation_id":"9fd7095e-970e-4183-b1d5-4f953f4235a9","resolution":{"observed_at":"2026-08-07T04:16:28.266800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-08-12T11:54:14.007649Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-07T04:16:19.802641Z","title":"Chameleon: Mixed-modal early-fusion foundation models.arXiv preprint arXiv:2405.09818, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:19.802641Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:a2eae8ecee770a25f2f92d1f3581d01d6928c235302b4d305856c27c48013aca","observation_id":"d4d2de75-2979-45dc-9df7-661d1c6f0499","resolution":{"observed_at":"2026-08-07T04:16:19.802641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:28.117089Z","title":"Video pixel networks","venue":null,"work_id":"5c46cdd9-4be9-4481-8399-128143b21993","year":2017},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:19.879784Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:27c1efe53f0e1f5b34bd19cd5e237ad58a3dd65fed5c66e7aac915c84acc0894","observation_id":"aa6ba4df-27e8-4de7-83aa-1df9a58850cf","resolution":{"observed_at":"2026-08-07T04:16:28.186219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.06571","last_updated":"2019-09-25T16:37:55Z","snapshot_observed_at":"2026-08-15T04:08:33.157509Z","submitted_at":"2019-07-15T16:27:04Z","title":"Adversarial Video Generation on Complex Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.06571","snapshot_observed_at":"2026-08-07T04:16:19.963790Z","title":"Efficient video generation on complex datasets.CoRR, abs/1907.06571, 2019","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:19.963790Z"},"links":{"cited_paper":"/paper/1907.06571","citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:164c6156365cbb70d0fec19713c0781ab920efc0ea0a7dcb30e83971d8b93140","observation_id":"22d9ad5c-c6be-4545-b1a3-dcc64fe6b8e8","resolution":{"observed_at":"2026-08-07T04:16:19.963790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:27.879011Z","title":"Unsupervised learning for physical interaction through video prediction","venue":null,"work_id":"c1ee0f74-6011-4a1a-997e-a7d7b2b174e4","year":2016},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:20.071722Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:1563857966465bf0678ada561cbab721727737d30d37e1859d092e139d0e1a44","observation_id":"fe791880-6990-4bb5-b836-088386e1278d","resolution":{"observed_at":"2026-08-07T04:16:27.999931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04035","last_updated":"2021-11-17T17:56:08Z","snapshot_observed_at":"2026-08-18T16:47:34.289341Z","submitted_at":"2020-03-09T10:52:25Z","title":"Transformation-based Adversarial Video Prediction on Large-Scale Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04035","snapshot_observed_at":"2026-08-07T04:16:20.179362Z","title":"Transformation-based adversarial video prediction on large-scale data.CoRR, abs/2003.04035, 2020","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:20.179362Z"},"links":{"cited_paper":"/paper/2003.04035","citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:d3f84cdf7f98d4f95b609e4120698d5d617d6cc3e5c7469582b90ad19758f3bf","observation_id":"627ad9ad-24b9-4870-bc55-a50a46a40d57","resolution":{"observed_at":"2026-08-07T04:16:20.179362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:27.674457Z","title":"Deep predictive coding networks for video prediction and unsupervised learning","venue":null,"work_id":"253efc85-81d0-4652-b7a9-85a2120c4b13","year":2017},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:20.291252Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:406f4ae11c6e8468b04e0dcc5b352218889e17cc56ed76bae0cda43cca12f616","observation_id":"c1ad3588-765a-4c26-bd1b-1367345378c9","resolution":{"observed_at":"2026-08-07T04:16:27.813132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:20.368711Z","title":"Videogpt: Video generation using vq-vae and transformers, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:20.368711Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:5bbbf4f386ad0f49f8105d0181c87d5e96fe44a36cb7c6f3984875efac3c9046","observation_id":"96f9b2de-f399-4b12-b639-b31edb7d822b","resolution":{"observed_at":"2026-08-07T04:16:20.368711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:27.353615Z","title":"Blattmann, Robin Rombach, Huan Ling, Tim Dockhorn, Seung Wook Kim, Sanja Fidler, and Karsten Kreis","venue":null,"work_id":"9dbd3e30-74fc-4b77-8fed-c2d868fb0a97","year":2023},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:20.460857Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:79c7d5bdc8bb164ad3d9f04ed9211556a5712e1d91179cafeef20a3c6a7c3aef","observation_id":"5100b42b-89ec-4789-a45f-4b382d2c3b48","resolution":{"observed_at":"2026-08-07T04:16:27.494178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:27.124163Z","title":"Predicting video with VQV AE, 2021","venue":null,"work_id":"f704f28c-db06-4932-b9bd-e35239398709","year":2021},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:20.573141Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:87e577aa36605606009e053ca295080ce2538713acb12a83ec49d6d9560b4ca9","observation_id":"b0faf90d-215f-44cf-adb8-8d8738cc2c98","resolution":{"observed_at":"2026-08-07T04:16:27.241848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:26.874861Z","title":"Ccvs: Context-aware controllable video synthesis","venue":null,"work_id":"1e6b266c-54f6-4052-b65b-8f90d9b6dd49","year":2021},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:20.692427Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:813d8302ed8be59e797378516ea52e043c56d00bd964f0480d72f23da0659a9d","observation_id":"eb266bba-116c-4682-86fc-8cddc0824d5a","resolution":{"observed_at":"2026-08-07T04:16:27.016948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:26.651160Z","title":"Diffusion models for video prediction and infilling.Transactions on Machine Learning Research, 2022","venue":null,"work_id":"06e625db-dac7-48fc-919a-aa51b2a68f54","year":2022},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:20.808365Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:72cc2d2c5b7962b5ab41c8c3650a4cc4ae85f10a22c032ef4b664e5bab2009e4","observation_id":"2fbe121d-ce67-4b54-ade3-27bab1b9fb44","resolution":{"observed_at":"2026-08-07T04:16:26.769450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:26.453367Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":"af8e63f7-9a73-4757-a3ee-a017b2f457b8","year":2023},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:20.887632Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:90b2aedad6e02b3cf16a0214a026ab1961cf804b6db535df4e206068e0d577f5","observation_id":"c277f227-623c-4d6b-b3ae-71d7522abe77","resolution":{"observed_at":"2026-08-07T04:16:26.554578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:21.003489Z","title":"Kingma, Ben Poole, Mohammad Norouzi, David J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:21.003489Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:55b31810a3e15aad19c1758ec0c8039796e666fe52c252744ec61ac21b5239df","observation_id":"b435dfd3-d289-4041-bf04-1f4969be6fb2","resolution":{"observed_at":"2026-08-07T04:16:21.003489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:26.240186Z","title":"Video diffusion models","venue":null,"work_id":"1cb8f7ab-a2ec-4a18-99b7-21bcbc71b7ee","year":2022},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:21.108454Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:7258b47497b123e18a38efbdccb6d0722ed9c3c31f04dd2d53e047281bf61820","observation_id":"4df71208-2c94-4219-8c98-d87e1644b4da","resolution":{"observed_at":"2026-08-07T04:16:26.382006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:21.201435Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:21.201435Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:937425a4f289d35eadc510c31c6576deffc419e74c467f5397fb0e5866a9ff09","observation_id":"fce7da0f-e95f-43d6-9eec-f99c1de11fbc","resolution":{"observed_at":"2026-08-07T04:16:21.201435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:26.105176Z","title":"Sequential modeling enables scalable learning for large vision models","venue":null,"work_id":"a18cd7f5-c4cb-403f-9e08-43766501d0b7","year":2024},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:21.282938Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:8e8b1e62afc8beca19da74241850804206911fa9eda7a238d0a2e085f530da90","observation_id":"b9c9d333-4172-461b-8fb2-caa2e57cc9af","resolution":{"observed_at":"2026-08-07T04:16:26.129356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:21.361623Z","title":"Drivegan: Towards a controllable high-quality neural simulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:21.361623Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:5336255ba2ed2ec5359f387f132a9463f4cb22c79825d395bd29d8e70fd6300f","observation_id":"04f726fd-b98b-4078-9143-a4324c4fea88","resolution":{"observed_at":"2026-08-07T04:16:21.361623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:21.462320Z","title":"Scalability in per- ception for autonomous driving: Waymo open dataset","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:21.462320Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:38771b2b7c66d519f45666f2b0f58f8f2e0d6ae71fdecd17531afb8c8321ecc9","observation_id":"c57bdc1f-9220-417e-bd4a-0c63d6e94b4f","resolution":{"observed_at":"2026-08-07T04:16:21.462320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:21.575256Z","title":"Lang, Sourabh V ora, Venice Erin Liong, Qiang Xu, Anush Krishnan, Yu Pan, Giancarlo Baldan, and Oscar Beijbom","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:21.575256Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:513680e4622f97ada98ea69cc51ac732c33d6a78930a5ac7f7e93ad6b5b7f1d5","observation_id":"a3ef4743-ce24-419b-af3b-9776a22812be","resolution":{"observed_at":"2026-08-07T04:16:21.575256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:21.675118Z","title":"Argoverse 2: Next generation datasets for self-driving perception and forecasting","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:21.675118Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:378988f7b6a9c17dc15781517c7fa7e20b4e5798996dff09fae4cf414092fd23","observation_id":"56540233-1529-4e50-9eb7-aabe944555a3","resolution":{"observed_at":"2026-08-07T04:16:21.675118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:25.897594Z","title":"Recurrent world models facilitate policy evolution","venue":null,"work_id":"dbe65fbf-1dde-4c0e-8dae-7236cdc6c063","year":2018},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:21.755053Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:05e36eb8cfdf30a44426e0a75180a408c9267600d5930491b515578dee61f5a6","observation_id":"f28c585c-757b-4384-bce1-08c301f6e429","resolution":{"observed_at":"2026-08-07T04:16:25.986954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:25.777052Z","title":"Action-conditional video prediction using deep networks in atari games","venue":null,"work_id":"675d0c05-afc7-4d38-9313-3961aa2bbf44","year":null},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:21.841452Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:2627588409df3b205fa6928b5380bf4b0b1fc3f218ca532a579ea30565f94b0b","observation_id":"8d0f80d9-3628-45e3-9f2a-f519f431097b","resolution":{"observed_at":"2026-08-07T04:16:25.815761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:21.923390Z","title":"Action-conditioned benchmarking of robotic video prediction models: a comparative study","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:21.923390Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:d44ceb42fc3669b51e9d4c8b4a37191ed229250aec03c7791c862c7a93c7a0ad","observation_id":"17652cb7-0480-4f1a-9cf4-aae5e8ea137e","resolution":{"observed_at":"2026-08-07T04:16:21.923390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:22.017273Z","title":"Mastering atari with discrete world models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:22.017273Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:79c4bda039a0df5f6110647f917f3dec3f6bcfda1e86bf8ce69d90fa5063e133","observation_id":"a4ed42f7-3933-4694-82a9-4bbc79507d25","resolution":{"observed_at":"2026-08-07T04:16:22.017273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:25.652372Z","title":"Transformers are sample-efficient world models","venue":null,"work_id":"0ca2853d-0d21-4b31-a2e8-aa11491cf13f","year":2023},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:22.107191Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:db7f043c89d459e6d242cb1d8cc78518b9b412fd7069dfe82e86e80328a5e7b2","observation_id":"2c23d774-5b87-4aa9-a24d-7cd9aa02c8b8","resolution":{"observed_at":"2026-08-07T04:16:25.714076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:25.507368Z","title":"Transformer-based world models are happy with 100k interactions","venue":null,"work_id":"9421978e-01c0-42b2-87ff-6f2156635ca3","year":2023},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:22.189968Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:19d022595055c486f62bed78726e2ae2ea5abe54c08ea392e13032863a3b6fa0","observation_id":"ac337680-8d0f-4c1d-a92f-db75feee6d29","resolution":{"observed_at":"2026-08-07T04:16:25.549740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:25.379721Z","title":"Learning to simulate dynamic environments with gamegan","venue":null,"work_id":"80e37d0a-e138-429e-b1a0-057547526bff","year":2020},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:22.282949Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:f0ade952fa40a996d21df2d2962b53809da75641fd5f8367828dfb4ddf0fc565","observation_id":"303a93ad-80ec-47f3-9566-36c927be1c56","resolution":{"observed_at":"2026-08-07T04:16:25.449913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:25.224753Z","title":"Drivegan: Towards a controllable high-quality neural simulation","venue":null,"work_id":"1a34b1bc-db03-49bc-b3f0-a8179f67ac6f","year":2021},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:22.385193Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:046eb745f2416a0810248da549474b524202de58b1a4ec022858e69c5ea4c629","observation_id":"5d8aea56-5969-454e-80c5-0b1fc7cd7de5","resolution":{"observed_at":"2026-08-07T04:16:25.313143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:25.107972Z","title":null,"venue":null,"work_id":"7bc8b222-f239-4c76-b47e-a138c00a45c0","year":2020},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:22.463588Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:8d60349cb8b03286dc04caed8cd877936022e6c324c9dd99956f4e41640620e4","observation_id":"d26ded5e-0bb0-463a-b836-a47373aff2af","resolution":{"observed_at":"2026-08-07T04:16:25.162515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:24.992958Z","title":"Recurrent environment simulators","venue":null,"work_id":"424c22aa-d66f-4436-874c-30d1bc5dc352","year":2017},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:22.580543Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:02328bd21fe5c354679020d37d9bfce3ea4a288b6a05b1683c2895d6552c9938","observation_id":"1403fcf0-4522-48de-aaeb-ec04d8234496","resolution":{"observed_at":"2026-08-07T04:16:25.051882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:24.845915Z","title":"Iso-dream: Isolating and leveraging noncontrollable visual dynamics in world models","venue":null,"work_id":"3c0e9265-aac5-48df-878b-7aa494034b26","year":2022},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:22.662937Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:9b4fc3888e77bb328bdb5dbe667fb0df9ed9c7ce57c65b24f95cb94b9d99f430","observation_id":"161254ad-f2d0-40f5-97e2-eb855bf6181f","resolution":{"observed_at":"2026-08-07T04:16:24.899020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:22.730251Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:22.730251Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:ddf66b9e65e0fe04889f84c5993658aaabb05e9cc30b0fc9ae538a3c3f77159e","observation_id":"ca398826-78ea-4516-9345-b02cd6231a1c","resolution":{"observed_at":"2026-08-07T04:16:22.730251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09777","last_updated":"2023-11-27T05:09:29Z","snapshot_observed_at":"2026-08-16T14:59:48.218608Z","submitted_at":"2023-09-18T13:58:42Z","title":"DriveDreamer: Towards Real-world-driven World Models for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09777","snapshot_observed_at":"2026-08-07T04:16:22.829701Z","title":"Drivedreamer: Towards real-world-driven world models for autonomous driving.arXiv preprint arXiv:2309.09777, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:22.829701Z"},"links":{"cited_paper":"/paper/2309.09777","citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:0c356540df8a8b14624b00473beee9295c46d57da668d168cb0bd5afe9af57ea","observation_id":"7da16826-7672-42ed-97a0-260ab6805a28","resolution":{"observed_at":"2026-08-07T04:16:22.829701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17398","last_updated":"2024-10-28T05:53:17Z","snapshot_observed_at":"2026-08-16T13:48:56.802800Z","submitted_at":"2024-05-27T17:49:15Z","title":"Vista: A Generalizable Driving World Model with High Fidelity and Versatile Controllability","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17398","snapshot_observed_at":"2026-08-07T04:16:22.905844Z","title":"Vista: A generalizable driving world model with high fidelity and versatile controllability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:22.905844Z"},"links":{"cited_paper":"/paper/2405.17398","citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:0ea38eb22f256541cc09ade1485286460747068fab47efc9907f9f33c91a3928","observation_id":"69b47442-496b-4f24-9ed9-585e19cc31cf","resolution":{"observed_at":"2026-08-07T04:16:22.905844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:22.999951Z","title":"Pixel recurrent neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:22.999951Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:70540fad00a5725f649c5268a72d1c859c636b232d01cc1680adfa208d2ae268","observation_id":"4458b2b9-2c7c-451e-b329-4262290331da","resolution":{"observed_at":"2026-08-07T04:16:22.999951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:24.698948Z","title":"Video pixel networks","venue":null,"work_id":"70893fe5-5fac-48c9-995f-d87a0ac4caf4","year":2017},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:23.092143Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:32a9a53a67392e624c4c3811ed965db55a00aa78ca4d9976b1337836bb3789b2","observation_id":"59223df1-174a-4eca-9aa4-02ec2c5b1300","resolution":{"observed_at":"2026-08-07T04:16:24.760476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:24.552649Z","title":"Maskvit: Masked visual pre-training for video prediction","venue":null,"work_id":"074693fb-413a-4732-a223-9eda29985b79","year":2023},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:23.171213Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:4cd1d289c32165531e7385d7aa5469e6318d7d11f49079ca526af59fa0624dcc","observation_id":"b0836154-ef4c-4004-9056-9cffa414c8e1","resolution":{"observed_at":"2026-08-07T04:16:24.602336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:24.414437Z","title":"Autoregressive video generation without vector quantization","venue":null,"work_id":"b57aa5b8-20b5-4f09-aecb-72325634c381","year":2025},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:23.233598Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:93be0aae977f6bdcbf55a7297d4ec38a4f9981b611477dfe827da9b14b6a4c5c","observation_id":"5bd1bd58-a325-4622-82cc-143a2f63b645","resolution":{"observed_at":"2026-08-07T04:16:24.467872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19325","last_updated":"2025-05-18T02:27:31Z","snapshot_observed_at":"2026-08-15T15:00:19.916941Z","submitted_at":"2025-03-25T03:38:06Z","title":"Long-Context Autoregressive Video Modeling with Next-Frame Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19325","snapshot_observed_at":"2026-08-07T04:16:23.304440Z","title":"Long-context autoregressive video modeling with next-frame prediction.arXiv preprint arXiv:2503.19325, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:23.304440Z"},"links":{"cited_paper":"/paper/2503.19325","citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:b5e334d8d0fb0937d912a80f9eb28343baf6cdc44a8d317ff68077a8568ce615","observation_id":"fc53fda0-51a3-454c-9a6b-05177da47089","resolution":{"observed_at":"2026-08-07T04:16:23.304440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:24.300848Z","title":"Bdd100k: A diverse driving dataset for heterogeneous multitask learning","venue":null,"work_id":"5d26c274-9fef-4746-837f-918a4c1eb169","year":2020},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:23.361913Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:a86050f47f5e0d42aaf935741ae899cca20b27c211c1990b06bab1f428c17a8c","observation_id":"f97b5a5d-9164-42e0-8304-9c735f48993d","resolution":{"observed_at":"2026-08-07T04:16:24.346655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:16:24.187299Z","title":"Kesten, M","venue":null,"work_id":"2a3b26ec-2532-46a4-a0c1-ba8335f40230","year":2020},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:23.430589Z"},"links":{"citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:1b525b4de0d80d091b797ce4b4d1a0e44cc47a761609e49a4172fa32986a5299","observation_id":"87ce126d-d30e-443f-9ce2-531adc19047d","resolution":{"observed_at":"2026-08-07T04:16:24.231306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T04:16:23.493262Z","title":"look around","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:16:23.493262Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.11302"},"observation_digest":"sha256:d615544e806bd8f78460e5bb43b8e5fa32d179f6a93ce95546bd2d28e0a71455","observation_id":"fe395e9e-1f1a-4a28-865e-bb0f15fc46d6","resolution":{"observed_at":"2026-08-07T04:16:23.493262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.11302","last_updated":"2025-06-19T15:10:29Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T23:45:39.072356Z","submitted_at":"2025-06-12T21:08:11Z","title":"TARDIS STRIDE: A Spatio-Temporal Road Image Dataset and World Model for Autonomy"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2506.11302."}