{"as_of":"2026-08-08T01:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:42eddf599099f81a5083a1d3758b0cbfa5d1a7a598cc99bd7f42adcc46fab572","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T08:19:04.131379Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.05133/citation-record","integrity":"/paper/2607.05133/integrity","json":"/paper/2607.05133/citation-record.json","paper":"/paper/2607.05133"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Planning-oriented autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:93636844115dc9a108ee43a27a70bb889f39943fb61114c01678b7e98d71a0a0","observation_id":"7b361df2-a5c4-4f6f-b9a7-effb4aea65e2","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Transfuser: Imitation with transformer-based sensor fusion for autonomous driving.IEEE transactions on pattern analysis and machine intelligence, 45(11):12878–12895, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:e520f1c40b0ddba6cf3360c418f928b094372887a59cf49bff905e47ee3a2469","observation_id":"60566461-5abb-49d5-9240-1e8b21008ef9","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Diffusiondrive: Truncated diffusion model for end-to-end autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:6679e9af9aebdd1142afa98ca8b861dc376aba6cc9cef157cdcfef6fa4d85b41","observation_id":"8ba7632e-7268-484d-9f79-2b91df255131","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15922","last_updated":"2026-02-17T15:04:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T15:04:02Z","title":"World Action Models are Zero-shot Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15922","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"World action models are zero-shot policies.arXiv preprint arXiv:2602.15922, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2602.15922","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:973a065dde774b603cdf1e6605c89109a5b6a24994da513612e13d9f691fb117","observation_id":"44b7402b-5903-4d5f-9db8-babb7b5d16b4","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"A path towards autonomous machine intelligence version 0.9","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:9faaf0239e6087487634cf75fe54fe98e5da2d25d5ee4a9fe2385d4817f91bf7","observation_id":"313fc146-3381-4a64-8740-c4f7cb2786bb","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"World models.arXiv preprint arXiv:1803.10122, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:d0b870389e9c5e1ebd78b4e89c3666f43cce19e294ad4d60558d1be76fe5d67c","observation_id":"f45d7ce1-d311-42b1-9a30-a72dcf2c9b12","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Genad: Generative end-to-end autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:745fdfb814a873ede37e668266e68154b7b666af06629e8c1aeb85bb070abb90","observation_id":"72a9f0f3-048c-47be-bb44-e253796fa4ec","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Dreamgen: Unlocking generalization in robot learning through video world models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:9aa1384ebe6f2438aac3b88287beaaeceebd91a941960d0f2d75f97c73465e1e","observation_id":"768aa29c-09db-4038-a4cc-9611087c9f1c","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21998","last_updated":"2026-03-22T15:37:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T17:07:43Z","title":"Causal World Modeling for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21998","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Causal world modeling for robot control.arXiv preprint arXiv:2601.21998, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2601.21998","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:90d1f687e8d54a857a39586bc9c848ed15a632142d944f5c35c8873b926bcb92","observation_id":"612d2847-c5ee-4e1d-adaf-cafd8763b5b2","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00200","last_updated":"2025-04-24T20:02:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-28T21:38:17Z","title":"Unified Video Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00200","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Unified video action model.arXiv preprint arXiv:2503.00200, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2503.00200","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:67cfe5d76691e9b27ac1bdfa5f5fe8b237b6495e9ecc78c2533a5dfba0bace12","observation_id":"bdb8a4ae-cf39-47d6-8048-08d2a24cda1a","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02792","last_updated":"2025-05-23T00:47:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-03T17:38:59Z","title":"Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02792","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Unified world models: Coupling video and action diffusion for pretraining on large robotic datasets.arXiv preprint arXiv:2504.02792, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2504.02792","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:d68f08c2c4d466201b8133eb810a4fa4db6de2aabd7d02d211ae6536377fdf6d","observation_id":"05574959-853a-4d62-a4a2-394dc4ac1f9c","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.16666","last_updated":"2026-03-23T05:41:14Z","snapshot_observed_at":"2026-07-06T22:49:23.750692Z","submitted_at":"2026-03-17T15:33:43Z","title":"Fast-WAM: Do World Action Models Need Test-time Future Imagination?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.16666","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Fast-wam: Do world action models need test-time future imagination?arXiv preprint arXiv:2603.16666, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2603.16666","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:3894edbcd3818afc2e1e9bc45b44288cafd3c7b9d6b9cdadc742df4ab5c39dbd","observation_id":"6dbd57fd-f0c7-482b-941b-a23371b42581","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Imagidrive: A unified imagination-and-planning framework for autonomous driving.arXiv preprint arXiv:2508.11428, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:4278ac9d7e4b30ebe012e1598cb709b090c6e869bfb3e0e2ce6a8ed2fad708a7","observation_id":"9f1efbe1-9ffb-4e8a-898d-9ae2024cceae","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04198","last_updated":"2026-07-01T07:33:13Z","snapshot_observed_at":"2026-07-13T10:56:53.552324Z","submitted_at":"2026-04-05T17:43:16Z","title":"DriveVA: Video Action Models are Zero-Shot Drivers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.04198","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Driveva: Video action models are zero-shot drivers","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2604.04198","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:8c1c35605fc757a0459a34fa2b2afbc85fddb0b29d134f1e51c1144de1585e73","observation_id":"07079a8a-bacb-4af4-9869-872674882e70","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Gigaworld-policy: An efficient action-centered world–action model.arXiv preprint arXiv:2603.17240, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:6736bc299e2394d8aade04a73d0cb07cb28d502dd42f0e96a4a58b885718cb60","observation_id":"eb1cde90-1e30-4f08-8cc9-c4a655ce2d6d","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18650","last_updated":"2025-05-24T11:35:09Z","snapshot_observed_at":"2026-08-07T14:25:57.955968Z","submitted_at":"2025-05-24T11:35:09Z","title":"ProphetDWM: A Driving World Model for Rolling Out Future Actions and Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18650","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Prophetdwm: A driving world model for rolling out future actions and videos.arXiv preprint arXiv:2505.18650, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2505.18650","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:d7c949acab7631ce8bdfd2e07a3007aaf95748a1271bf601656ee41cf97035c5","observation_id":"cd9f61eb-a9c5-4a07-a724-9993149039d9","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.15692","last_updated":"2025-12-19T18:30:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-17T18:47:31Z","title":"mimic-video: Video-Action Models for Generalizable Robot Control Beyond VLAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.15692","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"mimic- video: Video-action models for generalizable robot control beyond vlas.arXiv preprint arXiv:2512.15692, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2512.15692","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:cd2f17c65dcfd6017c3307c9a14ac5e5a0b99e40db0d822232785dc9f4752ce4","observation_id":"05274d57-664e-43af-a525-1fbf0b152902","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.00795","last_updated":"2025-08-01T17:23:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-01T17:23:49Z","title":"Video Generators are Robot Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.00795","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Video generators are robot policies.arXiv preprint arXiv:2508.00795, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2508.00795","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:f27333ad6e385a00fae5e01267e7e16ac74c685a6fac956ca571f1b1b4d96bd1","observation_id":"20330b21-ba23-4a95-b84e-11642a2fc275","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.16163","last_updated":"2026-01-22T18:09:30Z","snapshot_observed_at":"2026-08-06T02:05:52.408905Z","submitted_at":"2026-01-22T18:09:30Z","title":"Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.16163","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Cosmos policy: Fine-tuning video models for visuomotor control and planning.arXiv preprint arXiv:2601.16163, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2601.16163","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:d2d5c452fb05efdb44821adffb8a48ff0471e86585b95e04010ac2b013172dde","observation_id":"c90ea10d-1188-4425-bcd0-328815bbe223","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.15840","last_updated":"2026-05-08T06:37:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-17T18:35:54Z","title":"Large Video Planner Enables Generalizable Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.15840","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Large video planner enables generalizable robot control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2512.15840","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:f0a72afea0be282f0b5f79420c4ac11c69cc8c9c8708a2f0560ab3db69f88ce5","observation_id":"7bd410ac-8e3c-45c8-ae4a-c75c1791f37e","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:a2eb2aa0eec3517480895a1ef3413f3ade1559972a753be3e6d628cfd1ed61dc","observation_id":"28578f82-77e5-49d8-9b62-a7266f1eee40","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.27607","last_updated":"2026-05-28T05:41:27Z","snapshot_observed_at":"2026-08-04T07:00:43.894238Z","submitted_at":"2025-10-31T16:32:12Z","title":"Dual-Stream Diffusion for World-Model Augmented Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.27607","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Dual-stream diffusion for world-model augmented vision-language-action model.arXiv preprint arXiv:2510.27607, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2510.27607","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:87eaaa56536885490507855e17ee2dc186d4289cd29e2838c260e9e69ba86f9a","observation_id":"3d2c49e2-5f48-40c0-993c-b9314e9ac0ae","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Drivegan: Towards a controllable high-quality neural simulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:3549850acb56edf492a9aa769769f44cfa36c5fbea245a5c9bed13952f23c229","observation_id":"fab1e1ff-8f62-495c-b8cf-8d79cfbfd3ec","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02601","last_updated":"2024-05-03T04:50:27Z","snapshot_observed_at":"2026-08-06T19:21:54.069156Z","submitted_at":"2023-10-04T06:14:06Z","title":"MagicDrive: Street View Generation with Diverse 3D Geometry Control","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02601","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Magicdrive: Street view generation with diverse 3d geometry control.arXiv preprint arXiv:2310.02601, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2310.02601","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:401507dcc0b2b456e0ecdbf685dd40fed248eda784ef46f7f08d731383021414","observation_id":"0b5fe724-da19-45d0-ad01-f21291e557b6","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Drivedreamer: Towards real-world-drive world models for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:61271fc6a7deb4e16445d180fe2bc6579b7c143abe281163a0977425a9863e66","observation_id":"8b6cd6eb-4959-4952-a32a-689b31a7ffa6","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Drivedreamer-2: Llm-enhanced world models for diverse driving video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:38272ec10087196111bd8f9c1af789f019d50358ef3854e0cc80302f24d79077","observation_id":"35ba3ee8-1afc-458a-a436-bcc13f6830d3","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Panacea: Panoramic and controllable video generation for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:8c68b4f8599185cca4be16492fca4ba92ca0e7bec442d12fe927537d1080ed62","observation_id":"0c086a69-0f0a-44a3-8802-645e587dd52f","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Vista: A generalizable driving world model with high fidelity and versatile controllability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:12de58b9613c107fbe6c68fda8109721b57d98b936fb8ab1af1bad95c742bd3f","observation_id":"d01ae7fc-da41-4394-aa00-f0df80a905f3","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Gaia-1: A generative world model for autonomous driving.arXiv preprint arXiv:2309.17080, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:056da9cc8afa597d7f9320d9a0cbb51a941e513d09ff290412ef8911f527b13d","observation_id":"b90848e2-4eec-4d87-8770-04882689d2f9","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20523","last_updated":"2025-03-26T13:11:35Z","snapshot_observed_at":"2026-07-06T20:59:00.415760Z","submitted_at":"2025-03-26T13:11:35Z","title":"GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20523","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Gaia-2: A controllable multi-view generative world model for autonomous driving.arXiv preprint arXiv:2503.20523, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2503.20523","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:ce02a95179be1618ff2f0585f7d7e6bf9f3aafb1abaf393bb923c529f07f4b6b","observation_id":"230b496f-f725-4893-bf88-4db994804733","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Magicdrive-v2: High- resolution long video generation for autonomous driving with adaptive control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:e006c00f8e991aa7a2cd2b9018f4e77c2df3db9419be3d2ec211a64dd9fdc63e","observation_id":"36c25b09-0608-4832-ad1e-5044730fdfbb","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15875","last_updated":"2025-03-20T05:58:32Z","snapshot_observed_at":"2026-08-07T16:50:03.504799Z","submitted_at":"2025-03-20T05:58:32Z","title":"MiLA: Multi-view Intensive-fidelity Long-term Video Generation World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15875","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Mila: Multi-view intensive-fidelity long-term video generation world model for autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2503.15875","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:5a208220979bed3e991fb0607322dd7a1cedf7bfe207bc2098f288b17dc4d054","observation_id":"62af673d-4d06-4883-a2cc-f6169e189350","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.22231","last_updated":"2025-04-05T15:43:06Z","snapshot_observed_at":"2026-08-07T16:30:49.269378Z","submitted_at":"2025-03-28T08:27:05Z","title":"CoGen: 3D Consistent Video Generation via Adaptive Conditioning for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.22231","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Cogen: 3d consistent video generation via adaptive conditioning for autonomous driving.arXiv preprint arXiv:2503.22231, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2503.22231","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:39f3f23116bd9cee2956ee039353095b098b0629ae1ad63f68b3634e9c1a644f","observation_id":"3b70a9ca-5aea-4e99-be2b-1b03a632fb70","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07497","last_updated":"2025-06-20T14:20:56Z","snapshot_observed_at":"2026-08-07T23:12:59.837477Z","submitted_at":"2025-06-09T07:20:49Z","title":"Genesis: Multimodal Driving Scene Generation with Spatio-Temporal and Cross-Modal Consistency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07497","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Genesis: Multimodal driving scene generation with spatio-temporal and cross-modal consistency.arXiv preprint arXiv:2506.07497, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2506.07497","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:1d5807bf9ccb0449fd42cc5aaeb5b60ca8bde49c5426a10e484174a87b1ef2e1","observation_id":"dceccfac-7cfb-4f7f-9062-8aa62f9a58a0","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18313","last_updated":"2026-06-29T02:20:45Z","snapshot_observed_at":"2026-08-06T20:20:34.094359Z","submitted_at":"2025-10-21T05:49:01Z","title":"OmniNWM: Omniscient Driving Navigation World Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.18313","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Omninwm: Omniscient driving navigation world models.arXiv preprint arXiv:2510.18313, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2510.18313","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:4e9fd784160a121b97ee2c26e67ac0e36894b9ca5b4a610e2ffab146e5822ce4","observation_id":"d1628af3-107a-4f24-b6c7-cba92d7196e8","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Occworld: Learning a 3d occupancy world model for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:33dd086f034b729ff8b23aa7ff54944b37aa2b85cade5dc4b8680926394f6b21","observation_id":"a9a8d2d7-32a5-42c1-9a84-eafa8bbf029c","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Driveworld: 4d pre-trained scene understanding via world models for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:d1e13ddc931fcec8292d6e27d25ec9777ec8e6a61ff3367bc11ac141365e348e","observation_id":"7fafc4b6-9aa3-4fad-b26c-56e9d8e6f851","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-07-06T20:13:36.042546Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Drivingworld: Constructing world model for autonomous driving via video gpt.arXiv preprint arXiv:2412.19505, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:806cc476eefbfa9ac45cda116d2a3af94c538ae6c5c4339f5d9679bf66c5b4bf","observation_id":"68ca223f-0f8f-4af5-9abd-6e3415aa9a5d","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Wovogen: World volume-aware diffusion for controllable multi-camera driving scene generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:3ddfdd31bb56c1555399f03f11a687079a432e7239d50106fb57fcd7949e3649","observation_id":"8f676f42-65e2-49d7-940c-fe548dc416c3","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Uniscene: Unified occupancy-centric driving scene generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:3d9d92dcecbd99402d93524ab200e85f4683594e06a99416b8d066dcb8bb0a6d","observation_id":"b7541b17-8d2f-41b5-a04e-3f51047ccfff","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Driving into the future: Multiview visual forecasting and planning with world model for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:00f759a4023737716c9b176f40d3965fa29cc0817cc5c2ba6b3f2c459e4c730c","observation_id":"ad49560b-9c9e-4f80-9dba-6ac328350aed","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Drivinggpt: Unifying driving world modeling and planning with multi-modal autoregressive transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:f55d9c33549fd303593e719ea791a018b56bee17d31bb39cffde3516b47c0702","observation_id":"0b4ebf3c-0713-48cc-9ccc-8764314cf555","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08481","last_updated":"2025-02-28T07:43:38Z","snapshot_observed_at":"2026-07-06T18:29:49.284504Z","submitted_at":"2024-06-12T17:59:21Z","title":"Enhancing End-to-End Autonomous Driving with Latent World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08481","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Enhancing end-to-end autonomous driving with latent world model.arXiv preprint arXiv:2406.08481, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2406.08481","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:9f304090439a60c6776891b23597d551932cba08679f136f095ca879df2c984a","observation_id":"e8c6bc98-0215-4466-9984-14ea1b0c8fbc","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09627","last_updated":"2024-12-12T18:59:59Z","snapshot_observed_at":"2026-08-05T03:34:06.291232Z","submitted_at":"2024-12-12T18:59:59Z","title":"Doe-1: Closed-Loop Autonomous Driving with Large World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09627","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Doe-1: Closed-loop autonomous driving with large world model.arXiv preprint arXiv:2412.09627, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2412.09627","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:fac16fe975100c61a511d68fc0c5c0fee13945655f6598eb1004fe0372c848c1","observation_id":"970279fa-9661-4d3d-81d5-12354fd65a5f","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09981","last_updated":"2026-04-28T09:28:14Z","snapshot_observed_at":"2026-08-02T12:46:46.614409Z","submitted_at":"2025-06-11T17:55:05Z","title":"ReSim: Reliable World Simulation for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09981","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Resim: Reliable world simulation for autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2506.09981","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:113ea30a56a19081610e1ac20f8129c18822888bd4ef56d4eb7c991ec85ef495","observation_id":"d1078172-1ab7-4ef2-b787-6937f5af58c7","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01941","last_updated":"2025-04-09T12:01:43Z","snapshot_observed_at":"2026-08-07T16:13:51.725618Z","submitted_at":"2025-04-02T17:47:23Z","title":"End-to-End Driving with Online Trajectory Evaluation via BEV World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01941","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"End-to-end driving with online trajectory evaluation via bev world model.arXiv preprint arXiv:2504.01941, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2504.01941","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:91b26cd28e75af33c90904534e0313852cb65ab20dff123de38af8ae2835ce82","observation_id":"62a3f43f-016d-4447-878e-8afc2436482c","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.23421","last_updated":"2026-04-17T11:51:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-29T12:32:27Z","title":"DriveLaW:Unifying Planning and Video Generation in a Latent Driving World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.23421","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Drivelaw: Unifying planning and video generation in a latent driving world.arXiv preprint arXiv:2512.23421, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2512.23421","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:2371eb92d68a98adeb5bd87e5f56cee10229a7216ab0025c41062e558a46fa14","observation_id":"842e1405-76c4-4e7b-86cf-882f1733e636","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.24113","last_updated":"2025-06-30T17:56:35Z","snapshot_observed_at":"2026-08-06T21:21:34.254944Z","submitted_at":"2025-06-30T17:56:35Z","title":"Epona: Autoregressive Diffusion World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.24113","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Epona: Autoregressive diffusion world model for autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2506.24113","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:7ebb35ea5c26b0bbd044234342a43dc96398b7a8cbb86ce982ced912d02c61b2","observation_id":"a3e06c47-43e5-4e9d-ab72-9204a8410b44","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"From forecasting to planning: Policy world model for collaborative state-action prediction.arXiv preprint arXiv:2510.19654, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:75fd3a57fb4fdc801bbfcf69b66d021ced9bdf35d8563db9fb0a0c734d4a3ee0","observation_id":"bcb5c186-ebf4-49cb-8e6f-4d2fd249ab05","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.12796","last_updated":"2025-12-18T07:25:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-14T17:59:47Z","title":"DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.12796","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Drivevla-w0: World models amplify data scaling law in autonomous driving.arXiv preprint arXiv:2510.12796, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2510.12796","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:21e5d9e6e85a39933c20e0c2ec731859994a205a0fb0b74a18dd93ae1ce7d75f","observation_id":"5edf131b-c9cd-4d5b-a222-47cb42ec359d","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:30784ca4b833d548a0455a9d80e5764ce238268a9e61bb3cb17c7a981b2b6603","observation_id":"92e2cf21-f064-4461-9b76-d8e79d7e64a8","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Videovla: Video generators can be generalizable robot manipulators.arXiv preprint arXiv:2512.06963, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:4a4f14d8a7b4a3596ade1576e9fcde8bd48fa406ce2f7b79abf23b82bef965ca","observation_id":"d41904ea-d844-4b86-8bd4-5a44d0574378","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Navsim: Data-driven non-reactive autonomous vehicle simulation and benchmarking.Advances in Neural Information Processing Systems, 37:28706– 28719, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:44f0ed6fbcbc2ce3643772d6a89c6d19bfbb86aae713050388e148f9e97029f4","observation_id":"cf684bf8-a91f-4979-8206-aa4500b2a3ac","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Openscene: The largest up-to-date 3d occupancy prediction benchmark in autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:41a991b5fa484a0115bdeabcbf92384bb49a4c4bca2b7bbeded7e58cd532993f","observation_id":"73ad8794-bbbf-4445-a686-7ac3962e7832","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"nuscenes: A multimodal dataset for autonomous driving","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:66091c2fa8d501f62df58b3894c06cea3d3cd943a3df811146954932aaa8f762","observation_id":"0f037c17-8f0a-49e7-8d2e-afb07817889c","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Vad: Vectorized scene representation for efficient autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:a4816f215a2393ebd603e742a497a6fea4e62c32e50804f5761398ca5bc75b29","observation_id":"4a33f046-15da-47a7-95e0-d291574a6c76","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Bench2drive: Towards multi- ability benchmarking of closed-loop end-to-end autonomous driving.Advances in Neural Information Processing Systems, 37:819–844, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:d171c77e2ecd4eeff66cecad73f0e785e43d7f2f3480474351db74dffc3c05cb","observation_id":"c9c09736-9a76-4e90-84ad-b9001be9a609","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Carla: An open urban driving simulator","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:c03392c357e56319c60ddf1aa73136d269da3cb8f62bb50d93b3dc9e986c67e6","observation_id":"f3ce3c71-f2b5-4348-b57a-e88130e91e7b","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"How simulation helps autonomous driving: A survey of sim2real, digital twins, and parallel intelligence.IEEE Transactions on Intelligent Vehicles, 9(1):593–612, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:14ee1ecd2f04a7c433cf580f8e93bddb8756f9fcb72c827c9c69ffe63b0a6beb","observation_id":"e0ce91d7-6e1a-4b9d-a579-37e4e35eba6b","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"V ADv2: End-to-end autonomous driving via probabilistic planning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:77dc8952d60318400c632cfd7fdd6f7fb267084660f86e6dc1bea8922946bffb","observation_id":"da365fa5-ac7a-49f9-9d90-4905ed63ecc2","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Para-drive: Parallelized architecture for real-time autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:d1e0799370f17a7b63b3bb0e4b4baa4c6a43d75512075092553114e83f43f45d","observation_id":"bafd97d5-f5d8-4bcf-b11d-e44dff33b11a","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08052","last_updated":"2025-09-29T17:21:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-09T03:14:04Z","title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08052","snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Recogdrive: A reinforced cognitive framework for end-to-end autonomous driving.arXiv preprint arXiv:2506.08052, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"cited_paper":"/paper/2506.08052","citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:9c1148e4d931f9969b2f8b68c4d6f06e63b7e1e3198208473e244aeb2c9a1f25","observation_id":"970a7fa9-8f55-41de-a1ac-c34374473589","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Deep patch visual odometry.Advances in Neural Information Processing Systems, 36:39033–39051, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:bc3a9e539ebd16a3a4ecf1579d39d6c81b872b12be6f0a194e289a134c8199eb","observation_id":"08c2c3cc-6762-4f0e-8f67-b4423a3dc562","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"St-p3: End-to- end vision-based autonomous driving via spatial-temporal feature learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:ec8a0393e3011e40a750df0943127f8fa87831a09dbc88851b325812e228bf3d","observation_id":"33980d71-31ed-48ae-a7e4-503c0cc94b75","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T08:19:04.131379Z","title":"Scene as occupancy","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-11T08:19:04.131379Z"},"links":{"citing_paper":"/paper/2607.05133"},"observation_digest":"sha256:f0524e1a24a841c0c4a42f21b087cb2460d2f6b0aa2f89725bb67914702c811c","observation_id":"f0e3c0cb-cee3-485a-8959-0e2904bf209d","resolution":{"observed_at":"2026-07-11T08:19:04.131379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.05133","last_updated":"2026-07-06T14:18:18Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T03:35:43.340219Z","submitted_at":"2026-07-06T14:18:18Z","title":"UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":65,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2607.05133."}