{"as_of":"2026-08-11T18:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:08014a96a60801a715120edccc1fb5e3079c4b0a8a296a8837de6bbaf75f088b","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:28:52.368199Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07693/citation-record","integrity":"/paper/2608.07693/integrity","json":"/paper/2608.07693/citation-record.json","paper":"/paper/2608.07693"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.02800","last_updated":"2026-06-23T17:33:32Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T19:12:30Z","title":"Cosmos 3: Omnimodal World Models for Physical AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02800","snapshot_observed_at":"2026-08-11T00:28:52.119049Z","title":"arXiv preprint arXiv:2606.02800 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.119049Z"},"links":{"cited_paper":"/paper/2606.02800","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:bc9196ca1bffe1bdafa376151cba59257a9be28cbf0fc8d299aca4e3b6487ccf","observation_id":"5114e2d1-e760-4e48-acb8-8b32b51d7523","resolution":{"observed_at":"2026-08-11T00:28:52.119049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-11T00:28:52.123300Z","title":"arXiv preprint arXiv:2501.03575 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.123300Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:61a4a756ebeb98cd8a00a038948d64aef22632cc57bed4bad02131de8099416a","observation_id":"bab81321-6972-42f4-8af1-b713f9d49b15","resolution":{"observed_at":"2026-08-11T00:28:52.123300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00062","last_updated":"2026-02-24T21:52:50Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-10-28T22:44:13Z","title":"World Simulation with Video Foundation Models for Physical AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.00062","snapshot_observed_at":"2026-08-11T00:28:52.127337Z","title":"arXiv preprint arXiv:2511.00062 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.127337Z"},"links":{"cited_paper":"/paper/2511.00062","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:682af8478abbb517cf05270368045de66a89638f8c67fee5dc097c932861f7f8","observation_id":"53fca354-ddde-4ed5-bc1f-381bcbda9ad2","resolution":{"observed_at":"2026-08-11T00:28:52.127337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-11T00:28:52.132240Z","title":"arXiv preprint arXiv:2506.09985 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.132240Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:b720964936f5ba9dcad51521dba85c4ae3e6987f0f041337e12672e44e2f03e9","observation_id":"670c768c-4898-4a74-b46a-9b975552bbfd","resolution":{"observed_at":"2026-08-11T00:28:52.132240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08471","last_updated":"2024-02-15T18:59:11Z","snapshot_observed_at":"2026-08-07T02:30:11.447693Z","submitted_at":"2024-02-15T18:59:11Z","title":"Revisiting Feature Prediction for Learning Visual Representations from Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08471","snapshot_observed_at":"2026-08-11T00:28:52.137205Z","title":"arXiv preprint arXiv:2404.08471 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.137205Z"},"links":{"cited_paper":"/paper/2404.08471","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:179e33246e81cb61803cf02e16ba04a48d188797658cf9bc57b8cbb694b8f30e","observation_id":"7d659554-f610-43d8-9360-8cedd6204624","resolution":{"observed_at":"2026-08-11T00:28:52.137205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.142017Z","title":"In: Forty-first International Conference on Machine Learning (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.142017Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:a2e8ef4fa04c279127abf9ca1e179f67f1f4851f8648cdbf75ae9d6cfa23ba9f","observation_id":"ea775f49-9686-4f48-a658-e3450dd6c1f2","resolution":{"observed_at":"2026-08-11T00:28:52.142017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.122696Z","title":"In: 2025 IEEE/CVF International Conference on Computer Vision (ICCV)","venue":null,"work_id":"dd64b5d1-e934-4361-9a0e-a6c6c36dcffc","year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.146829Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:ca42f80d029b08df3d725f5b55726014592e161d7b38b2417d53d3065eba5721","observation_id":"0c94acfd-76e4-4e3a-881f-f253212dcf20","resolution":{"observed_at":"2026-08-11T00:28:53.126774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.110692Z","title":null,"venue":null,"work_id":"a30a912c-7aff-48e3-ab02-bada0bfb1b99","year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.151343Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:dba2d1c2f07f968fa3866d6c80bac29dc6d2bece3632e6ce83500c4342d8728f","observation_id":"b24e5919-05e5-4788-92ed-b433b1da512c","resolution":{"observed_at":"2026-08-11T00:28:53.114636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.099650Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) Workshops","venue":null,"work_id":"bad82d37-5868-4464-bfa9-e80057f6efb8","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.155526Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:3471b05a46d1033d5484918534a1d8a7b7404c1cad2127cd576439740d7d4f21","observation_id":"66eeb85a-51d3-4e5e-aee6-ef6be885b3aa","resolution":{"observed_at":"2026-08-11T00:28:53.103464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.088832Z","title":"In: Proceedings of the IEEE/CVF Con- ference on Computer Vision and Pattern Recognition (CVPR) Workshops (2024)","venue":null,"work_id":"6cccb735-76f3-47f2-a868-b9468d107ca7","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.159818Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:0998de437da79c7ce41448112a4e6064c0841994e8e0bffa6e950bd37bf1aec7","observation_id":"492bc989-037c-4a5f-9cb7-46cff9a6953a","resolution":{"observed_at":"2026-08-11T00:28:53.092557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.00568","last_updated":"2018-12-03T06:06:25Z","snapshot_observed_at":"2026-08-05T20:04:40.605065Z","submitted_at":"2018-12-03T06:06:25Z","title":"Visual Foresight: Model-Based Deep Reinforcement Learning for Vision-Based Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.00568","snapshot_observed_at":"2026-08-11T00:28:52.164114Z","title":"arXiv preprint arXiv:1812.00568 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.164114Z"},"links":{"cited_paper":"/paper/1812.00568","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:7807ffa968f1391f9d1960bba72db1e13236b1833914bcb2d6d7e1b2cd432470","observation_id":"026093d5-85da-49b8-a918-ccf99902662f","resolution":{"observed_at":"2026-08-11T00:28:52.164114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.168603Z","title":"In: Scott, D., Bel, N., Zong, C","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.168603Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:9f3c013cb9cc79a275b596636eec1648ae39b409b28a5c3995086dbd16a8407d","observation_id":"d9d8f766-832b-43d5-871d-abb1d9a8409d","resolution":{"observed_at":"2026-08-11T00:28:52.168603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.172367Z","title":"Advances in Neural Information Processing Systems37, 91560–91596 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.172367Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:95a035ca8a1711bd0f6eea0abbd76ece54738e7ce62511653e656cd5f4422011","observation_id":"ca702a8c-f055-4e9b-8c7e-b6342615838f","resolution":{"observed_at":"2026-08-11T00:28:52.172367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-11T00:28:52.175473Z","title":"arXiv preprint arXiv:1803.101222(3), 440 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.175473Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:0ec3659c8968a9f6609bf326f33f4d37c059f87c8b85bf4b8fa0b6930190d1b3","observation_id":"c564d5f2-ffb7-46b9-bef3-ad3b8701a8a6","resolution":{"observed_at":"2026-08-11T00:28:52.175473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-09T02:21:17.479736Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-11T00:28:52.178821Z","title":"arXiv preprint arXiv:1912.01603 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.178821Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:4bb96b70846247c02c94dbd0b4cedef331497710af14fddc7971059710c883bd","observation_id":"d4606d31-95a8-42de-a39b-876956dbb865","resolution":{"observed_at":"2026-08-11T00:28:52.178821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.182698Z","title":"In: International conference on machine learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.182698Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:1641f2bb724952383e8e311c6b2dce8313ecbe624e90f9ade7ca63883c4ab528","observation_id":"9bc85d5f-fcfd-4132-b970-b5d3fd4b2fc1","resolution":{"observed_at":"2026-08-11T00:28:52.182698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.186103Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.186103Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:60409baf7b8b0e05ba8d53d68418a283200d69ba1daf960c5085351fbbfaca2b","observation_id":"fcef585c-b50d-4ff8-9cb2-bf7c5e3d5db8","resolution":{"observed_at":"2026-08-11T00:28:52.186103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-11T00:28:52.189450Z","title":"ArXivabs/2104.08718(2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.189450Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:9e001c5b90c55adb2a73ffaa209d74c88c9391f24747ce0d6762c456cdb83fdd","observation_id":"0ebc8c3e-9285-411f-ba57-44f7e333479d","resolution":{"observed_at":"2026-08-11T00:28:52.189450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08500","last_updated":"2018-01-12T14:05:44Z","snapshot_observed_at":"2026-07-06T05:48:30.254634Z","submitted_at":"2017-06-26T17:45:23Z","title":"GANs Trained by a Two Time-Scale Update Rule Converge to a Local Nash Equilibrium","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08500","snapshot_observed_at":"2026-08-11T00:28:52.193180Z","title":"ArXivabs/1706.08500(2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.193180Z"},"links":{"cited_paper":"/paper/1706.08500","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:d98fc24a72ac6f82d31cbf6ba9e3e8e633c7cbb46b97544b2cad9413e4dd2d26","observation_id":"1bfc4238-772c-4ac9-b885-e35e69e9262b","resolution":{"observed_at":"2026-08-11T00:28:52.193180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.197338Z","title":"In: NeurIPS (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.197338Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:68ece58089d0b17114cc45930d33a5cc1db62d33fa8da56be83ec27ec68915dd","observation_id":"499d24d8-4abf-4ef9-95c3-07b0bf47171d","resolution":{"observed_at":"2026-08-11T00:28:52.197338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-11T00:28:52.201807Z","title":"URL https://arxiv","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.201807Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:f33b263311ec3abee18b141a73b01dbb0d456cde306bc0ffd37be03a77fa9402","observation_id":"07c2bde5-a90c-4463-b5fc-5d7ef8b8c303","resolution":{"observed_at":"2026-08-11T00:28:52.201807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.206297Z","title":"In: ICLR (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.206297Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:b82308786d871420c527706af5231bccfeb4d0de587af1741cf5ab8be3d2705e","observation_id":"a0e5a582-8d29-4018-a5fd-efc920c5c9de","resolution":{"observed_at":"2026-08-11T00:28:52.206297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19505","last_updated":"2024-12-30T09:08:12Z","snapshot_observed_at":"2026-08-11T05:45:15.918855Z","submitted_at":"2024-12-27T07:44:07Z","title":"DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19505","snapshot_observed_at":"2026-08-11T00:28:52.210464Z","title":"arXiv preprint arXiv:2412.19505 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.210464Z"},"links":{"cited_paper":"/paper/2412.19505","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:cba5a82659ac10f81b480ac5fcde9195217672c81a9425068d3bda77a18c023b","observation_id":"90a528d6-e066-47c5-a81c-0a10ad410c84","resolution":{"observed_at":"2026-08-11T00:28:52.210464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.045427Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) Workshops (2025)","venue":null,"work_id":"103a93e3-3629-4179-b859-fb4f054cd4be","year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.214811Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:e76f488afc09c41b33a9e91aa0cc04eb798b0e70f9522c7e2878aa210a1872fd","observation_id":"d3c2f1db-57c6-46c8-9107-af61d175e183","resolution":{"observed_at":"2026-08-11T00:28:53.049116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-73116-7_1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.398010Z","title":"In: ECCV","venue":null,"work_id":"302ca0e3-526c-46c1-b459-87a251e22012","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.218667Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:d5504e5c9fb0259e7ffb0ca1796c139f21ebce3c8f0a7c61d15c99e40b836a05","observation_id":"77d8ed14-cdfb-4eda-b88b-7f1899195597","resolution":{"observed_at":"2026-08-11T00:28:52.403705Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.031804Z","title":"In: Proceedings of the Human Language Technology Conference of the North American Chapter of the Association for Computational Linguistics: HLT- NAACL 2004","venue":null,"work_id":"e74d618d-e8c0-4eee-bd58-1f98626dabe7","year":2004},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.222656Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:09159e48c6ee79dda20c7443e8bc73c0c8a8bb07bba00eb6a926ea4c67031439","observation_id":"9ed75762-20ba-4231-8413-b5261cf1a217","resolution":{"observed_at":"2026-08-11T00:28:53.036474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.226534Z","title":"2, 2022-06-27","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.226534Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:b9436de41d3ea9f8a3ce7f10c4a62ad3b2e7ed85fc453352b342f903be985a5a","observation_id":"432cf58b-1384-4fb9-abc8-3deaf806e0a5","resolution":{"observed_at":"2026-08-11T00:28:52.226534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:53.011892Z","title":"In: International Conference on Machine Learning (ICML) (2023) CosmosAlign for Generative Traffic Video Forecasting 17","venue":null,"work_id":"d530449b-2dd7-417b-8019-2dec7cd08dd7","year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.230472Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:4fc1f9e42abaf63568a88140ce396eb9979de1d1d1a9c69e55aae3eaf037af1e","observation_id":"f63d909d-d154-4042-835a-e7456b304099","resolution":{"observed_at":"2026-08-11T00:28:53.015993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.16732","last_updated":"2026-06-25T19:54:02Z","snapshot_observed_at":"2026-08-07T10:54:05.573771Z","submitted_at":"2025-10-19T07:12:32Z","title":"A Comprehensive Survey on World Models for Embodied AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.16732","snapshot_observed_at":"2026-08-11T00:28:52.233816Z","title":"arXiv preprint arXiv:2510.16732 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.233816Z"},"links":{"cited_paper":"/paper/2510.16732","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:e252c548c2284db4934bee890b54fad0759e5c49f9910c7b856e5f022698f5b8","observation_id":"86727f29-fd68-4409-92db-66f760aecf07","resolution":{"observed_at":"2026-08-11T00:28:52.233816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.237233Z","title":"In: Advances in Neural Information Processing Systems (NeurIPS) (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.237233Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:d0a06e045feee5c6409ede7d73938b07e5d051265db1d35faece5573e3e72910","observation_id":"ef2ecfab-68a0-46b8-be71-f0181a7225a1","resolution":{"observed_at":"2026-08-11T00:28:52.237233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.240212Z","title":"In: Forty-first International Conference on Machine Learning (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.240212Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:9e234bfad306e97e9d8481eea3ce2472aad84578071bd6c5754dea60877db2ad","observation_id":"ba3ba652-33d9-4782-b43a-9e7dd086627e","resolution":{"observed_at":"2026-08-11T00:28:52.240212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.243212Z","title":"In: Proceedings of the IEEE conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.243212Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:dd9c4d164c1172e14e84be1231a0c05ac6ea910ebbe02de2377d5c9ce5a8a31d","observation_id":"2e9fae23-deec-448c-ac5d-d1833d639674","resolution":{"observed_at":"2026-08-11T00:28:52.243212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00438","last_updated":"2023-12-01T09:10:33Z","snapshot_observed_at":"2026-08-10T14:43:54.873284Z","submitted_at":"2023-12-01T09:10:33Z","title":"Dolphins: Multimodal Language Model for Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00438","snapshot_observed_at":"2026-08-11T00:28:52.246338Z","title":"arXiv preprint arXiv:2312.00438 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.246338Z"},"links":{"cited_paper":"/paper/2312.00438","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:50a15e96c487b301e9fb57449761820abd1bc7832283072482dbbc403a292787","observation_id":"1baa118f-46e3-49ca-8045-ca67ee201dbf","resolution":{"observed_at":"2026-08-11T00:28:52.246338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.980050Z","title":"In: 2025 IEEE International Conference on Robotics and Automation (ICRA)","venue":null,"work_id":"ac47be84-351b-46c1-956a-baecf82f3c7d","year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.249787Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:70e16a04f49324f6a0e03870cee34f0bf7438f1c39bfd167679024765c63d00b","observation_id":"faf063b4-f74a-4a07-b62f-554c22585ed9","resolution":{"observed_at":"2026-08-11T00:28:52.983841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.253674Z","title":"Advances in Neural Information Processing Systems37, 121038–121072 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.253674Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:b0a41e0ac69c59e0eb4d9df965ade87fb55ccc55015f7b80d37f6cb9a3bd0738","observation_id":"adb16312-9939-4536-8579-8928b7d1ede8","resolution":{"observed_at":"2026-08-11T00:28:52.253674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.961607Z","title":"Advances in Neural Information Processing Systems 37, 42292–42310 (2024)","venue":null,"work_id":"b0377ee1-29dc-4b07-a9c2-e449b7426562","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.257545Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:67b88b715106890f011ad4f1f747dabf1c197db27c5a4010e59239f04f12a020","observation_id":"4ae00270-d073-416f-a5d4-00ec14659ea4","resolution":{"observed_at":"2026-08-11T00:28:52.965789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14718","last_updated":"2025-07-14T09:44:08Z","snapshot_observed_at":"2026-08-11T04:00:09.740878Z","submitted_at":"2024-01-26T08:59:38Z","title":"A Survey on Future Frame Synthesis: Bridging Deterministic and Generative Approaches","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14718","snapshot_observed_at":"2026-08-11T00:28:52.261527Z","title":"arXiv preprint arXiv:2401.14718 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.261527Z"},"links":{"cited_paper":"/paper/2401.14718","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:9a22076db137d1e6c7282b800be491c85ca846e07c00fcf43181ba3abe3e868e","observation_id":"8a8fafbf-df5c-4388-976b-7e882d93b6f6","resolution":{"observed_at":"2026-08-11T00:28:52.261527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.951454Z","title":"Advances in Neural Information Processing Systems38, 4741–4770 (2026)","venue":null,"work_id":"5519e166-bcea-4738-b3bf-8a8237e98843","year":2026},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.265769Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:120993317b6c5e40f74701b47a2f910b272dc29fd06dd225d338775ab4d20bae","observation_id":"11a501dc-de4e-4fbd-8a88-8c3b26f03b85","resolution":{"observed_at":"2026-08-11T00:28:52.954991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.941021Z","title":"In: Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"b2873375-3f3e-49cb-9c1a-740174618cb0","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.269755Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:40341b96aa9495ec60c967544832f05831f204541748eba52ffa9e2fffc7b8bb","observation_id":"67370f25-8305-40c0-af3f-bf174d555985","resolution":{"observed_at":"2026-08-11T00:28:52.944371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05086","last_updated":"2025-07-24T08:52:22Z","snapshot_observed_at":"2026-08-07T15:48:52.154611Z","submitted_at":"2025-05-08T09:34:15Z","title":"Beyond Low-rank Decomposition: A Shortcut Approach for Efficient On-Device Learning","version":2},"cited_work":{"arxiv_id":"2505.05086","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.05086","snapshot_observed_at":"2026-08-11T00:28:52.602327Z","title":"Beyond Low-rank Decomposition: A Shortcut Approach for Efficient On-Device Learning","venue":"cs.LG","work_id":"b57a8354-86bc-4f4e-8529-e10fb38f089a","year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.273713Z"},"links":{"cited_paper":"/paper/2505.05086","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:dcd536d07ec5a765487b6aca9ef1fb7da285c05d3c9474c589a8ad15ee9d98a7","observation_id":"13dbacaa-9c10-4f27-99b4-2e07dc892501","resolution":{"observed_at":"2026-08-11T00:28:52.608156Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.929846Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"6c8d3bd0-a4e2-414e-b6fe-4b716d532860","year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.277900Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:698909dce4c674923b2dff35b46f8b1930ac755bfeab98cb369a3cdaee6b17c7","observation_id":"dec7f2fb-fb33-4ea6-86af-4b6f4cdb0a13","resolution":{"observed_at":"2026-08-11T00:28:52.933691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.917163Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence44(6), 2806–2826 (2020)","venue":null,"work_id":"c9fd5c7a-d961-475b-ae0e-3b9c36c277e7","year":2020},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.281801Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:fb3e3947125fff1f68ab9b7d6a9e64e32ad93f1c354b444ae71b532a3ce4a93a","observation_id":"486b526b-dea3-4da5-b081-0b7ed889b63d","resolution":{"observed_at":"2026-08-11T00:28:52.921931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.285006Z","title":"In: ICML","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.285006Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:de70163feccd04f55c9199355b33a0900bebf515f65b2b3bfc7520c35b0836f8","observation_id":"11f2eca1-6fcc-44a2-9a4f-c935533ac97f","resolution":{"observed_at":"2026-08-11T00:28:52.285006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20523","last_updated":"2025-03-26T13:11:35Z","snapshot_observed_at":"2026-08-11T03:56:33.769013Z","submitted_at":"2025-03-26T13:11:35Z","title":"GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20523","snapshot_observed_at":"2026-08-11T00:28:52.288327Z","title":"arXiv preprint arXiv:2503.20523 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.288327Z"},"links":{"cited_paper":"/paper/2503.20523","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:3a886b46eaccae92ecbb8e68205399264ac2fe69428599ef61c1cc63716845fa","observation_id":"f4dcd3a2-18e6-47df-9e3e-2c3c89b84a01","resolution":{"observed_at":"2026-08-11T00:28:52.288327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.898618Z","title":"In: Proceedings of the 18 Q","venue":null,"work_id":"b5260a88-4f12-481d-93af-b36e4ccc0007","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.292099Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:168cd47e9ee6832b65fa87606cab4d27323fa28800b1f6cfd49e06aaa6037b02","observation_id":"048a291f-2147-487f-b080-3f21c0acd718","resolution":{"observed_at":"2026-08-11T00:28:52.902673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.295175Z","title":"In: Conference on Robot Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.295175Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:45494d31484a522d53500be9c9bbb4ae74ba1b8d6fdb1b46e948a3f5dfabc0c5","observation_id":"9af0ebca-82ea-4c86-ad6d-fb25dde39fd1","resolution":{"observed_at":"2026-08-11T00:28:52.295175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.879501Z","title":"In: European Conference on Computer Vision (ECCV) (2024)","venue":null,"work_id":"69aa828d-6197-44a4-92bf-460e93816ae7","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.298467Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:9b93ebac860b04fc45297e2aa392fe1f5358629804ccf3c52964d2c71af595eb","observation_id":"04831eaa-dfbd-435c-932c-92d571c9fbf1","resolution":{"observed_at":"2026-08-11T00:28:52.883363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.868211Z","title":"In: ECCV Workshops","venue":null,"work_id":"fba30f82-c971-40a5-add2-2e2359f192b3","year":2026},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.302481Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:1e727836dece9ec8dae0b4e2774e3c17f5423acb65ee633cb95eb2238175dee4","observation_id":"99f97a72-2561-4198-b95b-8f045f55731c","resolution":{"observed_at":"2026-08-11T00:28:52.871849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.12039","last_updated":"2020-08-25T15:49:48Z","snapshot_observed_at":"2026-08-11T03:37:43.630214Z","submitted_at":"2020-03-26T17:12:42Z","title":"RAFT: Recurrent All-Pairs Field Transforms for Optical Flow","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.12039","snapshot_observed_at":"2026-08-11T00:28:52.306518Z","title":"ArXivabs/2003.12039(2020),https://api.semanticscholar.org/CorpusID: 214667893","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.306518Z"},"links":{"cited_paper":"/paper/2003.12039","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:67a4d485f905217e5ef7502c546c386920f550bb20f3950d0c0d1f42988dd9f9","observation_id":"a3bf6748-a639-40f5-97e5-c3c9276331ca","resolution":{"observed_at":"2026-08-11T00:28:52.306518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.857739Z","title":"In: International Conference on Learning Representations Workshop (2019)","venue":null,"work_id":"5e5e5d52-56ba-4d31-9d19-4d06390350f0","year":2019},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.311310Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:ec229588c5c3523a91135d14e4ccf605b74378e60660430022a187bfefcf2de5","observation_id":"96bdde1c-ba32-4f18-ad46-fd407317f277","resolution":{"observed_at":"2026-08-11T00:28:52.861078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-11T00:28:52.315323Z","title":"ArXivabs/2503.20314(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.315323Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:14b1f74ad2be4065b2a43570c79b451b234eb3e698e35b428032a612151be85c","observation_id":"8b585e62-8e24-4fe9-bdce-407cec94b6bf","resolution":{"observed_at":"2026-08-11T00:28:52.315323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04412","last_updated":"2023-05-08T01:39:35Z","snapshot_observed_at":"2026-08-11T17:30:11.992770Z","submitted_at":"2023-05-08T01:39:35Z","title":"Efficient Reinforcement Learning for Autonomous Driving with Parameterized Skills and Priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04412","snapshot_observed_at":"2026-08-11T00:28:52.319765Z","title":"arXiv preprint arXiv:2305.04412 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.319765Z"},"links":{"cited_paper":"/paper/2305.04412","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:0d214582ee78afb9ff571f81e8fe2ddd5ab4085e36c9bcff9573a0deb59e9898","observation_id":"9d0fbb59-76ed-436e-9c7b-3324bd98fe61","resolution":{"observed_at":"2026-08-11T00:28:52.319765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.324407Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.324407Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:7e8e400c5b49a68618a626f30cbb1dcd0d91a6d4c98be6a0fd5b019b08345750","observation_id":"93e5d96e-c2e0-4ab6-944c-ec7b8dc7c349","resolution":{"observed_at":"2026-08-11T00:28:52.324407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-11T00:28:52.328031Z","title":"ArXivabs/2203.11171 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.328031Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:654b03dc27b9f75b2bea6da97cbf92b3ff57182cafd9a91db974a4df417068ec","observation_id":"fe90eaeb-0e36-498a-887a-ebda274b6c46","resolution":{"observed_at":"2026-08-11T00:28:52.328031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.840319Z","title":"In: Proceed- ings of the 2022 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"e52b3f43-6fd9-48eb-8425-d95c9c7ee203","year":2022},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.332064Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:4897eab543eb6009c809ad54e295d41ab9a58bf7dca6969c47a6a12ef743976f","observation_id":"5bff37ca-b817-4bae-a451-26882352d362","resolution":{"observed_at":"2026-08-11T00:28:52.844067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.334845Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.334845Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:0782e69fb886048feaeef38be4501e563ad63b04cee8f1dadb6fbe9f6b24b1ad","observation_id":"a5aa59d6-e571-4d10-8e34-64fe9b3f9585","resolution":{"observed_at":"2026-08-11T00:28:52.334845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05332","last_updated":"2023-11-28T09:47:57Z","snapshot_observed_at":"2026-07-06T16:45:11.604296Z","submitted_at":"2023-11-09T12:58:37Z","title":"On the Road with GPT-4V(ision): Early Explorations of Visual-Language Model on Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05332","snapshot_observed_at":"2026-08-11T00:28:52.337702Z","title":"arXiv preprint arXiv:2311.05332 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.337702Z"},"links":{"cited_paper":"/paper/2311.05332","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:99bb6af6abb3a556f0b4e4c918f93f662c6e0159e8283f710211f08bfcbcba6d","observation_id":"a478f21f-5dca-4d8c-ae85-f7da1984b8a2","resolution":{"observed_at":"2026-08-11T00:28:52.337702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05538","last_updated":"2019-04-11T05:20:57Z","snapshot_observed_at":"2026-07-06T07:45:23.367700Z","submitted_at":"2019-04-11T05:20:57Z","title":"Improvisation through Physical Understanding: Using Novel Objects as Tools with Visual Foresight","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05538","snapshot_observed_at":"2026-08-11T00:28:52.340700Z","title":"arXiv preprint arXiv:1904.05538 (2019) CosmosAlign for Generative Traffic Video Forecasting 19","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.340700Z"},"links":{"cited_paper":"/paper/1904.05538","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:60eda030cf5f2af9d88a3ece8f348ce18a42925a573423668ae0efdc3a0c30b6","observation_id":"f21a5695-d1a8-440a-9ee7-e6e0bf231239","resolution":{"observed_at":"2026-08-11T00:28:52.340700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.821893Z","title":"IEEE Robotics and Automation Letters (2024)","venue":null,"work_id":"6ad74084-65ac-42ed-82ff-a7c594f87dd4","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.343814Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:0f1c4c6fef237475af6ea3213ddb8cd5caf7337f147f9bb895bb2b25ab37db22","observation_id":"274845e0-296f-44ad-b264-6d3bcb410945","resolution":{"observed_at":"2026-08-11T00:28:52.826024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.346757Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (June 2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.346757Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:0368f4ba62fecade3a8f3d99fe2d14a71b85edc889c615b6a780e0988ef3c926","observation_id":"8b7bae63-a6b0-43ed-a3de-53aaf89f7947","resolution":{"observed_at":"2026-08-11T00:28:52.346757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.349991Z","title":"In: CVPR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.349991Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:5e47907fe0ab901fa011ec48a866f9274a4a5a21c101e110455acfc8a6208648","observation_id":"81b5d2f5-b83c-4b33-9d95-ac2a4a3e4a15","resolution":{"observed_at":"2026-08-11T00:28:52.349991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.353642Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.353642Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:4e3c1e4c8cd89b370e18be9c8027a2f8c12b5b5877b327f0b57a7cf08007282d","observation_id":"fee7f6a9-c78a-4306-9866-cd4ec206b9a6","resolution":{"observed_at":"2026-08-11T00:28:52.353642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03507","last_updated":"2024-06-02T21:24:12Z","snapshot_observed_at":"2026-07-06T17:40:15.746482Z","submitted_at":"2024-03-06T07:29:57Z","title":"GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03507","snapshot_observed_at":"2026-08-11T00:28:52.357358Z","title":"arXiv preprint arXiv:2403.03507 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.357358Z"},"links":{"cited_paper":"/paper/2403.03507","citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:1224b17fa76c4a5578047c58a0b9a78e5bb930c1d083d133bbf7d60de7eea6e0","observation_id":"2c7e0ba6-6cc0-43e6-9ce4-ff760042fb4c","resolution":{"observed_at":"2026-08-11T00:28:52.357358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.788938Z","title":"In: Thirty-seventh Conference on Neural Information Processing Systems (2023),https://openreview.net/forum? id=hrkmlPhp1u","venue":null,"work_id":"29905b63-8538-4901-8fd6-29af79b5d7db","year":2023},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.361186Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:57738198644456cfd2f7507c7e74c736791466e1d87639f6f5c9a114b39c0ab7","observation_id":"7a29efc2-28f9-4242-99b3-cb9e9c52650e","resolution":{"observed_at":"2026-08-11T00:28:52.793138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.776916Z","title":"Transactions of the Association for Com- putational Linguistics12, 525–542 (2024)","venue":null,"work_id":"9e1c8f13-d3d0-4a6a-8a82-9440db91f243","year":2024},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.364690Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:6146acc9f982c0cdf2a531203d0c2904ea263929d5f9a749c5b26ae2e2052393","observation_id":"22940223-ebd4-4e5d-8134-1b14e5ad0f27","resolution":{"observed_at":"2026-08-11T00:28:52.781146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:28:52.368199Z","title":"arXiv preprint arXiv:2601.01528 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T00:28:52.368199Z"},"links":{"citing_paper":"/paper/2608.07693"},"observation_digest":"sha256:5a1a059e14a72a975b1a8fec446c116174128117907d1164f6f337952fd9863d","observation_id":"78ac1796-b5cc-442b-92bd-182e28ec1f49","resolution":{"observed_at":"2026-08-11T00:28:52.368199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07693","last_updated":"2026-08-07T18:34:29Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T18:14:09.292235Z","submitted_at":"2026-08-07T18:34:29Z","title":"CosmosAlign: Adapting a World Foundation Model for Generative Traffic Video Forecasting"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":44,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2608.07693."}