{"as_of":"2026-08-11T04:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8490ca5de6ac6c318b130f0b620c48000b23d7c6dc80135813b1dc93d7b63bc6","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T08:22:48.074724Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T11:59:15.978300Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T07:56:04.725707Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30263","snapshot_observed_at":"2026-08-02T11:59:15.978300Z","title":"minwm: A full-stack open-source framework for real-time interactive video world models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10135","last_updated":"2026-07-24T07:11:46Z","snapshot_observed_at":"2026-08-02T11:59:11.962721Z","submitted_at":"2026-06-08T20:08:41Z","title":"BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T11:59:15.978300Z"},"links":{"cited_paper":"/paper/2605.30263","citing_paper":"/paper/2606.10135"},"observation_digest":"sha256:76a9cbef2731bd1c32843851f588d63b3252dd9468c8529f0c56ae2bb219ba74","observation_id":"d36e5299-2ac3-4209-a828-5c491ca8b853","resolution":{"observed_at":"2026-08-02T11:59:15.978300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"cited_work":{"arxiv_id":"2605.30263","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.30263","snapshot_observed_at":"2026-07-09T07:56:04.725707Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","venue":"cs.CV","work_id":"fdbccc79-260f-458d-b98f-5c2ab9e6e8ff","year":2026},"citing_paper":{"arxiv_id":"2607.07534","last_updated":"2026-07-08T15:33:25Z","snapshot_observed_at":"2026-08-09T17:35:23.965336Z","submitted_at":"2026-07-08T15:33:25Z","title":"Infinite Worlds with Versatile Interactions","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-09T07:51:36.802801Z"},"links":{"cited_paper":"/paper/2605.30263","citing_paper":"/paper/2607.07534"},"observation_digest":"sha256:0784b9a5e77eae136c24a1ef576db3245f3cc9c2f6062dcf9b81c34c80ce937a","observation_id":"bb714da9-de79-4196-a9c1-e346abe59d0c","resolution":{"observed_at":"2026-07-09T07:56:04.726909Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30263","snapshot_observed_at":"2026-08-02T03:08:13.354666Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Inter- active Video World Models, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14005","last_updated":"2026-07-15T16:36:33Z","snapshot_observed_at":"2026-08-06T04:32:50.811133Z","submitted_at":"2026-07-15T16:36:33Z","title":"M$^\\text{4}$World: A Multi-view Multimodal Driving World Model for Interactive Object Manipulation and Minute-long Streaming","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:13.354666Z"},"links":{"cited_paper":"/paper/2605.30263","citing_paper":"/paper/2607.14005"},"observation_digest":"sha256:77eaee452a80a2ca3838d1fd7943072af95506e21ea463f5ec8e3a35aa56f834","observation_id":"cdedc598-1dfe-4731-9add-fd8b8f4d08d7","resolution":{"observed_at":"2026-08-02T03:08:13.354666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30263","snapshot_observed_at":"2026-08-02T02:52:21.885911Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14076","last_updated":"2026-07-15T17:48:48Z","snapshot_observed_at":"2026-08-02T02:52:11.633120Z","submitted_at":"2026-07-15T17:48:48Z","title":"From Pixels to States: Rethinking Interactive World Models as Game Engines","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-02T02:52:21.885911Z"},"links":{"cited_paper":"/paper/2605.30263","citing_paper":"/paper/2607.14076"},"observation_digest":"sha256:b039e276d3f702c243c25889bce0381178ebf1750a70731f853bae727a2f59ca","observation_id":"ce70aa81-ecbf-42b4-b348-3bb5f8f7be39","resolution":{"observed_at":"2026-08-02T02:52:21.885911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.30263/citation-record","integrity":"/paper/2605.30263/integrity","json":"/paper/2605.30263/citation-record.json","paper":"/paper/2605.30263"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:22:48.074724Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:c2bb8a48e5228536a5576edb6fe356e406b847665b3fe4b4f06f498cc52019e9","observation_id":"26d85972-4d23-40fd-83b6-07798384a074","resolution":{"observed_at":"2026-06-29T08:22:48.074724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04233","last_updated":"2024-05-07T11:52:49Z","snapshot_observed_at":"2026-08-10T19:52:47.076746Z","submitted_at":"2024-05-07T11:52:49Z","title":"Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2405.04233","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.04233","snapshot_observed_at":"2026-07-04T19:50:11.362384Z","title":"Vidu: a highly consistent, dynamic and skilled text-to-video generator with diffusion models","venue":null,"work_id":"c2c10794-bc91-4c9f-9ed4-32fdb1cc4c19","year":2024},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2405.04233","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:88b8e41653ef76b2939717d6b090e0f22689497a03be1c91cc6d0f42b00a7697","observation_id":"1d7cd6f7-7a09-469a-ae35-a5751b533910","resolution":{"observed_at":"2026-06-29T08:23:14.795387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":"2408.06072","doi":"10.48550/arxiv.2408.06072","metadata_source":"pith","pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","venue":"cs.CV","work_id":"f38fc088-12aa-4bf4-9ecd-08d3e797ccb7","year":2024},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:c8135a6b31f04d9a49d476f943566efcf76a205a3c726520a68adfb7c84ac1f9","observation_id":"ebb18cf8-aaa7-4904-bab1-40aa6d012b27","resolution":{"observed_at":"2026-06-29T08:23:14.772796Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-08-09T23:28:59.299375Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":"2412.00131","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-07-08T14:44:59.776032Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","venue":"cs.CV","work_id":"51c0ab25-66f7-4d1a-a028-86b9b1b9e313","year":2024},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:ba684e1ea0cf1139c72f16e938d7fcbca1521a518b08abf7ae2cc1602d76783e","observation_id":"4eac45e4-b455-4b48-b2d3-4414c949a202","resolution":{"observed_at":"2026-06-29T08:23:14.798086Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":"2412.20404","doi":"10.48550/arxiv.2412.20404","metadata_source":"pith","pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open-Sora: Democratizing Efficient Video Production for All","venue":"cs.CV","work_id":"8b29ba7b-3d84-4281-85b7-9eaf905afd7f","year":2024},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:85fca7577aa89669c5386e397101bf5fef98919649b7d950f127c9c9aa99cb8c","observation_id":"40fa691f-8de3-4f5c-a841-b045d56783b4","resolution":{"observed_at":"2026-06-29T08:23:14.767501Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:770b1640965ce14b7c3528cadaf473678ce25122953e8a3b71f32c0e3f43d5a6","observation_id":"73d65f95-05d5-4e9a-a42a-abd3e567fc6a","resolution":{"observed_at":"2026-06-29T08:23:14.811286Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":"2412.03603","doi":"10.48550/arxiv.2412.03603","metadata_source":"pith","pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","venue":"cs.CV","work_id":"881efa7e-7e73-4c66-9cc3-2803e551061c","year":2024},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:e5444e91ec753a584a6832d6380066d92c3b4b8b3f216cdf780bd80b9fc5fd21","observation_id":"2b2cfd81-80fc-4ae2-8ae2-a931128d6c53","resolution":{"observed_at":"2026-06-29T08:23:14.755526Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.14614","last_updated":"2026-06-09T16:18:08Z","snapshot_observed_at":"2026-08-03T16:11:09.055651Z","submitted_at":"2025-12-16T17:22:46Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","version":2},"cited_work":{"arxiv_id":"2512.14614","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.14614","snapshot_observed_at":"2026-07-09T07:56:04.709254Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","venue":"cs.CV","work_id":"48231e12-6c15-4f28-8c51-092766c59f93","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2512.14614","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:edfbf07ea9be01651da68f01265788d3574445f516eff66d39ddbcf0eeeff142","observation_id":"0589debe-23c0-490a-820d-05c21152bed4","resolution":{"observed_at":"2026-06-29T08:23:14.778606Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:22:48.074724Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:689cc75cf6baa7df110fe4f8f315740e93dc84ad4670f4a3f0a02b3e69bcdb1a","observation_id":"4f369d11-1dd9-41c9-a621-d32ddd0a30cd","resolution":{"observed_at":"2026-06-29T08:22:48.074724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.23429","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T13:14:53.166628Z","title":"Hunyuan-gamecraft-2: Instruction-following interactive game world model","venue":null,"work_id":"49842da5-5896-4a8d-a8df-fe0f89b249d6","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:47418313df4fdf90b66a0a28209aaf920af84e9d5e278c2470f06f332e0d1923","observation_id":"d4cfafa0-9112-4cb8-9f15-6fea66aa8a60","resolution":{"observed_at":"2026-06-29T08:23:14.808350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.22096","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T13:14:53.240397Z","title":"Yume-1.5: A text-controlled interactive world generation model.arXiv preprint arXiv:2512.22096","venue":null,"work_id":"ad52c05d-d5a2-4898-a706-6e9f58dd3cf3","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:4052e603cb395a590e8165b4dead5ab18edf415eff6861aa689686734c667b35","observation_id":"52826859-1e00-4919-b6ee-5f44e9d2983c","resolution":{"observed_at":"2026-06-29T08:23:14.771336Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.17661","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:50:11.356932Z","title":"arXiv preprint arXiv:2512.17661 (2025)","venue":null,"work_id":"9e772f24-954f-420f-a8e5-490b0786c535","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:8567d66676286c239751ef7dd4b8743dc05fa340071b08a77ac54dfd97c69e6e","observation_id":"035a968c-8394-4787-a9e7-0e226782c253","resolution":{"observed_at":"2026-06-29T08:23:14.805762Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.04677","last_updated":"2026-07-31T10:43:50Z","snapshot_observed_at":"2026-08-10T06:34:19.642342Z","submitted_at":"2025-12-04T11:11:24Z","title":"Live Avatar: Streaming Real-time Audio-Driven Avatar Generation with Infinite Length","version":6},"cited_work":{"arxiv_id":"2512.04677","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.04677","snapshot_observed_at":"2026-07-04T20:00:07.549832Z","title":"Live Avatar: Streaming Real-time Audio-Driven Avatar Generation with Infinite Length","venue":"cs.CV","work_id":"6162e20b-7f90-4812-8c9b-a2423c67be80","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2512.04677","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:486af52e994d04940ae33681a978896664af8ba0059cab4c4f9371d9340bf968","observation_id":"a3054365-5e85-48ab-a15d-d5981e0af8a0","resolution":{"observed_at":"2026-06-29T08:23:14.768411Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.22065","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T16:49:57.656859Z","title":"Streamavatar: Streaming diffusion models for real-time interactive human avatars","venue":null,"work_id":"96aa6849-20e6-4022-b43d-2142b0ebda4d","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:e55fea2b9fdc338a4616a94f70af097029586bbb84f5593ba7748f72146d6486","observation_id":"1d89f0a5-8b75-480a-bc8a-7eb2f79daada","resolution":{"observed_at":"2026-06-29T08:23:14.789439Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.04040","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:00:07.566418Z","title":"Relic: Interactive video world model with long-horizon memory.arXiv preprint arXiv:2512.04040","venue":null,"work_id":"d398db79-a718-4fff-a215-641fd1af997a","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:27acf35d5564bfd527a64943359e3720b294c98b1dafd24d5612ed417fa5d3ec","observation_id":"65a32d7a-2cbb-4402-a642-4dbb19eba294","resolution":{"observed_at":"2026-06-29T08:23:14.808942Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.08601","last_updated":"2025-08-14T10:26:51Z","snapshot_observed_at":"2026-08-10T10:39:28.807396Z","submitted_at":"2025-08-12T03:34:21Z","title":"Yan: Foundational Interactive Video Generation","version":3},"cited_work":{"arxiv_id":"2508.08601","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.08601","snapshot_observed_at":"2026-07-02T20:27:22.749875Z","title":"Yan: Foundational interactive video generation","venue":null,"work_id":"18b68f7a-1165-4119-b688-e63acffec128","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2508.08601","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:56be561ba2e9080112d84abcef9bca5a6265ad8ec8505d6869503af1b5b0e34f","observation_id":"afa0de71-bd45-4407-a9c9-08ef65382e5a","resolution":{"observed_at":"2026-06-29T08:23:14.803765Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.09057","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T13:14:53.252836Z","title":"Pan: Aworldmodelforgeneral,interactable,andlong-horizonworldsimulation","venue":null,"work_id":"9df4502a-4028-43c9-9b40-8fea39effac4","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:e264b773a29cfed6aa7aa50dfa6f7b4acce5a5490a41b09f73c446a5c6ad39ea","observation_id":"d5f66e2a-3953-46c5-beed-f43487df16da","resolution":{"observed_at":"2026-06-29T08:23:14.787002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13009","last_updated":"2026-04-07T11:37:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-18T15:28:53Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model","version":4},"cited_work":{"arxiv_id":"2508.13009","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.13009","snapshot_observed_at":"2026-07-09T07:56:04.730683Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model","venue":"cs.CV","work_id":"492a2d34-e672-45fb-8f54-c720d2dfae5a","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2508.13009","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:9d93491359daafab1886d57f645206972acf7945246680e2fac59dd3f5665e9b","observation_id":"534b3597-3a74-446b-a3e2-04dc30d90925","resolution":{"observed_at":"2026-06-29T08:23:14.773709Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.01266","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:41.078141Z","title":"Motionstream: Real-time video gen- eration with interactive motion controls.arXiv preprint arXiv:2511.01266","venue":null,"work_id":"cf21957e-b90d-4728-83de-9326cf9751c3","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:e2709685e1030e86648c9df2a4562c1b20fe8fa621085793ee1cd8996c1174b9","observation_id":"9c2f6e26-fee0-4f4b-ba57-14d1d7b33cc6","resolution":{"observed_at":"2026-06-29T08:23:14.806364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:22:48.074724Z","title":"From slow bidirectional to fast autoregressive video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:028a4dae2b9f71a87e1d99092f727f710e0f00e2a45cfda00fe0af738f12c762","observation_id":"68c362e9-495b-4118-9ba4-c8d856e5a431","resolution":{"observed_at":"2026-06-29T08:22:48.074724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.08316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:07:45.233309Z","title":"Diffusion adversarial post-training for one-step video generation","venue":null,"work_id":"62c7164b-8dc8-4fc0-898d-e70790cfb89c","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:814301de0a18f650b08e2a25aa47e7f2a980e64cbcee0baf89a5cfcd1300bed0","observation_id":"f67364f6-5e99-421e-8926-02c9e07c2b79","resolution":{"observed_at":"2026-06-29T08:23:14.776675Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:46316f3ff78ee4946208c4c1a06d384d1567cee3634cb539718be986dc58af83","observation_id":"3a96d5b1-f39d-4fe0-a640-42a9224f6ffc","resolution":{"observed_at":"2026-06-29T08:23:14.797048Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-03T05:30:22.346810Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":5},"cited_work":{"arxiv_id":"2602.02214","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.02214","snapshot_observed_at":"2026-07-10T13:47:05.847304Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","venue":"cs.CV","work_id":"04f67f5b-e79a-4ad9-8e90-763e5e54bd3d","year":2026},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2602.02214","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:d2f5077a82ff297fb3d7b38b1828649c6a767ba5fc463c1c1fea5b7d101a5fc3","observation_id":"7234cfc7-61c8-404e-89df-ab77e083d16f","resolution":{"observed_at":"2026-06-29T08:23:14.784149Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15141","last_updated":"2026-06-01T14:27:49Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:46:36Z","title":"Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation","version":3},"cited_work":{"arxiv_id":"2605.15141","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.15141","snapshot_observed_at":"2026-07-04T19:50:11.401020Z","title":"Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation","venue":"cs.CV","work_id":"70a7f93a-7427-409a-967b-30f10198d6f1","year":2026},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2605.15141","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:0d499c16766e4d7487b70e304b9bd0005cb3145186ac1774bfd23a32c451886b","observation_id":"d053e2c0-880e-4407-b0ec-d5e1c363d17c","resolution":{"observed_at":"2026-06-29T08:23:14.790993Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.01419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:05:04.362931Z","title":"arXiv preprint arXiv:2511.01419 (2025)","venue":null,"work_id":"8beff34c-106c-4ebd-8366-120edc3440f4","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:9c939d9731ffe6d8aa496d4d50f83b4d2d11a386b96e88574cc67b162677fe67","observation_id":"2a1ce0a3-d9e8-45ee-84a0-06090247756a","resolution":{"observed_at":"2026-06-29T08:23:14.794894Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:22:48.074724Z","title":"Cameras as relative positional encoding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:7abda3c56b84897ddf05d978bf077dd1b9cf920c4e52322396703e7194485789","observation_id":"f7896839-288b-497b-ab01-1ef4894bbd69","resolution":{"observed_at":"2026-06-29T08:22:48.074724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13211","last_updated":"2025-05-19T14:58:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-19T14:58:50Z","title":"MAGI-1: Autoregressive Video Generation at Scale","version":1},"cited_work":{"arxiv_id":"2505.13211","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.13211","snapshot_observed_at":"2026-07-10T01:46:41.063877Z","title":"MAGI-1: Autoregressive Video Generation at Scale","venue":"cs.CV","work_id":"25e8bd3d-e51c-43ae-8126-4ea6ecdb3321","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2505.13211","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:7a1698486274bcdf3f98da4b93ff0cd6953bbb1fa99c1e919b7bfb75ea2ef25d","observation_id":"0961f605-8fd2-43aa-9bb2-ea0d400e041b","resolution":{"observed_at":"2026-06-29T08:23:14.782427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:22:48.074724Z","title":"Proliﬁcdreamer: High- ﬁdelity and diverse text-to-3d generation with variational score distillation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:7269cd01348e505124047d41702b4907d437a1611c089c45e647869de5b52415","observation_id":"67558a62-f667-455e-b03c-3d4c3084c71e","resolution":{"observed_at":"2026-06-29T08:22:48.074724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:22:48.074724Z","title":"Diff-instruct: A universal approach for transferring knowledge from pre-trained diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:63cbb96ecbcc91a72598c86cfdaea22ae66eee8c0f0bbe60c8c178f3b29998a8","observation_id":"c926c70f-ab31-4391-ac9d-7f155dd9f3ba","resolution":{"observed_at":"2026-06-29T08:22:48.074724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:22:48.074724Z","title":"One-step diffusion with distribution matching distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:b80721f216cfd399ea65ed772c11834c1baeb04d21234e4da04d9825ee66cd1a","observation_id":"6da17a52-8dce-421e-a379-d9e815f227ea","resolution":{"observed_at":"2026-06-29T08:22:48.074724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:22:48.074724Z","title":"Scaling rectiﬁed ﬂow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:09dd294efdcc2da3783aa43047ad66e5efd97bc298f7dc4ea6825f74c77a9b7e","observation_id":"937f4b2a-7a26-445c-91c9-406f13a26f81","resolution":{"observed_at":"2026-06-29T08:22:48.074724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":"2011.13456","doi":"10.1088/1748-9326/aae98d","metadata_source":"pith","pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","venue":"cs.LG","work_id":"d9110e53-a5d4-4794-a4c5-a575e91c31ad","year":2020},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:55afd18e231fd82eca3bb5d72a28420e6b2dda2c424864ce61d4134e62a18554","observation_id":"d5dcd3be-8947-45bd-a953-1906d94e522e","resolution":{"observed_at":"2026-06-29T08:23:14.769992Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:58:00.812405+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:58:00.812405+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:22:48.074724Z","title":"Consistency models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:7b23f57c1e498bc79e72bff9bfec2f630d4a565c79cd4951f04a6a3eb82be450","observation_id":"53fda67a-6378-4472-9944-70bb7a9de372","resolution":{"observed_at":"2026-06-29T08:22:48.074724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.09676","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T07:56:04.737468Z","title":"Spatialvid: A large-scale video dataset with spatial annotations.arXiv preprint arXiv:2509.09676, 2025a","venue":null,"work_id":"fa42660a-b999-4c7f-80c9-2b72151c3399","year":2025},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:63c884c78c30fdd65cca0cc57e762a29b9e24b19105f5c5198261520acfb45e3","observation_id":"3c1edcc6-e9fd-4d73-a60d-1021de4075dd","resolution":{"observed_at":"2026-06-29T08:23:14.788363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:22:48.074724Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:11d44aa4c539c813aa7e0f9e6ca81c3c4c1f8288866d7a9751d5e6290a5098f7","observation_id":"aa2724ba-5072-4cca-9b9a-e281012b21bc","resolution":{"observed_at":"2026-06-29T08:22:48.074724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02371","last_updated":"2025-02-13T10:13:24Z","snapshot_observed_at":"2026-08-07T10:03:56.902190Z","submitted_at":"2024-07-02T15:40:29Z","title":"OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation","version":3},"cited_work":{"arxiv_id":"2407.02371","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.02371","snapshot_observed_at":"2026-07-05T16:41:18.954519Z","title":"OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation","venue":"cs.CV","work_id":"00dd95a8-d503-4a41-9603-785dcf4a0b8e","year":2024},"citing_paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T08:22:48.074724Z"},"links":{"cited_paper":"/paper/2407.02371","citing_paper":"/paper/2605.30263"},"observation_digest":"sha256:a852af06e87ada9f93898675dd2e5560ced4f92fde888065e3afa915af796dd9","observation_id":"8fe5e981-1d92-4e1a-9389-d02d4e838296","resolution":{"observed_at":"2026-06-29T08:23:14.803157Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.30263","last_updated":"2026-05-28T17:27:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T05:19:05.421119Z","submitted_at":"2026-05-28T17:27:03Z","title":"minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":10,"verified_exact":24,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 4 inbound Pith citation observations for arXiv:2605.30263."}