{"as_of":"2026-08-11T17:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2c7d4eb3d2d6e36af88a2569d29570585ce48a549f0704c62a38943716ce4ec2","coverage":[{"denominator":113,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T01:36:53.029590Z","state":"measured"},{"denominator":200,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":200,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":230,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:09:13.645793Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2507.07982","last_updated":"2026-05-05T14:55:01Z","snapshot_observed_at":"2026-08-04T10:05:27.686733Z","submitted_at":"2025-07-10T17:55:08Z","title":"Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-19T05:13:28.767788Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2507.07982"},"observation_digest":"sha256:61a8bfc02d99b60273840654d5342cb9921d661893721af716a080c6b7a45249","observation_id":"54c4999a-b2e9-4b94-8672-a54342520c57","resolution":{"observed_at":"2026-05-19T05:17:06.744739Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-06T18:09:13.645793Z","title":"Xun Huang, Zhengqi Li, Guande He, Mingyuan Zhou, and Eli Shechtman","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09105","last_updated":"2026-06-02T03:09:55Z","snapshot_observed_at":"2026-08-07T18:24:31.816576Z","submitted_at":"2025-07-12T01:34:50Z","title":"Hybrid Autoregressive-Diffusion Model for Real-Time Sign Language Production","version":4},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:13.645793Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2507.09105"},"observation_digest":"sha256:0c2d0183430bab7e5d912608115cef1b81c1fc191eabeb6367185ff3e69644fd","observation_id":"0fd06437-33d2-472f-b709-377e3c43767c","resolution":{"observed_at":"2026-08-06T18:09:13.645793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-06T16:39:24.508909Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-07T11:02:23.505503Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:24.508909Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:b8a2e945687778f65330454593d1391254d89a0607412d5d573fd5c06f65201e","observation_id":"0d9c8bfd-9578-4c35-ad8f-a267699440f4","resolution":{"observed_at":"2026-08-06T16:39:24.508909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-06T15:24:25.841740Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16116","last_updated":"2026-05-26T15:21:27Z","snapshot_observed_at":"2026-08-09T04:46:14.900223Z","submitted_at":"2025-07-22T00:09:37Z","title":"Pusa V1.0: Unlocking Temporal Control in Pretrained Video Diffusion Models via Vectorized Timestep Adaptation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:24:25.841740Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2507.16116"},"observation_digest":"sha256:6cf7668061c825da71732d58eed3d75ef6f051ccf98f42658acee9db8c42dd3d","observation_id":"3549a2f9-caa9-48b2-966b-6d7b27cc6f5d","resolution":{"observed_at":"2026-08-06T15:24:25.841740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2508.13009","last_updated":"2026-04-07T11:37:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-18T15:28:53Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T22:36:31.044743Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2508.13009"},"observation_digest":"sha256:71c46b934ef6271eb416e6f74ec986d3085ea5ee38a5d08c31d7be48ea86eb4f","observation_id":"2b1d41bd-ba2d-4e04-802a-1fcb01ba7dbf","resolution":{"observed_at":"2026-05-18T22:36:53.239922Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2509.18611","last_updated":"2026-04-20T01:36:57Z","snapshot_observed_at":"2026-08-11T05:09:08.910867Z","submitted_at":"2025-09-23T04:00:41Z","title":"Flow marching for a generative PDE foundation model","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-18T13:48:14.532529Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2509.18611"},"observation_digest":"sha256:f4dd5c6b0228831f725018bd7a6423f78746700a96353007b88e614939b6b52f","observation_id":"ba5f92c1-72e2-4b84-bedc-659cd488f886","resolution":{"observed_at":"2026-05-18T13:51:25.513569Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2509.22622","last_updated":"2025-10-13T22:41:26Z","snapshot_observed_at":"2026-07-06T22:30:55.313733Z","submitted_at":"2025-09-26T17:48:24Z","title":"LongLive: Real-time Interactive Long Video Generation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-15T03:52:59.287555Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2509.22622"},"observation_digest":"sha256:30fcee5fbe64b51e892d15d5154a294e6fc2cef28c1d63dae30f035c714a10d7","observation_id":"441c9f73-9846-43bc-9667-77bb96220295","resolution":{"observed_at":"2026-05-15T03:52:59.462923Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2509.25161","last_updated":"2025-09-29T17:57:14Z","snapshot_observed_at":"2026-08-09T09:15:39.740119Z","submitted_at":"2025-09-29T17:57:14Z","title":"Rolling Forcing: Autoregressive Long Video Diffusion in Real Time","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-16T11:15:29.102090Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2509.25161"},"observation_digest":"sha256:8c407e3d6425f283926202a6cca84b81b88c636f3753ac0b8a19e31d48d401b3","observation_id":"1f701f3b-434b-4010-a4c7-c7beb56e0a46","resolution":{"observed_at":"2026-05-16T11:15:29.240695Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2510.02283","last_updated":"2025-10-02T17:55:42Z","snapshot_observed_at":"2026-08-09T17:36:50.125769Z","submitted_at":"2025-10-02T17:55:42Z","title":"Self-Forcing++: Towards Minute-Scale High-Quality Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T22:39:53.995700Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2510.02283"},"observation_digest":"sha256:a70af19ccd60b243bc795f6ecb2ebc2c3a1aebe7fb11135f9639134c8696c44a","observation_id":"18c1d836-f672-4126-b9ca-e7cfac754ca5","resolution":{"observed_at":"2026-05-15T22:39:54.398645Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-04T11:42:18.300365Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.03550","last_updated":"2026-05-28T15:10:18Z","snapshot_observed_at":"2026-08-09T13:31:08.225008Z","submitted_at":"2025-10-03T22:38:35Z","title":"Streaming Drag-Oriented Interactive Video Manipulation: Drag Anything, Anytime!","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T11:42:18.300365Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2510.03550"},"observation_digest":"sha256:a330da467534f2939f505090e41559a00f6259143958466ad322e8c3b3d72796","observation_id":"b3fbeacd-022b-46e7-af9c-7e69dc82dee6","resolution":{"observed_at":"2026-08-04T11:42:18.300365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2510.06637","last_updated":"2026-05-10T00:27:22Z","snapshot_observed_at":"2026-08-11T10:49:31.596318Z","submitted_at":"2025-10-08T04:37:32Z","title":"Control-Augmented Autoregressive Diffusion for Data Assimilation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T09:02:38.416697Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2510.06637"},"observation_digest":"sha256:6fc8a2913dc06b161969f19a43061beb96e104958a95291770ccbfa9954803cd","observation_id":"9da87e67-4fcf-494e-96c0-f0f61b6eeb93","resolution":{"observed_at":"2026-05-18T09:06:09.271234Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2510.08431","last_updated":"2026-05-06T15:49:52Z","snapshot_observed_at":"2026-08-11T10:50:12.121285Z","submitted_at":"2025-10-09T16:45:30Z","title":"Large Scale Diffusion Distillation via Score-Regularized Continuous-Time Consistency","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T08:46:16.541104Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2510.08431"},"observation_digest":"sha256:d2c2636c28fde89f9fabcb17149919621d9c3744ce49abaf575fdf220078dd94","observation_id":"2a330b6f-a18b-4580-adc2-ad69dd53a828","resolution":{"observed_at":"2026-05-18T08:51:09.198378Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2510.26782","last_updated":"2026-04-20T20:34:09Z","snapshot_observed_at":"2026-08-11T16:48:14.865374Z","submitted_at":"2025-10-30T17:56:43Z","title":"Cloning Deterministic Worlds: The Critical Role of Latent Geometry in Long-Horizon World Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T02:50:32.870296Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2510.26782"},"observation_digest":"sha256:d7bd6ebdafa6be2ec4d0ff17f4ff88dc84611973febf214f613f16af48e46259","observation_id":"513b40a9-42de-4561-9786-3ab5d6693b6b","resolution":{"observed_at":"2026-05-18T02:50:48.262123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2511.20714","last_updated":"2026-04-28T23:05:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-25T01:45:04Z","title":"Inferix: A Block-Diffusion based Next-Generation Inference Engine for World Simulation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-17T05:14:36.280155Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2511.20714"},"observation_digest":"sha256:114165f2373ccda3600cd3dcc4be527d00ee1f065a49bf46bdf2cf453823e720","observation_id":"d9f66215-8139-4c13-9f9d-4de44b3a0649","resolution":{"observed_at":"2026-05-17T05:19:05.033997Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T19:41:56.848609Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.22973","last_updated":"2026-06-22T15:51:03Z","snapshot_observed_at":"2026-08-03T19:41:54.757475Z","submitted_at":"2025-11-28T08:25:59Z","title":"BIFE: Better Interaction, Fewer Errors for Minute-Long Video Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T19:41:56.848609Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2511.22973"},"observation_digest":"sha256:540670e98008687cf798c37366d425b802f1d61bb37d410da1493c8ae8324109","observation_id":"8b72514e-b85a-4576-a79e-d343757eee97","resolution":{"observed_at":"2026-08-03T19:41:56.848609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2512.04677","last_updated":"2026-07-31T10:43:50Z","snapshot_observed_at":"2026-08-11T13:45:30.173834Z","submitted_at":"2025-12-04T11:11:24Z","title":"Live Avatar: Streaming Real-time Audio-Driven Avatar Generation with Infinite Length","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-17T01:56:44.123092Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2512.04677"},"observation_digest":"sha256:1a20727559ef52bb1c47da85568299e26758041d58df70efa855af1c0f81a97c","observation_id":"4bbd5641-707d-4e84-9ae0-8f849cf8d0bb","resolution":{"observed_at":"2026-05-17T01:58:51.363780Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T18:39:41.344768Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04677","last_updated":"2026-07-31T10:43:50Z","snapshot_observed_at":"2026-08-11T13:45:30.173834Z","submitted_at":"2025-12-04T11:11:24Z","title":"Live Avatar: Streaming Real-time Audio-Driven Avatar Generation with Infinite Length","version":6},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T18:39:41.344768Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2512.04677"},"observation_digest":"sha256:76bc78e2d10d7bd1c537f6cf679ca674148b24264dfc0ce849b463116d574396","observation_id":"cfbac149-1467-4cb7-b140-b48b69acd3e4","resolution":{"observed_at":"2026-08-03T18:39:41.344768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2512.04678","last_updated":"2025-12-28T11:15:39Z","snapshot_observed_at":"2026-08-04T14:52:25.854038Z","submitted_at":"2025-12-04T11:12:13Z","title":"Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution Matching Distillation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T18:17:54.943863Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2512.04678"},"observation_digest":"sha256:23085241261b22ef55a776b5873855b70c6f94f2e640ebaaaa45bc21223807b2","observation_id":"0e4ec63e-f914-4354-80d3-2a61eb037f1f","resolution":{"observed_at":"2026-05-16T18:17:55.169775Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T17:55:06.649101Z","title":"Self forcing: Bridging the train- test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.07778","last_updated":"2026-06-28T16:02:21Z","snapshot_observed_at":"2026-08-04T10:23:32.451665Z","submitted_at":"2025-12-08T17:59:47Z","title":"Distribution Matching Variational AutoEncoder","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T17:55:06.649101Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2512.07778"},"observation_digest":"sha256:b300976b6b687213ed26580f78387765c4b6bc81a625a7a00587a595e9643d07","observation_id":"3a6ea606-cd11-4f47-b833-e4eb3313b7c3","resolution":{"observed_at":"2026-08-03T17:55:06.649101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T17:02:35.320248Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10958","last_updated":"2026-06-01T17:54:44Z","snapshot_observed_at":"2026-08-03T18:19:00.778254Z","submitted_at":"2025-12-11T18:59:58Z","title":"WorldLens: Full-Spectrum Evaluations of Driving World Models in Real World","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T17:02:35.320248Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2512.10958"},"observation_digest":"sha256:f92318bfbdc2200fcf01be52910d6452e01a244c6b9671735f99341ab5fca227","observation_id":"d06dde71-6ff5-44d4-a0cd-c9768ce582bc","resolution":{"observed_at":"2026-08-03T17:02:35.320248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T16:30:34.497342Z","title":"Self forcing: Bridging the train- test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13247","last_updated":"2026-07-17T19:41:30Z","snapshot_observed_at":"2026-08-07T23:01:22.712955Z","submitted_at":"2025-12-15T11:59:01Z","title":"STARCaster: Spatio-Temporal AutoRegressive Video Diffusion for Identity- and View-Aware Talking Portraits","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T16:30:34.497342Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2512.13247"},"observation_digest":"sha256:ba6857c51228f09112d53ff9a92d0115ceb84d7f3725695ebd136ecd06b5a45c","observation_id":"3defc845-6b14-46a8-af97-b4b7b2ac0b2a","resolution":{"observed_at":"2026-08-03T16:30:34.497342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2512.14614","last_updated":"2026-06-09T16:18:08Z","snapshot_observed_at":"2026-08-03T16:11:09.055651Z","submitted_at":"2025-12-16T17:22:46Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T14:29:56.348733Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2512.14614"},"observation_digest":"sha256:6fec3ed9bff7cbd731c63485a7207b4cafc8e02d8e8b4229ef1e8acf081f6f1f","observation_id":"e0024932-e629-4f7a-8fc3-7123fb162a36","resolution":{"observed_at":"2026-05-15T14:29:56.455588Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T16:11:12.262538Z","title":"Self forcing: Bridging the train- test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14614","last_updated":"2026-06-09T16:18:08Z","snapshot_observed_at":"2026-08-03T16:11:09.055651Z","submitted_at":"2025-12-16T17:22:46Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T16:11:12.262538Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2512.14614"},"observation_digest":"sha256:9543b2c2bbc1f71bc5166a563eff0dc7520583e84074c0f217d6e01ed28e1348","observation_id":"b79fb749-b6f3-4e83-8ba4-393e169ba84c","resolution":{"observed_at":"2026-08-03T16:11:12.262538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T15:46:08.258198Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.15702","last_updated":"2026-07-01T03:39:09Z","snapshot_observed_at":"2026-08-06T15:52:47.972204Z","submitted_at":"2025-12-17T18:53:29Z","title":"End-to-End Training for Autoregressive Video Diffusion via Self-Resampling","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T15:46:08.258198Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2512.15702"},"observation_digest":"sha256:25986fdfe9c567dfbfdff539fa76a674f90e4a6c754f96e637fd9da26d9a313f","observation_id":"61111f2f-fc98-4202-8e54-689eeb1f8696","resolution":{"observed_at":"2026-08-03T15:46:08.258198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2512.15840","last_updated":"2026-05-08T06:37:02Z","snapshot_observed_at":"2026-08-11T06:04:17.319434Z","submitted_at":"2025-12-17T18:35:54Z","title":"Large Video Planner Enables Generalizable Robot Control","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T21:26:32.048309Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2512.15840"},"observation_digest":"sha256:707a556b3baadf30925f9bbd3b69eae729f2dbc3a8e7e6ce2c93996b6639eae8","observation_id":"0b095d61-5880-4d6c-9a71-6f08c31b7a3c","resolution":{"observed_at":"2026-05-16T21:28:33.888020Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T13:00:54.589266Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.01075","last_updated":"2026-05-28T18:42:26Z","snapshot_observed_at":"2026-08-08T07:29:12.731200Z","submitted_at":"2026-01-03T05:22:27Z","title":"Flow Equivariant World Models: Memory for Partially Observed Dynamic Environments","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-03T13:00:54.589266Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2601.01075"},"observation_digest":"sha256:0ba3607d3a87b6881a67b7797f876b8ff1f4a1e37f67343de46ef0a3fcef4147","observation_id":"930e776f-fb83-4eca-88aa-fb1a9ed46c67","resolution":{"observed_at":"2026-08-03T13:00:54.589266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T10:56:12.818493Z","title":"Self forcing: Bridging the train- test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.08303","last_updated":"2026-07-06T07:20:34Z","snapshot_observed_at":"2026-08-07T13:59:11.336528Z","submitted_at":"2026-01-13T07:46:46Z","title":"SnapGen++: Unleashing Diffusion Transformers for Efficient High-Fidelity Image Generation on Edge Devices","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T10:56:12.818493Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2601.08303"},"observation_digest":"sha256:0a4760ed936cf9b7839ea95080a2ef1fd45da409cb29c4140207db83c878ade6","observation_id":"8bf95d7f-8626-4faf-9050-0149749af736","resolution":{"observed_at":"2026-08-03T10:56:12.818493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T10:35:06.513455Z","title":"Self forcing: Bridging the train- test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09881","last_updated":"2026-07-09T22:49:12Z","snapshot_observed_at":"2026-08-09T17:44:11.904091Z","submitted_at":"2026-01-14T21:30:03Z","title":"Transition Matching Distillation for Fast Video Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T10:35:06.513455Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2601.09881"},"observation_digest":"sha256:39aad16702a77f9aaa0df9921094915678d4c8346ac8ca83a86d2a835090bd16","observation_id":"f8da3fbd-8283-4042-895a-d9c6577377e3","resolution":{"observed_at":"2026-08-03T10:35:06.513455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2601.20540","last_updated":"2026-01-28T12:37:01Z","snapshot_observed_at":"2026-08-03T01:29:14.204066Z","submitted_at":"2026-01-28T12:37:01Z","title":"Advancing Open-source World Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T09:07:00.904794Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2601.20540"},"observation_digest":"sha256:bceb24a690aa109efd309d9962cf003964df02ad405b96afa4e01d3b3263975f","observation_id":"cfb10b01-e54a-432c-93df-13319eb5ab9f","resolution":{"observed_at":"2026-05-16T09:07:00.976125Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-03T05:30:22.346810Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T17:32:01.642256Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.02214"},"observation_digest":"sha256:f5cf26ffe80a3f2a737d58539ca8eafa71fbf92dcdcd42185c2902042e819332","observation_id":"3b606d9d-06d7-43d0-8c47-f44da136f992","resolution":{"observed_at":"2026-05-21T17:32:01.742199Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-03T05:30:22.346810Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T11:48:00.633421Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.02214"},"observation_digest":"sha256:1027e759082bfb79f6214d07187140db6bd695c4e0c51e653a4610ad1cb8c76a","observation_id":"c9da6182-d1dd-44c2-b84e-c6c1e16e5992","resolution":{"observed_at":"2026-05-22T11:51:29.796382Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T05:30:25.808940Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-03T05:30:22.346810Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T05:30:25.808940Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.02214"},"observation_digest":"sha256:2a42899b8e366ed0e52c38ec976ddc08373d29961ff4134b823557003ff57534","observation_id":"28dd4b54-ef7d-4bad-9e1a-941f5f5ac44a","resolution":{"observed_at":"2026-08-03T05:30:25.808940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2602.02958","last_updated":"2026-05-05T23:46:52Z","snapshot_observed_at":"2026-08-11T02:29:46.998602Z","submitted_at":"2026-02-03T00:54:32Z","title":"Quant VideoGen: Auto-Regressive Long Video Generation via 2-Bit KV-Cache Quantization","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T07:58:24.456859Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.02958"},"observation_digest":"sha256:5287ce09c007161788d1cca9cbd72ccb01314d6c9a2b13c41373925d14b2de05","observation_id":"344d57a0-3b84-445f-b9f4-d73cb2e147a9","resolution":{"observed_at":"2026-05-16T08:00:44.680734Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T04:33:10.902627Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.04789","last_updated":"2026-08-01T03:31:24Z","snapshot_observed_at":"2026-08-06T23:10:56.703504Z","submitted_at":"2026-02-04T17:41:53Z","title":"Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T04:33:10.902627Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.04789"},"observation_digest":"sha256:5365a3d63d4b3e86c0bd4be963c31fdfcde040e4464bbb4697a6cab7a2e4d63a","observation_id":"00870348-5122-4d80-9a2b-13afb686843c","resolution":{"observed_at":"2026-08-03T04:33:10.902627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-04T00:38:16.756350Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.04789","last_updated":"2026-08-01T03:31:24Z","snapshot_observed_at":"2026-08-06T23:10:56.703504Z","submitted_at":"2026-02-04T17:41:53Z","title":"Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T00:38:16.756350Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.04789"},"observation_digest":"sha256:fa7da5f6d4e808415c984331dfc55b8bbcf20b81c5827dd995fe0c997b2d0e27","observation_id":"2126c9aa-8825-4e67-91a7-ad84018ea083","resolution":{"observed_at":"2026-08-04T00:38:16.756350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2602.04939","last_updated":"2026-05-08T16:47:05Z","snapshot_observed_at":"2026-08-11T16:57:51.461376Z","submitted_at":"2026-02-04T16:47:37Z","title":"SynthForensics: Benchmarking and Evaluating People-Centric Synthetic Video Deepfakes","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T07:32:30.580643Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.04939"},"observation_digest":"sha256:d856e686a32d567ffb401501c70e91f96f33ddf29eb3f096248af769b26db860","observation_id":"b7656c70-6a2a-4a09-8c50-63ae29857d0e","resolution":{"observed_at":"2026-05-16T07:37:33.004272Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2602.07775","last_updated":"2026-05-03T01:49:14Z","snapshot_observed_at":"2026-08-11T08:37:21.032068Z","submitted_at":"2026-02-08T02:16:02Z","title":"Rolling Sink: Bridging Limited-Horizon Training and Open-Ended Testing in Autoregressive Video Diffusion","version":6},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T07:02:38.876518Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.07775"},"observation_digest":"sha256:08021d4f10e504ad9b28eddf3a16c424f37bca17ec1e5ee432ccb2467a02a2ee","observation_id":"0e62bd52-2d15-480a-bbfb-50601633d2a4","resolution":{"observed_at":"2026-05-16T07:07:29.936372Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2602.11075","last_updated":"2026-04-28T08:51:16Z","snapshot_observed_at":"2026-08-03T04:09:34.408025Z","submitted_at":"2026-02-11T17:43:36Z","title":"RISE: Self-Improving Robot Policy with Compositional World Model","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T02:28:37.997148Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.11075"},"observation_digest":"sha256:6b29aa9c7f5f80f697fd81b4b7c38077e19ad64484b22836c5461e4426526a3f","observation_id":"83cdffda-753c-467b-85c2-6817a9d57bf5","resolution":{"observed_at":"2026-05-16T02:30:32.150300Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2602.11229","last_updated":"2026-05-06T20:12:38Z","snapshot_observed_at":"2026-08-11T07:19:31.817761Z","submitted_at":"2026-02-11T15:34:52Z","title":"Latent Generative Solvers for Generalizable Long-Term Physics Simulation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T05:21:13.280286Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.11229"},"observation_digest":"sha256:d5020b3b5860d2d5de1b4739aaad928b62ea96a4a7aefcae15b11a59e953115f","observation_id":"cb43ca7b-8642-4ed0-b9d1-39661d434e96","resolution":{"observed_at":"2026-05-16T05:22:22.587775Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2602.13669","last_updated":"2026-04-22T07:41:44Z","snapshot_observed_at":"2026-08-11T04:55:53.338738Z","submitted_at":"2026-02-14T08:32:38Z","title":"EchoTorrent: Towards Swift, Sustained, and Streaming Multi-Modal Video Generation","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T22:20:16.320171Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.13669"},"observation_digest":"sha256:64241813b2ed9c8dcb4d69ea808e75a1f007d23dab3ddb060c978ae6ed2d2aa7","observation_id":"32cf6f5a-9fd5-4e50-9be7-f15357e5127a","resolution":{"observed_at":"2026-05-15T22:20:22.360865Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-02T23:23:53.847694Z","title":"Huang, Z","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.13977","last_updated":"2026-06-27T16:11:05Z","snapshot_observed_at":"2026-08-02T23:23:50.481908Z","submitted_at":"2026-02-15T03:48:20Z","title":"WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T23:23:53.847694Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.13977"},"observation_digest":"sha256:5d617b21f4640c0db7c482c341a5348fd3a3e930fbeab27cd79362f1b48bb888","observation_id":"51656547-767d-408f-8411-4c131d1cd1a8","resolution":{"observed_at":"2026-08-02T23:23:53.847694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2602.15922","last_updated":"2026-02-17T15:04:02Z","snapshot_observed_at":"2026-08-09T12:54:21.149243Z","submitted_at":"2026-02-17T15:04:02Z","title":"World Action Models are Zero-shot Policies","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-11T16:18:15.003371Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.15922"},"observation_digest":"sha256:3abc21436918d9e88d3aca318d16b974ef36446e0d9f1625bdf29425ab6e795c","observation_id":"a11e67e2-907b-4cdf-893e-6c169d6b9f97","resolution":{"observed_at":"2026-05-11T16:18:15.290841Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-02T20:36:10.350756Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.22960","last_updated":"2026-06-29T11:22:33Z","snapshot_observed_at":"2026-08-10T14:47:08.716675Z","submitted_at":"2026-02-26T12:54:46Z","title":"UCM: Unified Modeling of Camera Control and Memory with Time-aware Positional Encoding Warping for World Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T20:36:10.350756Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.22960"},"observation_digest":"sha256:0739c24e4e2ef385bf41cf9dbdce7678256453acbae093eb76d1656685ddb232","observation_id":"3ecd02e1-5725-4e8f-b0f5-e458e778e781","resolution":{"observed_at":"2026-08-02T20:36:10.350756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2602.23058","last_updated":"2026-05-17T06:55:06Z","snapshot_observed_at":"2026-07-06T22:47:11.228912Z","submitted_at":"2026-02-26T14:42:53Z","title":"GeoWorld: Geometric World Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-21T11:39:15.308355Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2602.23058"},"observation_digest":"sha256:fa6ef38ae1c04a5f8da56f79f84c84271d567c7b22e617edf6a6024c7946f58c","observation_id":"34df3ac6-001d-4bfe-b725-74839451b061","resolution":{"observed_at":"2026-05-21T11:40:03.277250Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-02T19:20:40.047678Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.02697","last_updated":"2026-06-03T03:49:31Z","snapshot_observed_at":"2026-08-02T19:20:38.114490Z","submitted_at":"2026-03-03T07:41:12Z","title":"ShareVerse: Multi-Agent Consistent Video Generation for Shared World Modeling","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T19:20:40.047678Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2603.02697"},"observation_digest":"sha256:b1bd9f9674dafc9a2335ef977ab8e0b8736f379334b06c4415d8f6779b0eafb2","observation_id":"a3f216af-b4b9-4324-a2f6-64810069be24","resolution":{"observed_at":"2026-08-02T19:20:40.047678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-07-13T23:54:26.281624Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16271","last_updated":"2026-06-30T03:31:28Z","snapshot_observed_at":"2026-07-13T23:53:56.592969Z","submitted_at":"2026-03-17T09:04:10Z","title":"VIGOR: VIdeo Geometry-Oriented Reward for Temporal Generative Alignment","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T23:54:26.281624Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2603.16271"},"observation_digest":"sha256:dee7ba21c652af1ae517393e99981b4c63914b6b239e6f15523fbcc882d76052","observation_id":"08b39d50-d12d-4255-ae7b-04dcc988592b","resolution":{"observed_at":"2026-07-13T23:54:26.281624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-07-13T23:09:50.674516Z","title":"arXiv preprint arXiv:2506.08009 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.17461","last_updated":"2026-06-29T18:39:41Z","snapshot_observed_at":"2026-08-09T19:17:18.366617Z","submitted_at":"2026-03-18T08:07:01Z","title":"AR-CoPO: Align Autoregressive Video Generation with Contrastive Policy Optimization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T23:09:50.674516Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2603.17461"},"observation_digest":"sha256:73d84cc3535cd967d18cde924443d6f30e5cec42a339e2cc5fc283cfe20ab766","observation_id":"12879bd4-a172-43d0-9b92-4658eab2ce44","resolution":{"observed_at":"2026-07-13T23:09:50.674516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2603.17812","last_updated":"2026-04-07T18:00:52Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:04:57Z","title":"ChopGrad: Pixel-Wise Losses for Latent Video Diffusion via Truncated Backpropagation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T09:42:26.074609Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2603.17812"},"observation_digest":"sha256:411e0083d0bbe44b775f753fead90c8becb966bd41a05c3c9c4174b7015dd21b","observation_id":"4b1f0287-47c8-460d-b0b4-3aa35361f9b8","resolution":{"observed_at":"2026-05-15T09:45:23.223991Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2603.20187","last_updated":"2026-04-18T06:06:04Z","snapshot_observed_at":"2026-08-11T12:40:42.092082Z","submitted_at":"2026-03-20T17:59:06Z","title":"MuSteerNet: Human Reaction Generation from Videos via Observation-Reaction Mutual Steering","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T08:17:00.580559Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2603.20187"},"observation_digest":"sha256:d236c6a8da8f5893cb73e4d5ba706cc3aa876207135f340f2fc202f13edb79d5","observation_id":"75102867-81bb-447d-940e-4d724eac8954","resolution":{"observed_at":"2026-05-15T08:19:52.531626Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-03T02:30:19.287583Z","title":"arXiv preprint arXiv:2506.08009 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.23413","last_updated":"2026-07-31T11:13:43Z","snapshot_observed_at":"2026-08-10T10:39:59.339425Z","submitted_at":"2026-03-24T16:45:40Z","title":"I3DM: Implicit 3D-aware Memory Retrieval and Injection for Consistent Video Scene Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T02:30:19.287583Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2603.23413"},"observation_digest":"sha256:5269973b1f71ae743ee57194cfb0c5932a865fe504750c917157682f3e358b59","observation_id":"a423a6e7-f48a-4c20-a9b6-83c9e2bff728","resolution":{"observed_at":"2026-08-03T02:30:19.287583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.03118","last_updated":"2026-07-01T08:23:09Z","snapshot_observed_at":"2026-08-11T09:09:35.002953Z","submitted_at":"2026-04-03T15:43:21Z","title":"Salt: Self-Consistent Distribution Matching with Cache-Aware Training for Fast Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T19:38:54.942114Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.03118"},"observation_digest":"sha256:d17f1a9d64cd728959a9004170261e58cd44aa7c9b616b2bca1ac2d3a0d3b969","observation_id":"1cdc0ceb-0d57-49a2-8e89-8598b6527a75","resolution":{"observed_at":"2026-05-13T19:43:11.451956Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.06339","last_updated":"2026-04-07T18:17:05Z","snapshot_observed_at":"2026-07-06T22:54:53.308309Z","submitted_at":"2026-04-07T18:17:05Z","title":"Evolution of Video Generative Foundations","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-10T18:41:38.616611Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.06339"},"observation_digest":"sha256:80554edd5e93d39cd2842753ec294777500ddf04872065a16e4c45b3877502e2","observation_id":"21cfc8df-0d6a-40dc-8f2c-615a7029aa4d","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.06939","last_updated":"2026-04-13T17:35:53Z","snapshot_observed_at":"2026-08-11T14:27:06.457070Z","submitted_at":"2026-04-08T11:03:22Z","title":"Grounded Forcing: Bridging Time-Independent Semantics and Proximal Dynamics in Autoregressive Video Synthesis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T18:32:01.665435Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.06939"},"observation_digest":"sha256:d1391d4530249a5b2d036c8f2938a59cc0f327a070d431df63caeb6627415d0a","observation_id":"8d778f67-cedf-479b-a24b-8193469cee74","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.07209","last_updated":"2026-04-13T13:03:18Z","snapshot_observed_at":"2026-07-06T22:55:28.855291Z","submitted_at":"2026-04-08T15:31:22Z","title":"INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T19:08:56.588282Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.07209"},"observation_digest":"sha256:02d46a2d3855754a16f2071080f3aaead1acff795c32e70318276dbf116f9b50","observation_id":"b832f390-1a62-491a-b268-798f8a467844","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.07823","last_updated":"2026-04-14T22:09:01Z","snapshot_observed_at":"2026-07-06T22:57:05.146373Z","submitted_at":"2026-04-09T05:26:09Z","title":"LPM 1.0: Video-based Character Performance Model","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-10T17:09:17.360697Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.07823"},"observation_digest":"sha256:f0c1c9c698cb12e42562a7ff72405f988968e6a7d2c94dce2348eb0fe2435db4","observation_id":"99f41c3e-a70a-448e-b9b1-936e18295cd7","resolution":{"observed_at":"2026-05-11T07:30:59.878767Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.07882","last_updated":"2026-04-09T06:51:14Z","snapshot_observed_at":"2026-08-11T13:29:17.830962Z","submitted_at":"2026-04-09T06:51:14Z","title":"ReconPhys: Reconstruct Appearance and Physical Attributes from Single Video","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T16:57:29.556084Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.07882"},"observation_digest":"sha256:f0dc9b5afc8290d63acbcff2be39a42a6cc9633ca41483657150682f3727a708","observation_id":"66d3b328-18d6-41f6-bcaf-a0c28c9a973d","resolution":{"observed_at":"2026-05-11T07:50:57.805240Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.07966","last_updated":"2026-04-09T08:29:29Z","snapshot_observed_at":"2026-08-11T15:58:53.788922Z","submitted_at":"2026-04-09T08:29:29Z","title":"Lighting-grounded Video Generation with Renderer-based Agent Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T17:34:39.848940Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.07966"},"observation_digest":"sha256:19bf1daa6fc74a8ecb1d6a0969317db5281dba0b3a6d0ea4f82c648b5eec5607","observation_id":"cbaa8a7f-c5f3-45df-bd3b-886ed8f2df7e","resolution":{"observed_at":"2026-05-11T06:36:01.742328Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-07-12T23:58:40.131335Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.08324","last_updated":"2026-08-05T12:35:59Z","snapshot_observed_at":"2026-08-08T23:12:54.103268Z","submitted_at":"2026-04-09T14:55:36Z","title":"Multi-Modal Learning meets Genetic Programming: Analyzing Alignment in Latent Space Optimization","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T23:58:40.131335Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.08324"},"observation_digest":"sha256:918f9e506807fed193fcd1d51bb3e3c7179946f264eab113b210168b95208b94","observation_id":"357e4927-7a2e-4e73-ade0-63a223780f9e","resolution":{"observed_at":"2026-07-12T23:58:40.131335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.08329","last_updated":"2026-04-09T15:01:50Z","snapshot_observed_at":"2026-07-06T22:57:26.678728Z","submitted_at":"2026-04-09T15:01:50Z","title":"DiV-INR: Extreme Low-Bitrate Diffusion Video Compression with INR Conditioning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T17:21:16.076729Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.08329"},"observation_digest":"sha256:b93ec073622d197c33b02b29f3e7e216abc2871c38414e62f26d58b20148c77e","observation_id":"83fbd391-dc06-4c2e-994a-4cbf3871dbf0","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.08995","last_updated":"2026-04-13T03:48:38Z","snapshot_observed_at":"2026-07-06T22:57:59.555972Z","submitted_at":"2026-04-10T06:00:09Z","title":"Matrix-Game 3.0: Real-Time and Streaming Interactive World Model with Long-Horizon Memory","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T18:24:14.349469Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.08995"},"observation_digest":"sha256:ad3ca670f730537f5b49dd52853de520a80fd36fc4c456d81c4432aaa3985a92","observation_id":"53b60662-929e-4b12-bc56-29732c98dda7","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.10103","last_updated":"2026-04-28T08:33:18Z","snapshot_observed_at":"2026-08-11T03:44:50.080187Z","submitted_at":"2026-04-11T08:54:07Z","title":"Long-Horizon Streaming Video Generation via Hybrid Attention with Decoupled Distillation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T16:10:54.363560Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.10103"},"observation_digest":"sha256:02305b7e54c096f12919c80f82cd66044aa0337b34ff9a621cf796de04dd834f","observation_id":"2a1491a6-ed61-42e0-942a-78a47701fb9d","resolution":{"observed_at":"2026-05-11T09:11:10.156812Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.13036","last_updated":"2026-04-14T17:59:44Z","snapshot_observed_at":"2026-08-11T10:46:08.311397Z","submitted_at":"2026-04-14T17:59:44Z","title":"Lyra 2.0: Explorable Generative 3D Worlds","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T15:30:57.712342Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.13036"},"observation_digest":"sha256:42dd67b92c26ae96ea475542338de5df6d5967ec83447a71ee8eead6508bf0e2","observation_id":"bf83eb8c-ca66-440f-8a53-5685ac55a413","resolution":{"observed_at":"2026-05-11T10:25:59.730325Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.13509","last_updated":"2026-04-15T05:52:43Z","snapshot_observed_at":"2026-08-11T03:08:21.494832Z","submitted_at":"2026-04-15T05:52:43Z","title":"DiT as Real-Time Rerenderer: Streaming Video Stylization with Autoregressive Diffusion Transformer","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T14:19:55.598710Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.13509"},"observation_digest":"sha256:e11256b652d50b286ad8c182915de6327686b4115062e1e3886d415a15866495","observation_id":"8eb0e04e-c812-4373-adfc-e026746e6d05","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.13793","last_updated":"2026-07-01T12:10:20Z","snapshot_observed_at":"2026-08-10T21:40:39.646332Z","submitted_at":"2026-04-15T12:32:25Z","title":"From Synchrony to Sequence: Exo-to-Ego Generation via Interpolation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T13:23:35.738229Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.13793"},"observation_digest":"sha256:2a3954f311127da0a350d4fd59e807295706ea1a5257786bd22ad070b786d7bf","observation_id":"1c62217c-2e22-4ff5-b158-714a72d3e312","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-07-12T20:34:35.048469Z","title":"arXiv preprint arXiv:2506.08009 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.13793","last_updated":"2026-07-01T12:10:20Z","snapshot_observed_at":"2026-08-10T21:40:39.646332Z","submitted_at":"2026-04-15T12:32:25Z","title":"From Synchrony to Sequence: Exo-to-Ego Generation via Interpolation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T20:34:35.048469Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.13793"},"observation_digest":"sha256:0763519d5c14135c149511334cf0c05aaa9d483deb6228c6d5d76ca48c76629b","observation_id":"caa3b6ee-941c-421b-a5b9-7535765fe2d3","resolution":{"observed_at":"2026-07-12T20:34:35.048469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.14268","last_updated":"2026-04-15T17:59:17Z","snapshot_observed_at":"2026-08-11T03:24:28.893148Z","submitted_at":"2026-04-15T17:59:17Z","title":"HY-World 2.0: A Multi-Modal World Model for Reconstructing, Generating, and Simulating 3D Worlds","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T13:45:24.961208Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.14268"},"observation_digest":"sha256:dd4b882fa4a31da65a0309728d7c50c16d89f5b4ce3dc0198526087da917e507","observation_id":"b93cd7fa-d3b0-4901-94b3-81c7add578a8","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.14580","last_updated":"2026-05-05T22:56:58Z","snapshot_observed_at":"2026-08-11T12:21:00.619476Z","submitted_at":"2026-04-16T03:19:29Z","title":"TurboTalk: Progressive Distillation for One-Step Audio-Driven Talking Avatar Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T11:13:27.689539Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.14580"},"observation_digest":"sha256:849851bdd376c0f288039ae305948f3f2ecbb3db2e0d23228b48018fa67baeb0","observation_id":"b37966fc-e6c7-44f0-9909-c4b307c00b10","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.15911","last_updated":"2026-04-17T10:11:39Z","snapshot_observed_at":"2026-08-11T06:56:48.614928Z","submitted_at":"2026-04-17T10:11:39Z","title":"Efficient Video Diffusion Models: Advancements and Challenges","version":1},"reference_index":297,"source":"pdf_text","source_observed_at":"2026-05-10T08:28:29.706249Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.15911"},"observation_digest":"sha256:95ce415b8e295ab5865821263042006ae32f16368ec0f5cca7189ccc77742790","observation_id":"32019b4a-72f4-4457-8982-91b7bf59a90f","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.16299","last_updated":"2026-04-17T17:59:50Z","snapshot_observed_at":"2026-08-03T01:59:43.264555Z","submitted_at":"2026-04-17T17:59:50Z","title":"Repurposing 3D Generative Model for Autoregressive Layout Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T08:09:00.779456Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.16299"},"observation_digest":"sha256:00c5d6d37dcb985fbd0704b7b086c5430b08f437abd9fc4f50f8edd0eb572ce2","observation_id":"0f447374-8d99-4fb6-9616-90fc977ac98b","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.16592","last_updated":"2026-04-17T17:51:46Z","snapshot_observed_at":"2026-07-06T23:03:52.631613Z","submitted_at":"2026-04-17T17:51:46Z","title":"Human Cognition in Machines: A Unified Perspective of World Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-10T08:12:15.663761Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.16592"},"observation_digest":"sha256:df6fe5fcd18ae9724c4ada105646e3a0acd36cf12bac527805a22562398d5be3","observation_id":"a67ce22a-459d-4326-a356-923c0e085dc4","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.17397","last_updated":"2026-04-19T12:01:57Z","snapshot_observed_at":"2026-08-04T20:16:43.873473Z","submitted_at":"2026-04-19T12:01:57Z","title":"Speculative Decoding for Autoregressive Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T06:10:41.082951Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.17397"},"observation_digest":"sha256:02d73d5b2b0256b6724684f601b940fb3a65975fa545c346f71abe2ab707a4cc","observation_id":"f1aae549-6382-4a31-8eec-c09459df0f6f","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.18215","last_updated":"2026-04-21T16:05:42Z","snapshot_observed_at":"2026-08-11T11:42:36.776676Z","submitted_at":"2026-04-20T13:00:17Z","title":"Memorize When Needed: Decoupled Memory Control for Spatially Consistent Long-Horizon Video Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T04:49:44.525757Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.18215"},"observation_digest":"sha256:32cf491dd1dfb3a18c529926a3d918ec03adeea09c7a9be2e69482ff561165e2","observation_id":"8844f294-d861-4043-aadb-5c4bb320bed4","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.18564","last_updated":"2026-04-21T06:41:18Z","snapshot_observed_at":"2026-08-11T12:51:39.594285Z","submitted_at":"2026-04-20T17:52:15Z","title":"MultiWorld: Scalable Multi-Agent Multi-View Video World Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T05:06:11.514186Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.18564"},"observation_digest":"sha256:322e735f920e999fb292142752e40f037fae3aca0aec9d1c14e8117e0766eae2","observation_id":"152fc266-e4a2-4b25-ac6a-109ddffa4dec","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.19129","last_updated":"2026-04-21T06:22:47Z","snapshot_observed_at":"2026-08-11T02:00:19.902134Z","submitted_at":"2026-04-21T06:22:47Z","title":"PortraitDirector: A Hierarchical Disentanglement Framework for Controllable and Real-time Facial Reenactment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T03:30:18.645845Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.19129"},"observation_digest":"sha256:00cd95b605b80a2b45b5c7f60e69352a44aea55e3717ec93d9c8bf97c961456d","observation_id":"3fccc004-b223-446e-b585-879e26e18665","resolution":{"observed_at":"2026-05-11T12:31:04.317303Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.19741","last_updated":"2026-06-03T18:09:47Z","snapshot_observed_at":"2026-08-11T10:54:39.709784Z","submitted_at":"2026-04-21T17:59:03Z","title":"CityRAG: Stepping Into a City via Spatially-Grounded Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T02:10:54.935053Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.19741"},"observation_digest":"sha256:9a1b5a7082ced5c551134d892a87c7f3daa655ba0ea114178e71c98ac21b351f","observation_id":"0692e593-6002-4dfe-841f-c907c9d10e36","resolution":{"observed_at":"2026-05-11T13:11:23.974996Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.20289","last_updated":"2026-05-05T20:42:09Z","snapshot_observed_at":"2026-07-29T21:16:59.368046Z","submitted_at":"2026-04-22T07:36:59Z","title":"X-Cache: Cross-Chunk Block Caching for Few-Step Autoregressive World Models Inference","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T00:19:58.480655Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.20289"},"observation_digest":"sha256:4a4aea77caad3f7c7fab3a9b789da053c218404a66ab1c5403ac247868fef6d7","observation_id":"166990e0-61ce-4b93-a422-f010cbaed368","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.21221","last_updated":"2026-04-23T02:22:25Z","snapshot_observed_at":"2026-07-06T23:07:51.979267Z","submitted_at":"2026-04-23T02:22:25Z","title":"Sparse Forcing: Native Trainable Sparse Attention for Real-time Autoregressive Diffusion Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T22:42:49.286967Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.21221"},"observation_digest":"sha256:95e4af444d706911b21563587110ea6b23d6d4acba27c5d7bdce7d34a3a74bff","observation_id":"9069cd3b-5865-4702-bcb0-7128b31aaff7","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.22748","last_updated":"2026-06-08T04:24:27Z","snapshot_observed_at":"2026-08-10T21:15:32.081402Z","submitted_at":"2026-04-24T17:48:47Z","title":"Agentic World Modeling: Foundations, Capabilities, Laws, and Beyond","version":1},"reference_index":155,"source":"arxiv_source","source_observed_at":"2026-05-08T12:02:07.027775Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.22748"},"observation_digest":"sha256:c7a1bc0d2db4c5e78685213726cdd0d71f92bcdb97edb25db6da41c0f714f8cd","observation_id":"21241ca2-7b16-48ae-97d7-2da3470ee5b6","resolution":{"observed_at":"2026-05-11T19:26:08.245613Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.22748","last_updated":"2026-06-08T04:24:27Z","snapshot_observed_at":"2026-08-10T21:15:32.081402Z","submitted_at":"2026-04-24T17:48:47Z","title":"Agentic World Modeling: Foundations, Capabilities, Laws, and Beyond","version":2},"reference_index":155,"source":"arxiv_source","source_observed_at":"2026-07-04T17:29:43.764085Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.22748"},"observation_digest":"sha256:352ae2a29a58b0665d39e6cc0a6971002618d4483abeb899cd5ff153a2fc28b1","observation_id":"be963475-1a69-4c46-bcb0-a0b6561be7d3","resolution":{"observed_at":"2026-07-04T17:29:59.589414Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.23632","last_updated":"2026-04-26T09:46:58Z","snapshot_observed_at":"2026-07-06T23:09:48.137856Z","submitted_at":"2026-04-26T09:46:58Z","title":"Hallo-Live: Real-Time Streaming Joint Audio-Video Avatar Generation with Asynchronous Dual-Stream and Human-Centric Preference Distillation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T06:56:19.795651Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.23632"},"observation_digest":"sha256:2dceed8e4199d4235eab75f177b3b0f9b586fc67b3523bda57beb668a27400e0","observation_id":"0d1901f3-6911-45e9-a7ce-09e36467ce6c","resolution":{"observed_at":"2026-05-11T21:06:12.912952Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.25427","last_updated":"2026-04-28T09:34:51Z","snapshot_observed_at":"2026-07-06T23:11:16.247497Z","submitted_at":"2026-04-28T09:34:51Z","title":"A Systematic Post-Train Framework for Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-07T16:58:33.014401Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.25427"},"observation_digest":"sha256:023b0eae834670868e5f025a561d21af39d3035ae075976e1d65c92336d1b2f1","observation_id":"89be9538-ebd0-4085-9823-8a620f7ee2e8","resolution":{"observed_at":"2026-05-11T23:26:19.855952Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2604.25819","last_updated":"2026-04-28T16:28:05Z","snapshot_observed_at":"2026-08-10T12:29:16.529286Z","submitted_at":"2026-04-28T16:28:05Z","title":"Mutual Forcing: Dual-Mode Self-Evolution for Fast Autoregressive Audio-Video Character Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-07T16:54:23.108142Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2604.25819"},"observation_digest":"sha256:4aa982fb681a695c5bf3b700beb8833a3f24827f4d12c1f7236aaefaa5ef7dfe","observation_id":"ee8c4a9c-1b08-4428-9553-2b28688cab89","resolution":{"observed_at":"2026-05-11T23:31:14.874434Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.01896","last_updated":"2026-07-01T09:31:38Z","snapshot_observed_at":"2026-07-06T23:15:01.968194Z","submitted_at":"2026-05-03T14:22:22Z","title":"Divide and Conquer: Decoupled Representation Alignment for Multimodal World Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T15:51:12.604102Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.01896"},"observation_digest":"sha256:be423b4ef60f32c41529e53bd1ef3040f4bbffc7d00068d950cff6965d9238f5","observation_id":"4f4ee25b-536b-491f-8b82-73a8ac3f2495","resolution":{"observed_at":"2026-05-11T09:46:02.822785Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.01896","last_updated":"2026-07-01T09:31:38Z","snapshot_observed_at":"2026-07-06T23:15:01.968194Z","submitted_at":"2026-05-03T14:22:22Z","title":"Divide and Conquer: Decoupled Representation Alignment for Multimodal World Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-02T23:56:39.865433Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.01896"},"observation_digest":"sha256:0cd6ce5bda047aaa0ca12c32faeb0861609934d279e7da6241fb40e580eb3036","observation_id":"d6831395-87f5-447f-ae13-daa5a933fc9f","resolution":{"observed_at":"2026-07-02T23:57:27.917885Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.02948","last_updated":"2026-05-11T03:04:55Z","snapshot_observed_at":"2026-08-11T12:02:27.560611Z","submitted_at":"2026-05-01T16:38:06Z","title":"AsymTalker: Identity-Consistent Long-Term Talking Head Generation via Asymmetric Distillation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T20:19:39.565157Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.02948"},"observation_digest":"sha256:dca2fc668ee599e5080c61790daf1ac3af440b9adde4827463406822db69bc97","observation_id":"a69dbc51-67f2-4b6a-9975-3fc625b83bff","resolution":{"observed_at":"2026-05-11T15:16:11.402538Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.02948","last_updated":"2026-05-11T03:04:55Z","snapshot_observed_at":"2026-08-11T12:02:27.560611Z","submitted_at":"2026-05-01T16:38:06Z","title":"AsymTalker: Identity-Consistent Long-Term Talking Head Generation via Asymmetric Distillation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T02:18:58.996355Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.02948"},"observation_digest":"sha256:d3294c10f8800303fbe543667eaa02d65e52e1ad97abcdfcdc6e7b2326f7fd4a","observation_id":"c3d78d1d-3c7e-4c31-b38e-7203400c4b0d","resolution":{"observed_at":"2026-05-11T03:45:57.433139Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.03849","last_updated":"2026-05-05T15:15:30Z","snapshot_observed_at":"2026-08-10T21:16:02.247069Z","submitted_at":"2026-05-05T15:15:30Z","title":"Stream-R1: Reliability-Perplexity Aware Reward Distillation for Streaming Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T17:38:08.199955Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.03849"},"observation_digest":"sha256:4f90a93c5e984bf11257f05e067f1ee9d6cb6fd382402af1cea6e1d11df839c6","observation_id":"ecba1afa-6e99-4a87-b56f-9a2335b6f74d","resolution":{"observed_at":"2026-05-11T23:16:36.755698Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.04461","last_updated":"2026-05-06T03:40:05Z","snapshot_observed_at":"2026-08-01T01:47:15.158535Z","submitted_at":"2026-05-06T03:40:05Z","title":"Stream-T1: Test-Time Scaling for Streaming Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T18:16:14.985693Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.04461"},"observation_digest":"sha256:4b6fb921941967ff978985a59519f4a84781f8beae174c348f0b0592ef844dfe","observation_id":"e0127b0a-35f7-4e7e-9a01-0c0503386fb4","resolution":{"observed_at":"2026-05-11T01:36:53.812910Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.05204","last_updated":"2026-05-26T15:05:04Z","snapshot_observed_at":"2026-08-03T09:59:43.729293Z","submitted_at":"2026-05-06T17:59:34Z","title":"D-OPSD: On-Policy Self-Distillation for Continuously Tuning Step-Distilled Diffusion Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T17:25:26.391582Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.05204"},"observation_digest":"sha256:9a636af443d463f90791c56f179a4c7a68d96bf0b72ebba3d0d2e87ec2bcbd84","observation_id":"38ff8182-cb1a-46b5-ab65-69412d05fc42","resolution":{"observed_at":"2026-05-11T17:36:06.014038Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.05204","last_updated":"2026-05-26T15:05:04Z","snapshot_observed_at":"2026-08-03T09:59:43.729293Z","submitted_at":"2026-05-06T17:59:34Z","title":"D-OPSD: On-Policy Self-Distillation for Continuously Tuning Step-Distilled Diffusion Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T23:18:35.390642Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.05204"},"observation_digest":"sha256:dfc3dd41308e8028b2c066b060ff85277d715097defceff405476619aa52016c","observation_id":"44243efc-bede-42db-9e84-1649d295bf85","resolution":{"observed_at":"2026-05-20T23:19:13.375952Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.05204","last_updated":"2026-05-26T15:05:04Z","snapshot_observed_at":"2026-08-03T09:59:43.729293Z","submitted_at":"2026-05-06T17:59:34Z","title":"D-OPSD: On-Policy Self-Distillation for Continuously Tuning Step-Distilled Diffusion Models","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T23:44:10.302520Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.05204"},"observation_digest":"sha256:3985b93d159b7668bfa0ae55e872f5c1e0da20508508ebcd68c15f5ff79afe02","observation_id":"305b9139-d664-40a2-a70d-565efc2005b9","resolution":{"observed_at":"2026-06-30T23:45:07.755855Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.06051","last_updated":"2026-05-07T11:36:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-07T11:36:29Z","title":"RealCam: Real-Time Novel-View Video Generation with Interactive Camera Control","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-09T15:22:04.387900Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.06051"},"observation_digest":"sha256:85e91ec9b957f94efd7b88435d11b55f9606966fd01e26c03edaccc90239a540","observation_id":"d33539ee-4185-4895-899a-4bf7ab8fbf27","resolution":{"observed_at":"2026-05-11T16:41:16.444350Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.06509","last_updated":"2026-05-07T16:21:34Z","snapshot_observed_at":"2026-08-06T11:28:24.405584Z","submitted_at":"2026-05-07T16:21:34Z","title":"FreeSpec: Training-Free Long Video Generation via Singular-Spectrum Reconstruction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T13:11:46.079614Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.06509"},"observation_digest":"sha256:6fa050315f2c15498ab41a6259ebfddd51c9d5669434142d8128f601410ca151","observation_id":"e2db436d-e6de-455e-98f7-65eee5e27e9e","resolution":{"observed_at":"2026-05-11T18:56:07.736852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.07020","last_updated":"2026-05-07T23:04:24Z","snapshot_observed_at":"2026-08-11T01:02:06.690328Z","submitted_at":"2026-05-07T23:04:24Z","title":"FlashMol: High-Quality Molecule Generation in as Few as Four Steps","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T01:01:39.724352Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.07020"},"observation_digest":"sha256:0b92ad9c779099933736f0d684ff72f4bfb3c9cbdb579f99091b7b9002c80c2d","observation_id":"85a5eb79-c4e9-4422-bc7a-4707e91b9caf","resolution":{"observed_at":"2026-05-11T04:50:57.812713Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.07288","last_updated":"2026-05-08T05:54:33Z","snapshot_observed_at":"2026-08-11T13:22:06.779533Z","submitted_at":"2026-05-08T05:54:33Z","title":"Sword: Style-Robust World Models as Simulators via Dynamic Latent Bootstrapping for VLA Policy Post-Training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T01:10:09.166876Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.07288"},"observation_digest":"sha256:ff3a83fef4a143efc0e6bfcc99959d1da0024a9e5c7bb35c8dbf57f0f965aecc","observation_id":"2f4720bc-1bb9-4f6f-9803-64edf7fd90b1","resolution":{"observed_at":"2026-05-11T04:40:59.040838Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.08567","last_updated":"2026-05-16T00:08:27Z","snapshot_observed_at":"2026-08-11T11:12:24.733029Z","submitted_at":"2026-05-09T00:00:47Z","title":"ACWM-Phys: Investigating Generalized Physical Interaction in Action-Conditioned Video World Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T02:32:24.412202Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.08567"},"observation_digest":"sha256:1b40fce6c80f65c3b0550657ec3f8d72629ab8dabef1a99a4156e831e8464fae","observation_id":"55e756c5-8acb-4f63-9d1a-33f93c0b7a9f","resolution":{"observed_at":"2026-05-12T07:31:35.216141Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.08567","last_updated":"2026-05-16T00:08:27Z","snapshot_observed_at":"2026-08-11T11:12:24.733029Z","submitted_at":"2026-05-09T00:00:47Z","title":"ACWM-Phys: Investigating Generalized Physical Interaction in Action-Conditioned Video World Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T23:36:21.849680Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.08567"},"observation_digest":"sha256:ab4981eec80ebec4943542a407e9289b8acc0d6e3046f45a92344b59ce0c4744","observation_id":"3671d792-ab5c-40a0-b0e5-8f24434c72e5","resolution":{"observed_at":"2026-05-20T23:39:13.430250Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.08729","last_updated":"2026-06-29T11:45:55Z","snapshot_observed_at":"2026-08-11T14:25:55.811264Z","submitted_at":"2026-05-09T06:32:54Z","title":"Unison: Harmonizing Motion, Speech, and Sound for Human-Centric Audio-Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T02:28:14.734682Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.08729"},"observation_digest":"sha256:4f96070f76b239b88cc7b611cf109c3af5fc5854ceaa58693613280881d126b8","observation_id":"d2dd4fd6-b2d8-482a-8673-38f75d11cb1b","resolution":{"observed_at":"2026-05-12T07:36:44.553350Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.08729","last_updated":"2026-06-29T11:45:55Z","snapshot_observed_at":"2026-08-11T14:25:55.811264Z","submitted_at":"2026-05-09T06:32:54Z","title":"Unison: Harmonizing Motion, Speech, and Sound for Human-Centric Audio-Video Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T23:26:46.077894Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.08729"},"observation_digest":"sha256:93efee11b3e6c3e60dfb66f07fc31ea5562617bdfc2eb54b33c5d697dddabd57","observation_id":"a4ff9e15-f28c-4930-aec3-f6a4c4a9c6c4","resolution":{"observed_at":"2026-06-30T23:35:07.809287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":"2506.08009","doi":"10.48550/arxiv.2506.08009","metadata_source":"pith","pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","venue":"cs.CV","work_id":"53e58ef9-7932-4b83-b757-34ac14db3e0f","year":2025},"citing_paper":{"arxiv_id":"2605.09442","last_updated":"2026-05-10T09:37:56Z","snapshot_observed_at":"2026-07-06T23:21:30.897592Z","submitted_at":"2026-05-10T09:37:56Z","title":"SWIFT: Prompt-Adaptive Memory for Efficient Interactive Long Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T04:57:38.215348Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2605.09442"},"observation_digest":"sha256:cc1f42898811f65e667b78a9db72b25033f477771e5a047c8dba18ce02c48cbc","observation_id":"78bff942-2c9e-4f44-8a1d-d267b3ced9ee","resolution":{"observed_at":"2026-05-12T05:46:30.532347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.08009/citation-record","integrity":"/paper/2506.08009/integrity","json":"/paper/2506.08009/citation-record.json","paper":"/paper/2506.08009"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Block diffusion: Interpolating between autoregressive and diffusion language models","venue":null,"work_id":"09e2b14c-7eec-4c22-aa90-bd38ae40e8ce","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:dbf633038f575166b00f4969da075182b2e7d33fc95a4c5d682f0c2acd80c63e","observation_id":"578b8bc9-ef05-49f9-8417-281d709bf81a","resolution":{"observed_at":"2026-05-11T01:36:53.595536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toward one-second latency: Evolution of live media streaming.IEEE Communications Surveys & Tutorials","venue":null,"work_id":"674dd89c-4a6f-4756-a9cd-df288877c8b0","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:83a7b77123fede115652cefc9720e54bb360b857063ca7569000e247c1a0de3a","observation_id":"d67d6f53-56bb-49a2-be07-1f0cf8980fd4","resolution":{"observed_at":"2026-05-11T01:36:53.607067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":"2311.15127","doi":"10.48550/arxiv.2311.15127","metadata_source":"pith","pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","venue":"cs.CV","work_id":"4f68eada-27e3-437a-a2fe-6e4ca524d0d3","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:9caecf09c9ccba23b48999e1e0097fd80e5fda0b266c91ec199e31be03c55f16","observation_id":"102ac161-4c01-4a19-b371-84f71d9a07ab","resolution":{"observed_at":"2026-05-11T01:36:53.213466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:11:42.190108Z","title":"Align your latents: High-resolution video synthesis with latent diffusion models","venue":null,"work_id":"6afaccfc-e618-464f-b690-0476b2877625","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:f5f42e40b78fa4304f702faa785236548058c28d222da590244bc4e8aa93f086","observation_id":"33262d86-3ebf-4b6c-8c2e-b56daa495fc6","resolution":{"observed_at":"2026-05-11T01:36:53.611039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generating long videos of dynamic scenes.NeurIPS","venue":null,"work_id":"334fc048-239f-4172-9ceb-32bb34324c47","year":2022},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:90f6dbbcdaf02f2351fc8f40143db246620a17f347fe7589399140217d3a5c36","observation_id":"491d179a-3a5a-49b2-b4be-9832679a8a96","resolution":{"observed_at":"2026-05-11T01:36:53.614251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video generation models as world simulators","venue":null,"work_id":"bee768e9-cebf-4057-bd37-558ce5d54abe","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:cb3e93e6c7b1a6aca0b91d9a69e08e45ed64311be0ae90ac2f558ae17ba775f3","observation_id":"bd363c4c-597b-4d07-ae40-f73b2c87bfe6","resolution":{"observed_at":"2026-05-11T01:36:53.618573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Genie: Generative interactive environments","venue":null,"work_id":"f5160acc-11b4-4cd4-be49-0b95ce1d8d50","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:31c6038af3c23d1b7f7eaac73d7da54e30e801d3a290b7432e5e9b3639b80a5a","observation_id":"d2172c7a-f27f-4cb6-a377-05b46fa04bb9","resolution":{"observed_at":"2026-05-11T01:36:53.637270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion forcing: Next-token prediction meets full-sequence diffusion","venue":null,"work_id":"16168f3b-007c-484b-9291-928b056968bc","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:a955b03420e4b683d9d5c18159504718ca28c3603f1a410caa23dac5cc3c5f18","observation_id":"8127958a-1ad4-43a4-908b-739237f5c14b","resolution":{"observed_at":"2026-05-11T01:36:53.649466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19726","last_updated":"2024-05-30T06:16:33Z","snapshot_observed_at":"2026-07-06T18:22:27.156635Z","submitted_at":"2024-05-30T06:16:33Z","title":"Streaming Video Diffusion: Online Video Editing with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2405.19726","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.19726","snapshot_observed_at":"2026-07-02T11:56:55.085242Z","title":"Streaming video diffusion: Online video editing with diffusion models","venue":null,"work_id":"98f01fe0-898a-4929-a04f-a470db07f942","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2405.19726","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:de3310423ed41ead132e08eb80350a117fc10a9e6836e19216ed57970374bd7c","observation_id":"00682b39-ba19-4527-9dd0-83f065d3b68c","resolution":{"observed_at":"2026-05-11T01:36:53.249961Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13074","last_updated":"2025-04-21T10:34:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-17T16:37:27Z","title":"SkyReels-V2: Infinite-length Film Generative Model","version":3},"cited_work":{"arxiv_id":"2504.13074","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.13074","snapshot_observed_at":"2026-07-10T01:46:41.058772Z","title":"SkyReels-V2: Infinite-length Film Generative Model","venue":"cs.CV","work_id":"2ce11350-273e-4f0d-ae78-292aa3151060","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2504.13074","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:88dec85172a5293c98327ef63b83bd65a98f8c7252362e78eafc40af3ae95ac5","observation_id":"47be411e-0349-4f65-be91-78a19ca8cf22","resolution":{"observed_at":"2026-05-14T20:23:04.486750Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Oasis: A universe in a transformer","venue":null,"work_id":"f900ad55-075d-452c-9a8d-2dd74fe51595","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:e7f58646a44ab63acaeca26f36222e72bc7e3c0511961852413e5c82b58e3359","observation_id":"ae2faadb-a07d-4eb5-b841-8af11526dbd8","resolution":{"observed_at":"2026-05-11T01:36:53.653927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12095","last_updated":"2024-12-17T18:45:55Z","snapshot_observed_at":"2026-08-11T14:14:16.149124Z","submitted_at":"2024-12-16T18:59:29Z","title":"Causal Diffusion Transformers for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2412.12095","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.12095","snapshot_observed_at":"2026-06-30T17:54:57.999523Z","title":"Causal diffusion transformers for generative modeling","venue":null,"work_id":"580e6700-929e-4e9c-b159-33072a8afcfe","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2412.12095","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:b8a89c64546522dc02c3a76ad558b9957019304a55cf8da18c7adf99a635089c","observation_id":"7d5a059e-c83d-4dba-ad0f-16bf25ad7f50","resolution":{"observed_at":"2026-05-11T01:36:53.235817Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T19:34:07.579856Z","title":"Autoregressive video generation without vector quantization","venue":null,"work_id":"49bfe7b5-ff9a-4c4f-b175-4c98afeeb926","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:4fa5cfe11877ee61e7762f4da9c42e48f3f08d8708d559fe44e67c6cbe39d189","observation_id":"ef4e11c2-1293-49a2-9334-790d60d59692","resolution":{"observed_at":"2026-05-11T01:36:53.661637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unsupervised learning of disentangled representations from video","venue":null,"work_id":"b08969ba-6363-452a-b75f-b2d91d41de1e","year":2017},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:1e551e6f96ecc9b05c4c6a93b215f7a7ccd0c6887655b572a21d3e3e2a61418c","observation_id":"e34f0958-36bd-4bb3-864c-96f0dd9d7b08","resolution":{"observed_at":"2026-05-11T01:36:53.668271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05496","last_updated":"2024-12-07T01:46:38Z","snapshot_observed_at":"2026-08-07T15:28:16.662668Z","submitted_at":"2024-12-07T01:46:38Z","title":"Flex Attention: A Programming Model for Generating Optimized Attention Kernels","version":1},"cited_work":{"arxiv_id":"2412.05496","doi":"10.48550/arxiv.2412.05496","metadata_source":"pith","pith_arxiv_id":"2412.05496","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flex Attention: A Programming Model for Generating Optimized Attention Kernels","venue":"cs.LG","work_id":"692b9d44-343b-4635-a0dc-1ee8fe539aa3","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2412.05496","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:0ad80168fa14faf4838a91ab9a3b299efab1953beca7ec5f4653d6357fee4c0a","observation_id":"91cbba34-4b26-4742-8e3f-2747bd661701","resolution":{"observed_at":"2026-05-17T21:27:16.810492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.898364+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.898364+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-10T13:12:38.948884Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:ccc128f91db7fbe571bb675246925b02a68e5e61aa269ba26f339f51a66e99b0","observation_id":"4f9735f1-ae02-45dc-8a3d-0ad4c05d0e04","resolution":{"observed_at":"2026-05-11T01:36:53.142419Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Long video generation with time-agnostic vqgan and time-sensitive transformer","venue":null,"work_id":"2f49b711-e00a-4738-a625-f9130d27599c","year":2022},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:925e080c4863e0778c898f5b15dbcbb12d12a445f1eb08ec07a3d8f6a2970de9","observation_id":"eb7c4b6d-9853-48e9-91cd-56a65320ca51","resolution":{"observed_at":"2026-05-11T01:36:53.680351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative adversarial nets","venue":null,"work_id":"629bda9a-8d33-42c3-a55d-4f832c09da73","year":2014},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:a18d703f78541ee4cd018aa1ca485e6dc96bd6b91f90a866907085a413a8c52f","observation_id":"343d5a26-4911-470d-a41c-67b0d3961726","resolution":{"observed_at":"2026-05-11T01:36:53.683460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":"5a0b7cb4-e357-41c9-9a88-faabd5ef761f","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:6e314aec2e5a203d0ffd4a70039cd14b366519db32dc9098616d88efe737b347","observation_id":"b9f91b42-9989-4c9f-8058-21cf8735e15f","resolution":{"observed_at":"2026-05-11T01:36:53.689105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19325","last_updated":"2025-05-18T02:27:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T03:38:06Z","title":"Long-Context Autoregressive Video Modeling with Next-Frame Prediction","version":3},"cited_work":{"arxiv_id":"2503.19325","doi":"10.48550/arxiv.2503.19325","metadata_source":"pith","pith_arxiv_id":"2503.19325","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Long-Context Autoregressive Video Modeling with Next-Frame Prediction","venue":"cs.CV","work_id":"9700bbdc-df42-461a-81fa-b29ffe683326","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2503.19325","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:8f2ed546e5d997e22b3006a228c7d62423d5dc4784a2e638f2021ccd2ce33713","observation_id":"8b32dd3e-5116-4066-aa54-064ff8ce043c","resolution":{"observed_at":"2026-05-16T23:05:17.562899Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:e645825c1645dfaedf74d48de7f49d030daf77d0bc97c56e458c32866d451c12","observation_id":"a1b3dfd5-29ca-42fd-a9ab-c236b201591a","resolution":{"observed_at":"2026-05-11T01:36:53.314593Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10589","last_updated":"2025-03-13T17:40:07Z","snapshot_observed_at":"2026-08-07T17:06:18.944213Z","submitted_at":"2025-03-13T17:40:07Z","title":"Long Context Tuning for Video Generation","version":1},"cited_work":{"arxiv_id":"2503.10589","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.10589","snapshot_observed_at":"2026-07-04T08:59:42.126868Z","title":"Yoav HaCohen, Nisan Chiprut, Benny Brazowski, Daniel Shalem, Dudu Moshe, Eitan Richardson, Eran Levin, Guy Shiran, Nir Zabari, Ori Gordon, et al","venue":null,"work_id":"94a15b89-3e30-4736-9f73-4841caf301db","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2503.10589","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:ba1874a7d8f55bff3a4876954f2fd111eea3c61f5a4a34f4efbd283175ae55a7","observation_id":"6c0d6521-52c3-41c3-ad36-e9ab732fda96","resolution":{"observed_at":"2026-05-11T01:36:53.332342Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"f60e6aee-c0a6-4ef9-a5e6-adf6c0f3dc79","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:f096fb7af1d6c7d7be2ad7db9231265465494c6bdb25ae2839ca47ad85b2e44b","observation_id":"fc71d48b-529b-4e83-9108-e61b9287e9e6","resolution":{"observed_at":"2026-05-11T01:36:53.692750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":"2501.00103","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-07-09T07:56:04.699528Z","title":"LTX-Video: Realtime Video Latent Diffusion","venue":"cs.CV","work_id":"cee5c521-3ce9-466e-a035-1e42f89254f4","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:3bcbb4e55e70e826be2910e556ceb3bc8d3ade7bdbcb7fe63679307bd623ca66","observation_id":"b8bff021-56ef-4dd3-b0e8-76c5d9f66940","resolution":{"observed_at":"2026-05-11T10:36:12.849504Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2210.02303","doi":"10.48550/arxiv.2210.02303","metadata_source":"pith","pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","venue":"cs.CV","work_id":"bb20d241-dc6f-4b0a-b071-fd43a2cbd57f","year":2022},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:23417ed2723b99f0c1b790cb5a83879eb466e26f94b6684b2699a957b17094b0","observation_id":"9d2c2196-c7dd-43dd-bfa6-2c64d12c5592","resolution":{"observed_at":"2026-05-11T03:31:08.340948Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:49:59.676131+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:49:59.676131+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T07:20:47.456761Z","title":"Video diffusion models","venue":null,"work_id":"6e3d8807-8f09-4cec-8cef-4419ada7be28","year":2022},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:a6ad8d31656001ca469914cdf2349dc2bc72728e2d18e6951cd188e52c680374","observation_id":"1e071fa1-718f-4ae8-87de-ecb8e19fba9c","resolution":{"observed_at":"2026-05-11T01:36:53.695525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers","venue":null,"work_id":"6aab19b4-2fb0-48f1-a66e-64bf147bd8fe","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:47db3e60b0d62e41b5013344c772bf2dfe915483d9c984d51ec0fb51c297f4b8","observation_id":"399a6983-41fe-4dc7-8b94-b4972a0c692a","resolution":{"observed_at":"2026-05-11T01:36:53.698270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.07720","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:03:48.633048Z","title":"Acdit: Interpolating autoregressive conditional modeling and diffusion transformer.arXiv preprint arXiv:2412.07720","venue":null,"work_id":"610c8deb-5318-467a-910e-f05bb91c38ac","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:b66ad33b049211db7da9b03ae1edaca9cb4ee0c17b0d054a6c788fa6c6338746","observation_id":"101f224b-4c8b-4309-9077-2086249465a7","resolution":{"observed_at":"2026-05-11T01:36:53.163071Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The gan is dead; long live the gan! a modern gan baseline","venue":null,"work_id":"c2cbc19a-66f6-4d3e-9784-be43386ffde8","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:297aaf65e9bc055c269adb6bfa5883f1114e6be0ece4ddc8f37081c2a11817ea","observation_id":"38929b41-e337-4160-b77a-e0cf3fea77c6","resolution":{"observed_at":"2026-05-11T01:36:53.704912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19310","last_updated":"2024-10-25T05:41:28Z","snapshot_observed_at":"2026-08-09T12:23:19.322822Z","submitted_at":"2024-10-25T05:41:28Z","title":"Flow Generator Matching","version":1},"cited_work":{"arxiv_id":"2410.19310","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.19310","snapshot_observed_at":"2026-07-08T11:54:51.240089Z","title":"Flow generator matching","venue":"cs.CV","work_id":"3f277dcc-b94b-46e0-b6ba-c4ff79df8a51","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2410.19310","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:4e7f47ab824432dd560b7ca7ca979b149494ca2e5306466fb44ed71ebcb2ad98","observation_id":"d642d901-edfb-4a69-a41a-431413feaaba","resolution":{"observed_at":"2026-05-11T01:36:53.229361Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"VBench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"0b269d78-42f3-4323-a845-05ed08601717","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:a54c4ee710c0c48750c7cc80582126dca5a58fd35cfa98f6e234fcbbb2c06235","observation_id":"a8fb6ddb-650c-4056-8a61-6eed348891db","resolution":{"observed_at":"2026-05-11T01:36:53.710816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On stabilizing generative adversarial training with noise","venue":null,"work_id":"e7de632a-ce64-4d13-a645-bfc86786b04f","year":2019},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:a821217733d2d0a7b201e1c4b4ee053ecdb9ca487754374628d9f57e00835dff","observation_id":"7a79aa20-bc9e-42da-bb74-fec635a824c5","resolution":{"observed_at":"2026-05-11T01:36:53.713738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pyramidal flow matching for efficient video generative modeling","venue":null,"work_id":"ad21974f-074f-4f0a-881e-5b2f40bc1a61","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:0dc919817508769623a1bf1cfe7c501532cc8004d0babf9e497f900a89fe04cc","observation_id":"8172f34b-87f5-4ef5-a3b3-1ac7f0c75876","resolution":{"observed_at":"2026-05-11T01:36:53.720216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The relativistic discriminator: a key element missing from standard gan","venue":null,"work_id":"3248bf92-ba5b-46da-b8ac-d8e60ed10100","year":2019},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:fb703ffe8c1486b9d2e1cf831a3015472712155804bba1938baf3a77b42d514f","observation_id":"b21af946-7b2f-479d-9ed1-e7f30fb733fc","resolution":{"observed_at":"2026-05-11T01:36:53.727807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fifo-diffusion: Generating infinite videos from text without training","venue":null,"work_id":"fdd38992-20e3-4fef-9a83-fcaa0513498c","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:50790411d8558d47b6a357fc166279b94baea3580cfcb14bc75747b77f79c345","observation_id":"2e23d623-1742-462e-b251-c5a4cc82fcd0","resolution":{"observed_at":"2026-05-11T01:36:53.731088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Variational diffusion models","venue":null,"work_id":"0c715db8-93e7-42fc-ab04-b04073ab1395","year":2021},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:58f47774927d9cc29bee7fbee9d1f2b2e8b70a90dc98cbd95088bd0d8810db63","observation_id":"554f1112-236e-474d-a27b-6b1bdce732cd","resolution":{"observed_at":"2026-05-11T01:36:53.734189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Auto-encoding variational bayes","venue":null,"work_id":"0885ab33-cb9c-40ea-b98b-f6e378e2da30","year":2014},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:ec4e3d89965f1c00437b8b134239a5e1d117db81c884d942f5c9deda14f851d1","observation_id":"5cf920f1-7420-40fc-a61c-805c3bbe564c","resolution":{"observed_at":"2026-05-11T01:36:53.742529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videopoet: A large language model for zero-shot video generation","venue":null,"work_id":"6752e45d-e98f-4a33-b26e-2fb303164cbe","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:b9cbe3c84c789ab325519db084b8dee89bdb7e87fe22d5a2c6e8d011015c6c03","observation_id":"b12621ff-9b6e-4066-ab1d-45a2831bb9f5","resolution":{"observed_at":"2026-05-11T01:36:53.751295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":"2412.03603","doi":"10.48550/arxiv.2412.03603","metadata_source":"pith","pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","venue":"cs.CV","work_id":"881efa7e-7e73-4c66-9cc3-2803e551061c","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:4aa37c3af074ddecb71e7a33c5ac443f181d61a00370e9a878725856960d9c00","observation_id":"611dfa89-06ed-4ec1-ab3c-c1103e286331","resolution":{"observed_at":"2026-05-11T01:36:53.103420Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Professor forcing: A new algorithm for training recurrent networks","venue":null,"work_id":"8b5994af-40a4-41a4-b2fd-234787c7dd54","year":2016},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:47801afcad0dd2e123144e41f22b73150cfef7c1024887811229f8b9f5030616","observation_id":"c9dee08a-e030-46d0-a0aa-8421be56bfcc","resolution":{"observed_at":"2026-05-11T01:36:53.758248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Latency reducing in real-time internet video transport: A survey.SSRN 4654242","venue":null,"work_id":"b31e9263-d4da-4ff8-b3a5-0f72e31865e1","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:b2c8adf6978b945b86cacb8e2e16d00eb550a5c6bff8915c4dce7f602bd8569d","observation_id":"dadca4ad-3945-49c3-a53b-abc40088c4e0","resolution":{"observed_at":"2026-05-11T01:36:53.761842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00200","last_updated":"2025-04-24T20:02:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-28T21:38:17Z","title":"Unified Video Action Model","version":3},"cited_work":{"arxiv_id":"2503.00200","doi":"10.48550/arxiv.2503.00200","metadata_source":"pith","pith_arxiv_id":"2503.00200","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unified Video Action Model","venue":"cs.RO","work_id":"fb4cc512-d1d9-40f4-8854-d35950ad20b3","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2503.00200","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:d71323244eb5f3626c2064229141df4f6cb22f76f575e8bf5276d4706db3346b","observation_id":"8659c518-883f-4b35-b9e0-95f9366fb765","resolution":{"observed_at":"2026-05-13T17:50:29.857677Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Autoregressive image generation without vector quantization","venue":null,"work_id":"1e37722e-77da-4d59-8284-a4ef4d71fb56","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:ab28f170eab59b88931182e09ec4c6ce3bd01a247c8a561c5002f46164b171c9","observation_id":"ce8d7df8-0424-4072-a141-ba903e5fbc4c","resolution":{"observed_at":"2026-05-11T01:36:53.767027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Infinitenature-zero: Learning perpetual view generation of natural scenes from single images","venue":null,"work_id":"01178341-43a2-4b19-a8f0-c81532303dd1","year":2022},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:0c784c0fe5dcc21d8bb9a6c774c8527467da72fb3048cb9d39ae6db12d0c4c53","observation_id":"33810364-874c-4383-9762-f9f767abcb9d","resolution":{"observed_at":"2026-05-11T01:36:53.773986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Arlon: Boosting diffusion transformers with autoregressive models for long video generation","venue":null,"work_id":"944da326-13de-4ece-8a7a-fcd71cd8752c","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:a967943c0c8fc61570ba47ba71f16ac3aef243cdb1b9326ca71bbd7af8681e5b","observation_id":"37a04a05-ab1a-47d3-bbe3-ccc29c05950a","resolution":{"observed_at":"2026-05-11T01:36:53.778153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Looking backward: Streaming video-to-video translation with feature banks","venue":null,"work_id":"92e1a0ce-888c-43db-b1e8-6dbc674079b2","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:ca96040a11e89b3959f56a58cb9db50b15369d7117cf373ad70c1a7e61f0ba99","observation_id":"b2c22b4f-9df7-4a7d-83ba-66674e8f3bc7","resolution":{"observed_at":"2026-05-11T01:36:53.782926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.08316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:07:45.233309Z","title":"Diffusion adversarial post-training for one-step video generation","venue":null,"work_id":"62c7164b-8dc8-4fc0-898d-e70790cfb89c","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:2182c1b88f485e22122692bd7a4b378e24b7c6ded85e9d1f185d81a005531722","observation_id":"abc0b03f-aaba-4b43-98d5-5c975cdfacd3","resolution":{"observed_at":"2026-05-11T01:36:53.244388Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flow matching for generative modeling","venue":null,"work_id":"73e89498-c66c-4563-b003-deb9c9742110","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:e0344b55452837484c067b9bbfa91f89cd3868422ff8874cc23ca0ed63e70765","observation_id":"117e8110-0349-427e-9dd7-8484d5aaa26f","resolution":{"observed_at":"2026-05-11T01:36:53.789043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Infinite nature: Perpetual view generation of natural scenes from a single image","venue":null,"work_id":"53acc702-c1a2-48ae-9578-4501ceed70f2","year":2021},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:11a3de222cd5353480ef6787e1091f9ec33fec2365f3c01cc396f8028d2ddb0b","observation_id":"b218aaf5-5fde-473e-bd0e-fbf63e0b5bd0","resolution":{"observed_at":"2026-05-11T01:36:53.798208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20280","last_updated":"2024-10-26T21:12:32Z","snapshot_observed_at":"2026-07-06T19:40:12.973874Z","submitted_at":"2024-10-26T21:12:32Z","title":"MarDini: Masked Autoregressive Diffusion for Video Generation at Scale","version":1},"cited_work":{"arxiv_id":"2410.20280","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20280","snapshot_observed_at":"2026-07-01T19:16:00.498245Z","title":"Mardini: Masked autoregressive diffusion for video generation at scale","venue":null,"work_id":"c55eb05e-1cd3-4b08-8542-48c1765a085c","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2410.20280","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:759c4e81c8225e13b8a6252f7f3d21e40cdf8489a3bb9235a6da3531b99b6800","observation_id":"2338f9ea-a91d-416f-9df8-7d2b94a55ea3","resolution":{"observed_at":"2026-05-11T01:36:53.310698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":"6ae699e3-a9cf-4a35-b8a5-40500135b754","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:a8fc857cd2d2524bcee8c0edcb57e1d6a30ed5c160dfe21cfc8e9fd78977e2f9","observation_id":"a3ae60f9-d43b-4366-9343-ca4f327a1397","resolution":{"observed_at":"2026-05-11T01:36:53.808377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03160","last_updated":"2024-10-04T05:47:39Z","snapshot_observed_at":"2026-07-06T19:27:29.609371Z","submitted_at":"2024-10-04T05:47:39Z","title":"Redefining Temporal Modeling in Video Diffusion: The Vectorized Timestep Approach","version":1},"cited_work":{"arxiv_id":"2410.03160","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03160","snapshot_observed_at":"2026-07-01T14:05:46.681545Z","title":"Redefining temporal modeling in video diffusion: The vectorized timestep approach","venue":null,"work_id":"f589ff6b-3ac6-4f62-a1d1-ed6ae172e9f0","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2410.03160","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:34e99d489bd1b8c837400d55e211b29b17d602074c6c6e92d6904c63cb1de908","observation_id":"292f8333-52fc-4a42-b2fb-25b1522f83a3","resolution":{"observed_at":"2026-05-11T01:36:53.322526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05551","last_updated":"2024-06-08T18:57:13Z","snapshot_observed_at":"2026-07-06T18:27:36.903877Z","submitted_at":"2024-06-08T18:57:13Z","title":"Autoregressive Diffusion Transformer for Text-to-Speech Synthesis","version":1},"cited_work":{"arxiv_id":"2406.05551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.05551","snapshot_observed_at":"2026-07-03T03:27:35.627140Z","title":"Autoregressive diffusion transformer for text-to-speech synthesis","venue":null,"work_id":"5585ee67-b148-4f36-896c-88d83418d9f6","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2406.05551","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:dd565a750cb878d169f9bf9cf4603e2b03442ae370ef7340dc6b57862d2dd878","observation_id":"cda5b317-bf10-4a5b-9491-bd3be58499d9","resolution":{"observed_at":"2026-05-11T01:36:53.326258Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diff-instruct: A universal approach for transferring knowledge from pre-trained diffusion models","venue":null,"work_id":"52a0e499-f2fd-41bb-92d2-3285cf1f194b","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:2d5d4d5f1bda9f919905a8632d52c0beb8c43115e96d761dc56f520f520b1d67","observation_id":"b7037612-5123-46bb-a9fb-9c4cf779d2ec","resolution":{"observed_at":"2026-05-11T01:36:53.349945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"One-step diffusion distillation through score implicit matching.NeurIPS","venue":null,"work_id":"f946d526-f07a-427e-833e-1efe5fb1bc73","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:f75562a08fd08215f283a833f82c77e5c5085d2955efe9759ec7c95c58ce224a","observation_id":"983eb2a2-275c-4d1e-ab60-57ab3f01dfa6","resolution":{"observed_at":"2026-05-11T01:36:53.359229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Osv: One step is enough for high-quality image to video generation","venue":null,"work_id":"92eb7ffa-e029-4c59-a201-958c23e2d284","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:7afe60b0e3788a7bdece4523b31791b6e32dce8920428fb3677303d6d13f8a72","observation_id":"3f7af2ee-2f59-4648-b7ed-d2dcae36eb1b","resolution":{"observed_at":"2026-05-11T01:36:53.363130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The parallelism tradeoff: Limitations of log-precision transformers","venue":null,"work_id":"5680a0d2-8495-4a8b-8c8e-2e09dad7263e","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:ba335e362b388d8b9526215f3952fc84c74a4552b195c854c16a62a80d1f413e","observation_id":"d8465a89-4596-4f38-a887-e8364e504d10","resolution":{"observed_at":"2026-05-11T01:36:53.368181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Which training methods for gans do actually converge? InICML","venue":null,"work_id":"600d1e6a-4932-46c3-87d4-bd6c11b020e8","year":2018},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:a298893dfbd0353588c3f4b2291a20b84682d954dfd95f44e7c137fbbf7b53d5","observation_id":"83bcb66f-9bcb-40fa-9157-d651503fca81","resolution":{"observed_at":"2026-05-11T01:36:53.379636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20996","last_updated":"2025-04-29T17:59:45Z","snapshot_observed_at":"2026-08-07T15:58:06.814353Z","submitted_at":"2025-04-29T17:59:45Z","title":"X-Fusion: Introducing New Modality to Frozen Large Language Models","version":1},"cited_work":{"arxiv_id":"2504.20996","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.20996","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"X-fusion: Introducing new modality to frozen large language models","venue":null,"work_id":"5837507a-bf8a-4502-8243-56d4f6c8a35e","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2504.20996","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:a1c9db1549f806f20a65cbf02a7911708bf4cc8ec2e2663e3af81d03f72345d7","observation_id":"03b976e2-9cc8-4901-bbb0-4a0dfa934104","resolution":{"observed_at":"2026-05-11T01:36:53.126525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Elucidating the exposure bias in diffusion models","venue":null,"work_id":"f0c5668a-9042-4b7d-8d3d-2d74e399ca18","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:62bdfb7d57bbb2b24f55ee3190dce99973d3fd5b3f104b5aceea68834b0631b7","observation_id":"220e4f4e-c64e-415d-b524-c4d9be409050","resolution":{"observed_at":"2026-05-11T01:36:53.383705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Genie 2: A large-scale foundation world model","venue":null,"work_id":"2adb0b23-b288-45df-9d16-b9eb1e9be94c","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:5ffd96106a6f1a4840405275f2a7a958584509321b07839c56ef3fe2040ed97b","observation_id":"2d5885e6-95a0-44e4-a7b4-dd2b6534ac10","resolution":{"observed_at":"2026-05-11T01:36:53.391660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"7d9f1c7f-e539-43ba-9ab1-5324ec84f8bd","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:4caed7d9ca952256fa627972d6ea488427b6d49f589e63edd68283c19b93d633","observation_id":"651630fb-a745-42f4-a81e-da46e64fd150","resolution":{"observed_at":"2026-05-11T01:36:53.395586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20171","last_updated":"2025-05-26T16:12:41Z","snapshot_observed_at":"2026-08-10T14:47:31.651213Z","submitted_at":"2025-05-26T16:12:41Z","title":"Long-Context State-Space Video World Models","version":1},"cited_work":{"arxiv_id":"2505.20171","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20171","snapshot_observed_at":"2026-07-10T18:57:31.679784Z","title":"Long-context state-space video world models.ArXiv, abs/2505.20171","venue":"cs.CV","work_id":"c35e6872-01ea-417a-ba0f-442c82e051c5","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2505.20171","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:daeab437c484f5aee716cb989e7daf05121d3071809a65b0b7fdcb125e8a5132","observation_id":"1773a11a-af1e-4a1a-bcd0-d78ee8101786","resolution":{"observed_at":"2026-05-11T01:36:53.152030Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-10T21:41:31.247717Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":"2410.13720","doi":"10.48550/arxiv.2410.13720","metadata_source":"pith","pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Movie Gen: A Cast of Media Foundation Models","venue":"cs.CV","work_id":"a6a118b0-002f-4b19-881f-7f1183e0d7d8","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:5c023b78795b81eabc343c129ab19bd72a2d14d11f9a0c30b6ac9e4d5af22e15","observation_id":"9ef452e8-00bb-4656-8cfa-3fb41a957153","resolution":{"observed_at":"2026-05-11T14:16:26.778393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sequence level training with recurrent neural networks","venue":null,"work_id":"a1260251-9178-4aa2-987d-83e9411e1e0c","year":2016},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:3ae731e079831a0818f38a69782075afab6629c80a1cd95ac3a12986d60ae262","observation_id":"916f331a-be55-4cc5-819c-3341c42ac6a2","resolution":{"observed_at":"2026-05-11T01:36:53.399414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07737","last_updated":"2025-02-12T14:50:50Z","snapshot_observed_at":"2026-08-09T14:39:05.131807Z","submitted_at":"2025-02-11T17:57:53Z","title":"Next Block Prediction: Video Generation via Semi-Autoregressive Modeling","version":2},"cited_work":{"arxiv_id":"2502.07737","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07737","snapshot_observed_at":"2026-07-04T16:29:57.325994Z","title":"arXiv preprint arXiv:2502.07737 (2025) 30","venue":null,"work_id":"4696bd68-488d-48f9-ac0b-2fa808160ea2","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2502.07737","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:9a780ee7141376d91b7fc96bb1d660b4d84e4ae85dd2f39f5c6af65f26f9df7f","observation_id":"299005e7-5dae-43e3-a942-e23d7afb4a41","resolution":{"observed_at":"2026-05-11T01:36:53.205091Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rolling diffusion models","venue":null,"work_id":"cde175c5-b644-4d42-a41c-be0f3dfa22f5","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:aac024a35f47a8495bb0a431d7cd5ee7ad7e1493b22cd93a35610329e06c6dc0","observation_id":"98cd7701-8b35-48a6-9df4-a52742177621","resolution":{"observed_at":"2026-05-11T01:36:53.404530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Temporal generative adversarial nets with singular value clipping","venue":null,"work_id":"b5442e41-2af0-4c01-bf9b-ae51e1a4e39d","year":2017},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:aab1d7fdda85c43c956e38b9eb1d03f861fee6f2a81bc9a26abedf9e859d9553","observation_id":"5b63dcc8-4c1e-4621-8adc-2bde9313c94a","resolution":{"observed_at":"2026-05-11T01:36:53.413171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Magi-1: Autoregressive video generation at scale","venue":null,"work_id":"e330b981-775d-4c50-a898-0e605686404e","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:8213bd97e937c5605b08176b4e0d8cbb72c9c40a999c9fe0f710ca7cfa04fd96","observation_id":"1947f5b0-f4f9-45ea-a750-4f59853e09a4","resolution":{"observed_at":"2026-05-11T01:36:53.417632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast high-resolution image synthesis with latent adversarial diffusion distillation","venue":null,"work_id":"115a34ee-29ce-404c-b1f0-3ab6d814bed1","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:6d3be7d9bfee99afd31fd00818df0d8f2d7a17e98f32797fc6c596ba30dab7ea","observation_id":"68d7fe07-af11-469b-ab76-228fe8095649","resolution":{"observed_at":"2026-05-11T01:36:53.422328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generalization in generation: A closer look at exposure bias.EMNLP-IJCNLP 2019, page 157","venue":null,"work_id":"e9e43490-f126-4c86-acd1-0f3d25de8118","year":2019},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:51a74d540121f25d17f307d34b30c4dea018e7acf7e25e13b2d4582e1ad1131f","observation_id":"1d02ec0b-3299-48dd-ab03-8fc7d3e483ac","resolution":{"observed_at":"2026-05-11T01:36:53.445009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flashattention-3: Fast and accurate attention with asynchrony and low-precision","venue":null,"work_id":"fde09a24-edf3-4265-8e34-bd1788aaef34","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:c5573febdc9884912b7b66f08cf8e25d741cb672b7a5148981c652fb06934f71","observation_id":"f3c4ddbf-60ee-4b7e-8bca-fe0a1dade102","resolution":{"observed_at":"2026-05-11T01:36:53.449731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06764","last_updated":"2025-07-24T03:58:47Z","snapshot_observed_at":"2026-08-07T11:01:49.684719Z","submitted_at":"2025-02-10T18:44:25Z","title":"History-Guided Video Diffusion","version":2},"cited_work":{"arxiv_id":"2502.06764","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06764","snapshot_observed_at":"2026-07-08T03:24:28.724863Z","title":"History-Guided Video Diffusion","venue":"cs.LG","work_id":"7822dfb2-a168-4080-8673-2dfafbe1a2ab","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2502.06764","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:934c7df5eadddd5dddd6785e79850528c0e6110100da9338ed6f9f613ad6e3d1","observation_id":"1777d8df-4bcd-49fc-a8af-bb5eacbbf7a3","resolution":{"observed_at":"2026-05-16T12:00:14.880011Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T19:34:07.599986Z","title":"Consistency models","venue":null,"work_id":"71959eca-61a4-42da-acad-7ffc193582d1","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:edc78782c899c6e89e36b3f4e2033c84b8746a12f1176fa78d2f41c88b198fd5","observation_id":"3e98f328-1a98-4216-b28a-6815cceb434c","resolution":{"observed_at":"2026-05-11T01:36:53.457805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Maximum likelihood training of score-based diffusion models","venue":null,"work_id":"34372b3b-889b-4ed4-9026-0899889a583a","year":2021},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:cce9b343f7b57f63eb2750ebbe153461e54b7eb50d8509e05de41fc51fec1045","observation_id":"ee582ce0-91b3-46f8-bb0f-c66d3250575e","resolution":{"observed_at":"2026-05-11T01:36:53.461420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ar-diffusion: Asynchronous video generation with auto-regressive diffusion","venue":null,"work_id":"65cb5908-3054-4213-9c93-a6c6e62ec3b5","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:33584b5c210f4aba72273cb54e770264eaf0adff37e0b3ef574da6d00bf371a1","observation_id":"ca27b528-d215-4009-80b1-4922d894c60b","resolution":{"observed_at":"2026-05-11T01:36:53.468571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mocogan: Decomposing motion and content for video generation","venue":null,"work_id":"99e1d1c9-5772-473a-b481-2bfde018138d","year":2018},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:68e0240779ee345e65a77c0828cbdad937e1ccefa384f7713763a6470a124aa6","observation_id":"0bd09ef1-6f36-417b-884c-0158f601fb02","resolution":{"observed_at":"2026-05-11T01:36:53.472596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion models are real-time game engines","venue":null,"work_id":"bf20e15e-aff7-4b35-b551-853ad0dce87c","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:dd9ced38f5441e72f910c37d3e1909e91d29961aad6d6c75ccb6b74c2b0aeec7","observation_id":"55d1d800-fc8a-4dc1-a84c-7fa6ccaaeb2a","resolution":{"observed_at":"2026-05-11T01:36:53.476168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neural discrete representation learning","venue":null,"work_id":"67fd4470-3d20-4aad-8ea7-31ded9715dea","year":2017},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:5edc4861c737b9293be482e95639d485f8b4730c17488205b5b1939cbcdcb58a","observation_id":"56d7bea6-d033-49e2-a94f-98d43347a0d9","resolution":{"observed_at":"2026-05-11T01:36:53.480270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Phenaki: Variable length video generation from open domain textual descriptions","venue":null,"work_id":"77a6ff61-0cc4-489e-aabc-1e6c059352c4","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:198dc36f0f5934c699b6206f9fc03f83c5d813d012db4fcae4dc2b9b5b25774a","observation_id":"4455c6c9-c8c0-43c3-8a74-dd695ee4d22b","resolution":{"observed_at":"2026-05-11T01:36:53.484200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decomposing motion and content for natural video sequence prediction","venue":null,"work_id":"810ae4bb-7cd0-4b7b-985d-9490128a4b7b","year":2017},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:3036c02465837a2e09cf128fea6a95dbb4842d50e6b82b18e334539c39ba63f3","observation_id":"b1e4912e-2f5c-4ee9-bd7d-f14b4d0df936","resolution":{"observed_at":"2026-05-11T01:36:53.489761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generating videos with scene dynamics","venue":null,"work_id":"deb0881e-0ae8-49ff-9666-d0e3b7b50430","year":2016},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:d7f3d2242cf4affcd866a54a145add312309c86add3dd74afd271bad0c6b60ad","observation_id":"685f6623-835b-49fb-a1e5-5b86b80d4eb3","resolution":{"observed_at":"2026-05-11T01:36:53.493857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:a29257da5dd5499450d1571df81ed5f0374fd0ad8bbd73f27aa279a1d7c64a15","observation_id":"4de981b9-8abe-4236-8e5c-d11887423ac7","resolution":{"observed_at":"2026-05-11T01:36:53.111849Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.10704","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:47:05.844751Z","title":"Error analyses of auto-regressive video diffusion models: A unified framework","venue":null,"work_id":"784ecf0d-4ab1-47b6-8028-e930b78348f3","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:4ae5ce518e0478cd4abca1fe1cd6bae3492061a7b82508541983a8c07ff69642","observation_id":"60d57355-b178-4658-abad-247a631237e4","resolution":{"observed_at":"2026-05-11T01:36:53.120113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vidprom: A million-scale real prompt-gallery dataset for text-to-video diffusion models","venue":null,"work_id":"d6e21341-d576-4ab4-9ae7-079f96ee0a87","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:872ba63682ec3eacb1063199138443fe0421dab33352bbef9de6a4fa26b7051e","observation_id":"7737c95b-35ad-4a98-93be-f369df4416a4","resolution":{"observed_at":"2026-05-11T01:36:53.497778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02757","last_updated":"2025-04-02T07:57:32Z","snapshot_observed_at":"2026-08-08T15:15:02.406405Z","submitted_at":"2024-10-03T17:59:02Z","title":"Loong: Generating Minute-level Long Videos with Autoregressive Language Models","version":2},"cited_work":{"arxiv_id":"2410.02757","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.02757","snapshot_observed_at":"2026-07-04T08:59:42.133975Z","title":"LA VIE: High- quality video generation with cascaded latent diffusion models.International Journal of Computer Vision, 2024a","venue":null,"work_id":"457cd406-74c8-475f-8866-399412f2913b","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2410.02757","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:8800d599c9ff5c1d4360de8e49657a0ce2b0fcdfaa5261cad1cb04ce5ea4f83b","observation_id":"4dad1b58-0de1-4a3d-a9d1-2327fcd5b564","resolution":{"observed_at":"2026-05-11T01:36:53.131734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prolificdreamer: High-fidelity and diverse text-to-3d generation with variational score distillation.NeurIPS","venue":null,"work_id":"e640b0d6-988f-4aca-b505-75d7758a4155","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:6588cbf48609961db2b63814b59487939dfd221b9c31ceef291ce97d55f18aef","observation_id":"ef434170-3596-45f4-8e82-cfa23c33adb9","resolution":{"observed_at":"2026-05-11T01:36:53.509725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling autoregressive video models","venue":null,"work_id":"064d9e16-5f47-40f9-b78b-3a05174f187f","year":2020},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:3631ba7e786e55ea837f3fcc7121196c22c4c0e7514745bbe193bfae57490045","observation_id":"3248f5ef-1dfa-4a65-9ec5-bafca809dabe","resolution":{"observed_at":"2026-05-11T01:36:53.513910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Art-v: Auto-regressive text-to-video generation with diffusion models","venue":null,"work_id":"2aaaefa5-bae5-4a54-93d2-1a421ddadf5c","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:df7481432b99b9633eeca912d0c5370a8867e59e7800e428fa208d2824b1a72a","observation_id":"69c18a36-2a55-4cd2-9266-4e300e9b039a","resolution":{"observed_at":"2026-05-11T01:36:53.517718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ar-diffusion: Auto-regressive diffusion model for text generation","venue":null,"work_id":"47fb4cb6-d632-4c64-824b-c338fe817127","year":2023},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:d1151c3bf10c3944a8cc745a1b91ceab9f3f9bc8ea489ba65b2519e8242994ca","observation_id":"8e4c3dc0-b0b4-49cd-b975-d52a80857da8","resolution":{"observed_at":"2026-05-11T01:36:53.522615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Snapgen-v: Generating a five-second video within five seconds on a mobile device","venue":null,"work_id":"0827e31c-8f39-4e29-81fd-2476ef783cc2","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:d4973ca2d3cb029a0e897368bd9e3a0bc7363499d9be8c11459faec3f98ee958","observation_id":"f786153b-a237-454b-95bf-7deba8ddc8c9","resolution":{"observed_at":"2026-05-11T01:36:53.526953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T02:55:53.838612Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"da16d36a-7e50-4dad-868c-e15146ec79e0","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:d36706f78958f7f6f54429d5de69475df5baafdc9606905f7b8a610a2d216683","observation_id":"5420f233-904a-4f68-9178-aa32c62964c2","resolution":{"observed_at":"2026-05-11T01:36:53.536419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08151","last_updated":"2025-05-18T06:43:40Z","snapshot_observed_at":"2026-08-10T11:26:38.428251Z","submitted_at":"2024-10-10T17:36:15Z","title":"Progressive Autoregressive Video Diffusion Models","version":2},"cited_work":{"arxiv_id":"2410.08151","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.08151","snapshot_observed_at":"2026-07-03T01:07:30.542292Z","title":"arXiv preprint arXiv:2410.08151 , year=","venue":null,"work_id":"a5743ec3-75d5-42c2-a60f-4067e506dc8c","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2410.08151","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:457b991638513f2857f7321a840ae8eb53445fce231f79f111fa67017256664f","observation_id":"d325a6a4-0c08-4fc1-a512-a76d20bc2f51","resolution":{"observed_at":"2026-05-11T01:36:53.167878Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10157","last_updated":"2021-09-14T21:20:06Z","snapshot_observed_at":"2026-07-06T11:02:11.424356Z","submitted_at":"2021-04-20T17:58:03Z","title":"VideoGPT: Video Generation using VQ-VAE and Transformers","version":2},"cited_work":{"arxiv_id":"2104.10157","doi":"10.48550/arxiv.2104.10157","metadata_source":"pith","pith_arxiv_id":"2104.10157","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoGPT: Video Generation using VQ-VAE and Transformers","venue":"cs.CV","work_id":"703c74c3-fa5e-455c-8c00-697c83511fcf","year":2021},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2104.10157","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:cadb83fb607130b4ebb97f25aa640bb19dd62653e7aa1f28785d421752002f92","observation_id":"299e0be9-4709-4616-915b-6c0875ffcf4d","resolution":{"observed_at":"2026-05-13T17:24:33.857072Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:c057185b0ea94184da80ff8cd6e06605a6d79d6bc2bae8bac55d82f65c3c8d61","observation_id":"c6de5ddb-aaaf-4b27-9d49-93d8baaf8f71","resolution":{"observed_at":"2026-05-11T01:36:53.192810Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning interactive real-world simulators","venue":null,"work_id":"6cabe3c7-69ae-43f4-91fa-0a949464f3b0","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:8b3ed2802e501459829736b2c94182c349cea39039565b38abecd32368477874","observation_id":"4666ea00-a484-401c-9d8b-f11ee11cff2d","resolution":{"observed_at":"2026-05-11T01:36:53.539935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":"243cc86d-267b-4c6d-b9a2-5b33c528088b","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:02758568c38e4119e049f5ce6b75d7b78995008b29b5c6adcc93b31ba53ddf41","observation_id":"4ec8584c-f7a4-4a12-9425-39dbb2c54a0c","resolution":{"observed_at":"2026-05-11T01:36:53.543112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved distribution matching distillation for fast image synthesis.NeurIPS","venue":null,"work_id":"7a819198-6789-45ce-882a-2e7e52230725","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:80bbcc721071b7ff95183b1fc2e55ddea3786eb0b882e99dd21f50954a4bdeb6","observation_id":"f0a305a6-890c-4c82-84cc-2202cb18daf5","resolution":{"observed_at":"2026-05-11T01:36:53.546280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"One-step diffusion with distribution matching distillation","venue":null,"work_id":"ee612071-9c8d-40fe-8401-8161181d53c5","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:c3e1bad7ae9c439b8256907e8d3a6faf174c2fe371a4dcd60d019794f5de5b77","observation_id":"463b37c1-a6ae-40c8-9478-409b3bb78dac","resolution":{"observed_at":"2026-05-11T01:36:53.550824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T13:14:53.405958Z","title":"From slow bidirectional to fast autoregressive video diffusion models","venue":null,"work_id":"1e06e4b7-ac18-4aed-a586-6fba8e5da904","year":2025},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:51c85160096848f78ed7a94a3d1a48047a6661ad4cf86e5a2e11d4c7b170ecab","observation_id":"c711562d-03a8-44db-8caa-ead485d0be32","resolution":{"observed_at":"2026-05-11T01:36:53.553842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T00:07:53.851104Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":28,"verified_fuzzy":70},"total_outbound_references":113},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 113 outbound references and 100 inbound Pith citation observations for arXiv:2506.08009."}