{"as_of":"2026-08-21T10:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3264e32c5af85a08bab550de821feadfbcabece821976d85bed47a5d9445a2d1","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:17:41.946523Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":33,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:40:46.929553Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-07T14:03:48.589989Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-07T14:03:15.086030Z","title":"Ca2-vdm: Efficient autoregres- sive video diffusion model with causal generation and cache sharing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20171","last_updated":"2025-05-26T16:12:41Z","snapshot_observed_at":"2026-08-18T01:48:22.016333Z","submitted_at":"2025-05-26T16:12:41Z","title":"Long-Context State-Space Video World Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:15.086030Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2505.20171"},"observation_digest":"sha256:611887ebd4398b1f3acb6932212ff34aae644d59a02df880125dead4402097ca","observation_id":"f233286d-4875-406a-85c5-81bd97b25165","resolution":{"observed_at":"2026-08-07T14:03:15.086030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-07T10:28:37.670335Z","title":"Ca2- vdm: Efficient autoregressive video diffusion model with causal generation and cache sharing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05284","last_updated":"2025-06-05T17:42:34Z","snapshot_observed_at":"2026-08-10T16:56:54.588021Z","submitted_at":"2025-06-05T17:42:34Z","title":"Video World Models with Long-term Spatial Memory","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:37.670335Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2506.05284"},"observation_digest":"sha256:7f6de29a4fb33448ea6643c7cf3e07298716b4b39d5db16a614769c4d724cb43","observation_id":"80aac502-dcbf-4189-9864-0b149aa2a270","resolution":{"observed_at":"2026-08-07T10:28:37.670335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-15T15:02:59.826496Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-11T01:36:53.029590Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2506.08009"},"observation_digest":"sha256:c2d46f0012839b3c768bc6aee06d91a78b8b4b399ed4ccb6c64d5d6d3ed0e181","observation_id":"4f9735f1-ae02-45dc-8a3d-0ad4c05d0e04","resolution":{"observed_at":"2026-05-11T01:36:53.142419Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-07T00:15:37.775719Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14769","last_updated":"2025-08-09T11:31:44Z","snapshot_observed_at":"2026-08-17T21:56:16.787726Z","submitted_at":"2025-06-17T17:59:12Z","title":"CDP: Towards Robust Autoregressive Visuomotor Policy Learning via Causal Diffusion","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:37.775719Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2506.14769"},"observation_digest":"sha256:13711f5bc64cff710b16b44c896c0507108f5d32e50c09fdffaa593d2d0b7bf6","observation_id":"bc9f614f-4af4-4006-b277-df5a71160220","resolution":{"observed_at":"2026-08-07T00:15:37.775719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-06T16:39:23.020880Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-17T17:09:42.493624Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:23.020880Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:d087824f56433c1d3d9eec389187bced9b55c5be3b79d423845123ff6803eab3","observation_id":"d2d60708-f89c-49fe-9fa1-029466172e46","resolution":{"observed_at":"2026-08-06T16:39:23.020880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2509.18611","last_updated":"2026-04-20T01:36:57Z","snapshot_observed_at":"2026-08-11T05:09:08.910867Z","submitted_at":"2025-09-23T04:00:41Z","title":"Flow marching for a generative PDE foundation model","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-18T13:48:14.532529Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2509.18611"},"observation_digest":"sha256:ef03acdf1f976d8a785ca20c6c5e4f772295ffb31def5110267ac3d0780f9bf3","observation_id":"9bc497ef-ca4b-4856-b249-1f3b39a4cda1","resolution":{"observed_at":"2026-05-18T13:51:25.606866Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-03T15:46:07.054788Z","title":"Ca2-vdm: Efficient autoregressive video diffusion model with causal generation and cache sharing.arXiv preprint arXiv:2411.16375, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.15702","last_updated":"2026-07-01T03:39:09Z","snapshot_observed_at":"2026-08-06T15:52:47.972204Z","submitted_at":"2025-12-17T18:53:29Z","title":"End-to-End Training for Autoregressive Video Diffusion via Self-Resampling","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T15:46:07.054788Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2512.15702"},"observation_digest":"sha256:864754f3f143b47d24863978205a3f11c84564c2421848153a6b67a596b21899","observation_id":"5b202109-498a-41b2-baf2-42ba1e416eb5","resolution":{"observed_at":"2026-08-03T15:46:07.054788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-03T04:33:10.693871Z","title":"Ca2-vdm: Efficient autoregressive video diffusion model with causal generation and cache sharing.arXiv preprint arXiv:2411.16375,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.04789","last_updated":"2026-08-01T03:31:24Z","snapshot_observed_at":"2026-08-14T03:16:52.896793Z","submitted_at":"2026-02-04T17:41:53Z","title":"Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T04:33:10.693871Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2602.04789"},"observation_digest":"sha256:94bb4ffbae634a4f62f0c6c4b7ea22e81d067c08471a4dcb63b9c4c23b5c61b0","observation_id":"e77cfe51-8f5a-4821-9221-44e927289657","resolution":{"observed_at":"2026-08-03T04:33:10.693871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-04T00:38:16.421515Z","title":"Ca2-vdm: Efficient autoregressive video diffusion model with causal generation and cache sharing.arXiv preprint arXiv:2411.16375,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.04789","last_updated":"2026-08-01T03:31:24Z","snapshot_observed_at":"2026-08-14T03:16:52.896793Z","submitted_at":"2026-02-04T17:41:53Z","title":"Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T00:38:16.421515Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2602.04789"},"observation_digest":"sha256:06106b21dd3a0ebc0e59585f39416d608c4814d60e4ca41b81788cf4eef20fa6","observation_id":"c8362b4e-f1dc-4a15-b6e5-36187eccc7b1","resolution":{"observed_at":"2026-08-04T00:38:16.421515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2602.07775","last_updated":"2026-05-03T01:49:14Z","snapshot_observed_at":"2026-08-15T00:49:04.808892Z","submitted_at":"2026-02-08T02:16:02Z","title":"Rolling Sink: Bridging Limited-Horizon Training and Open-Ended Testing in Autoregressive Video Diffusion","version":6},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T07:02:38.876518Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2602.07775"},"observation_digest":"sha256:27dd0928166a62fd11995aa55d6563a315bd8bae2b321828bd6f607a13aed154","observation_id":"ca5e67c7-1c22-4fc3-bb25-1b835f594f37","resolution":{"observed_at":"2026-05-16T07:07:29.899500Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2602.11229","last_updated":"2026-05-06T20:12:38Z","snapshot_observed_at":"2026-08-11T07:19:31.817761Z","submitted_at":"2026-02-11T15:34:52Z","title":"Latent Generative Solvers for Generalizable Long-Term Physics Simulation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T05:21:13.280286Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2602.11229"},"observation_digest":"sha256:5a863ce626b28ca0c162a8a94c7a053018f51138f30419d2026f737a5133d221","observation_id":"759246b3-d963-473b-a31a-e2b2d711c9ff","resolution":{"observed_at":"2026-05-16T05:22:22.564867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2602.15922","last_updated":"2026-02-17T15:04:02Z","snapshot_observed_at":"2026-08-09T12:54:21.149243Z","submitted_at":"2026-02-17T15:04:02Z","title":"World Action Models are Zero-shot Policies","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T16:18:15.003371Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2602.15922"},"observation_digest":"sha256:b12a343bde8df611cce752957c43aeb2bd67a0da4e1ef0532f4bc5b38655ee64","observation_id":"7fcb2080-e596-4527-b256-dea7d962cfb3","resolution":{"observed_at":"2026-05-11T16:18:15.925581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2603.17812","last_updated":"2026-04-07T18:00:52Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:04:57Z","title":"ChopGrad: Pixel-Wise Losses for Latent Video Diffusion via Truncated Backpropagation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T09:42:26.074609Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2603.17812"},"observation_digest":"sha256:d7dc01c9adb8b47a0481a07f5f4e3722afe7c3edf3e3bc2e6a96666331cdcad4","observation_id":"d6b0969c-bd83-4a35-846b-a0c85c5cf219","resolution":{"observed_at":"2026-05-15T09:45:23.285493Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2604.07209","last_updated":"2026-04-13T13:03:18Z","snapshot_observed_at":"2026-08-18T15:38:48.854766Z","submitted_at":"2026-04-08T15:31:22Z","title":"INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T19:08:56.588282Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2604.07209"},"observation_digest":"sha256:4f1137824c5a14a32beeef7f202702fac73c8e265ae441ba8a1dca36931a4eda","observation_id":"82e72f8e-d72b-4b24-8c4f-2e8523944d3d","resolution":{"observed_at":"2026-05-10T23:25:53.514242Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2604.15911","last_updated":"2026-04-17T10:11:39Z","snapshot_observed_at":"2026-08-20T15:11:48.430991Z","submitted_at":"2026-04-17T10:11:39Z","title":"Efficient Video Diffusion Models: Advancements and Challenges","version":1},"reference_index":274,"source":"pdf_text","source_observed_at":"2026-05-10T08:28:29.706249Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2604.15911"},"observation_digest":"sha256:3c39f2c6e167940736f42b0f55bf719c4aa2ed45741370878dfb882d555bfc5b","observation_id":"076b2ddf-a4f8-417b-ba6d-754b106dced9","resolution":{"observed_at":"2026-05-10T09:03:26.211296Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2605.04461","last_updated":"2026-05-06T03:40:05Z","snapshot_observed_at":"2026-08-01T01:47:15.158535Z","submitted_at":"2026-05-06T03:40:05Z","title":"Stream-T1: Test-Time Scaling for Streaming Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T18:16:14.985693Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2605.04461"},"observation_digest":"sha256:d0da25041a6faf239f7bb91172b95aec7585029dc0b61ebecde3908d6eae208c","observation_id":"62b5c462-02c7-4d39-970d-8885c0eaeed1","resolution":{"observed_at":"2026-05-09T06:40:39.381562Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2605.14487","last_updated":"2026-05-14T07:27:39Z","snapshot_observed_at":"2026-08-11T04:01:43.208982Z","submitted_at":"2026-05-14T07:27:39Z","title":"Head Forcing: Long Autoregressive Video Generation via Head Heterogeneity","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T02:31:48.593354Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2605.14487"},"observation_digest":"sha256:4b7df13f5eb353319ab544791b0bacd8c2ef58447c238dfb7d983675ac34a7f4","observation_id":"0463eeab-4d57-4e39-b9f3-e3db5f6d7b28","resolution":{"observed_at":"2026-05-15T02:33:32.281615Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2605.15824","last_updated":"2026-06-17T15:16:37Z","snapshot_observed_at":"2026-08-16T00:30:22.953814Z","submitted_at":"2026-05-15T10:25:06Z","title":"FashionChameleon: Towards Real-Time and Interactive Human-Garment Video Customization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-20T20:11:33.277349Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2605.15824"},"observation_digest":"sha256:2f4fc7c52cef41d45bbf4e7cb7632fc56665e6ad4ef3f3c818088571e208d0c1","observation_id":"3301eccd-ccc9-44a7-835b-c2661441dc68","resolution":{"observed_at":"2026-05-20T20:13:43.560960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2605.15824","last_updated":"2026-06-17T15:16:37Z","snapshot_observed_at":"2026-08-16T00:30:22.953814Z","submitted_at":"2026-05-15T10:25:06Z","title":"FashionChameleon: Towards Real-Time and Interactive Human-Garment Video Customization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-30T19:23:07.044659Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2605.15824"},"observation_digest":"sha256:0c06c40349fb69b59e130d498d454ee0d5f3c5e0301ba862941355be6539d83e","observation_id":"4c354c30-61e1-4c92-999c-6620fc5c2628","resolution":{"observed_at":"2026-06-30T19:25:00.605936Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2605.17543","last_updated":"2026-05-23T05:05:23Z","snapshot_observed_at":"2026-08-01T03:51:15.108762Z","submitted_at":"2026-05-17T16:52:38Z","title":"HL-OutPaint: Coarse-to-Fine Video Outpainting for High-Resolution Long-Range Videos","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-20T13:32:36.375456Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2605.17543"},"observation_digest":"sha256:b1a8434db8136d0bdc7022a2a3ac47440296f2dad0a51bce49d44e9f326827af","observation_id":"e4ea9939-6545-4d78-be35-9ee771891979","resolution":{"observed_at":"2026-05-20T13:33:18.992886Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2606.02491","last_updated":"2026-06-01T17:01:21Z","snapshot_observed_at":"2026-08-03T04:26:51.126265Z","submitted_at":"2026-06-01T17:01:21Z","title":"MORPHOS: Autoregressive 4D Generation with Temporal Structured Latents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T15:03:22.366584Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2606.02491"},"observation_digest":"sha256:8dcef074cdc51c5777208e87c1fa311da1bf8ef9d4ac69e4d1a0a05e7c373de5","observation_id":"a36d3999-c64e-4578-9e3b-d52981915024","resolution":{"observed_at":"2026-07-01T22:46:19.522972Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2606.27964","last_updated":"2026-06-26T11:08:09Z","snapshot_observed_at":"2026-08-08T15:58:26.026893Z","submitted_at":"2026-06-26T11:08:09Z","title":"Directing the World: Fast Autoregressive Video Generation with Compositional Human-Camera Control","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-29T05:03:56.624536Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2606.27964"},"observation_digest":"sha256:71d1510172c22364e805a2d6466f6057987b9d0b259fca8c17fedd730e5f1d47","observation_id":"fa469b43-2e86-4cab-ad9d-db4477d7eb1c","resolution":{"observed_at":"2026-06-29T18:43:51.098440Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2606.28016","last_updated":"2026-07-02T07:14:50Z","snapshot_observed_at":"2026-08-13T21:13:38.544939Z","submitted_at":"2026-06-26T12:19:28Z","title":"TempAct: Advancing Temporal Plausibility in Autoregressive Video Generation via Planner-Executor RL","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T04:46:48.414652Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2606.28016"},"observation_digest":"sha256:f024aa84ced3500c213518dcf8ae5d936aa0971c8c9d6e11e868f74844751525","observation_id":"57f5c1b1-aa72-436b-b682-d0ccee7287f9","resolution":{"observed_at":"2026-06-29T19:13:53.604394Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2606.28016","last_updated":"2026-07-02T07:14:50Z","snapshot_observed_at":"2026-08-13T21:13:38.544939Z","submitted_at":"2026-06-26T12:19:28Z","title":"TempAct: Advancing Temporal Plausibility in Autoregressive Video Generation via Planner-Executor RL","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-03T22:38:33.557109Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2606.28016"},"observation_digest":"sha256:389a8b63b8ae92d1f5b8f75e5ba8a3313f57653b54e9ca58913cea4f0dcc5e9b","observation_id":"4794075d-da37-469e-b6d8-acb19dd855b2","resolution":{"observed_at":"2026-07-03T22:39:00.994390Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2606.30292","last_updated":"2026-06-29T13:35:44Z","snapshot_observed_at":"2026-08-15T15:25:43.071632Z","submitted_at":"2026-06-29T13:35:44Z","title":"DreamForge-World 0.1 Preview: A Low-Compute Real-Time Controllable World Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T07:32:03.567262Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2606.30292"},"observation_digest":"sha256:3169f5a0b0645f910a1f86255f4f09a049e8883ba3f3451ae0fa8a2269e72524","observation_id":"fcfb7cc4-8a79-4f78-b3e0-1d7df73b92b9","resolution":{"observed_at":"2026-06-30T07:34:21.442236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2607.01060","last_updated":"2026-07-15T03:57:18Z","snapshot_observed_at":"2026-08-15T15:33:44.319453Z","submitted_at":"2026-07-01T15:22:41Z","title":"RoboWorld: Fast and Reliable Neural Simulators for Generalist Robot Policy Evaluation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-02T11:21:32.725966Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2607.01060"},"observation_digest":"sha256:52d6c6306edca7db2b2237087acc159946a23e4a13c25478ed1af9231205ae16","observation_id":"e150c102-7f76-4788-b173-fb78bf046fbf","resolution":{"observed_at":"2026-07-02T11:26:53.857256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-14T16:48:30.512494Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.01060","last_updated":"2026-07-15T03:57:18Z","snapshot_observed_at":"2026-08-15T15:33:44.319453Z","submitted_at":"2026-07-01T15:22:41Z","title":"RoboWorld: Fast and Reliable Neural Simulators for Generalist Robot Policy Evaluation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-14T16:48:30.512494Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2607.01060"},"observation_digest":"sha256:343989a9d72b5af1ba95b7dbdb632690348a65d69a7added57f545398d5435b5","observation_id":"37279416-c207-4d80-8e26-1e27e76ef556","resolution":{"observed_at":"2026-07-14T16:48:30.512494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-15T15:40:46.929553Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.01060","last_updated":"2026-07-15T03:57:18Z","snapshot_observed_at":"2026-08-15T15:33:44.319453Z","submitted_at":"2026-07-01T15:22:41Z","title":"RoboWorld: Fast and Reliable Neural Simulators for Generalist Robot Policy Evaluation","version":4},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T15:40:46.929553Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2607.01060"},"observation_digest":"sha256:44f9118dd21f297ab78c353f3abcd6424e949b23552b8f59b36e6dc8c19c7b14","observation_id":"1fb307db-2d00-4d64-90d0-1e596cf49863","resolution":{"observed_at":"2026-08-15T15:40:46.929553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":"2411.16375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-07-07T14:03:48.589989Z","title":"Ca2-vdm: Efficient autore- gressive video diffusion model with causal generation and cache sharing","venue":"cs.CV","work_id":"64a14619-a1b0-45bc-acdb-eda16e69490c","year":2024},"citing_paper":{"arxiv_id":"2607.05376","last_updated":"2026-07-06T17:54:16Z","snapshot_observed_at":"2026-07-09T23:18:25.821956Z","submitted_at":"2026-07-06T17:54:16Z","title":"MV-Forcing: Long Multi-View Video Generation via 4D-Grounded Spatio-Temporal Self-Forcing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-07T13:58:13.194386Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2607.05376"},"observation_digest":"sha256:cbf0f7291c3129f3065add5354565504092500e9da15934e67ff5026002c476a","observation_id":"c9783dbd-9e12-48b7-94f8-1d58a3c5ce84","resolution":{"observed_at":"2026-07-07T14:03:48.593218Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-01T00:52:24.924518Z","title":"Ca2-vdm: Efficient autoregressive video diffusion model with causal generation and cache sharing.arXiv preprint arXiv:2411.16375,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26037","last_updated":"2026-07-28T17:45:25Z","snapshot_observed_at":"2026-08-19T07:03:31.070300Z","submitted_at":"2026-07-28T17:45:25Z","title":"Wonder: Video World Model Done Better","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T00:52:24.924518Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2607.26037"},"observation_digest":"sha256:8fa601f8c325ad7c967e6b7edab03abfc1647f1e8a58b5825d0fce9d0d12096f","observation_id":"c3ac8b02-b32a-4811-80a2-7b0eab42580b","resolution":{"observed_at":"2026-08-01T00:52:24.924518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-06T00:31:24.245292Z","title":"Ca2-vdm: Efficient autoregressive video diffusion model with causal generation and cache sharing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01127","last_updated":"2026-08-04T04:32:45Z","snapshot_observed_at":"2026-08-20T19:30:13.754035Z","submitted_at":"2026-08-02T09:57:02Z","title":"MiniWorld: Democratizing the Training of Video World Models from Scratch","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:31:24.245292Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2608.01127"},"observation_digest":"sha256:9c74b7549b5b912895e2b177b4d1090ca35b958f52aebf88bea5ffe549315c46","observation_id":"b5138675-3957-4e47-ba3f-3a01b3ffe7a2","resolution":{"observed_at":"2026-08-06T00:31:24.245292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-15T14:26:02.465168Z","title":"Ca2-vdm: Efficient autoregres- sive video diffusion model with causal generation and cache sharing.arXiv preprint arXiv:2411.16375, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10439","last_updated":"2026-08-11T03:39:05Z","snapshot_observed_at":"2026-08-20T12:38:47.927127Z","submitted_at":"2026-08-11T03:39:05Z","title":"Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:26:02.465168Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2608.10439"},"observation_digest":"sha256:f6c0c4e2f388b42e7d55b944ef91c2739d2a54dbc8a4242fa5061aa36d1b5950","observation_id":"9826d9b3-6cff-4d49-b97a-d4a3a2b57671","resolution":{"observed_at":"2026-08-15T14:26:02.465168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16375","snapshot_observed_at":"2026-08-14T12:17:52.836008Z","title":"Ca2-vdm: Ef- ficient autoregressive video diffusion model with causal generation and cache sharing.arXiv preprint arXiv:2411.16375, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13391","last_updated":"2026-08-13T15:51:31Z","snapshot_observed_at":"2026-08-16T23:51:49.758110Z","submitted_at":"2026-08-13T15:51:31Z","title":"Context-Matched Distillation: Teacher Causality for Autoregressive Video Distillation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T12:17:52.836008Z"},"links":{"cited_paper":"/paper/2411.16375","citing_paper":"/paper/2608.13391"},"observation_digest":"sha256:987b29cb2f81565e4eea95e963102e11872dc75898e7c293c78b3c856e308ec7","observation_id":"6bfa884f-388a-4dc2-948e-d44ba3e69bdc","resolution":{"observed_at":"2026-08-14T12:17:52.836008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.16375/citation-record","integrity":"/paper/2411.16375/integrity","json":"/paper/2411.16375/citation-record.json","paper":"/paper/2411.16375"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.15813","last_updated":"2023-11-27T13:39:44Z","snapshot_observed_at":"2026-08-20T14:31:07.917172Z","submitted_at":"2023-11-27T13:39:44Z","title":"FlowZero: Zero-Shot Text-to-Video Synthesis with LLM-Driven Dynamic Scene Syntax","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15813","snapshot_observed_at":"2026-08-12T13:17:41.872257Z","title":"Flowzero: Zero-shot text-to-video synthesis with llm-driven dynamic scene syntax","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.872257Z"},"links":{"cited_paper":"/paper/2311.15813","citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:5228b6c0673b753d22e2ee47616b026896905d8842251eac1d7ff4b9744904e2","observation_id":"194c750c-ccc7-4468-a694-67d33009b31f","resolution":{"observed_at":"2026-08-12T13:17:41.872257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:17:42.246343Z","title":"Videofusion: Decomposed diffusion models for high-quality video generation","venue":null,"work_id":"8aca796f-a2d6-4611-a567-26d9546a44f3","year":2023},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.877000Z"},"links":{"citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:b3f8c78f9165fe4692586b00e14690140973fa3949e5fa804af9622896df510c","observation_id":"6234e286-06c3-48d7-a0c4-cb071354b5e5","resolution":{"observed_at":"2026-08-12T13:17:42.250515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:17:42.233970Z","title":"Stylegan- v: A continuous video generator with the price, image quality and perks of stylegan2","venue":null,"work_id":"7403d5e2-a914-451a-b012-24c20c3026ba","year":2022},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.881586Z"},"links":{"citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:509af3cb68945104d33f0c06574b47bea377ca73e4825e6d49e50035badb5952","observation_id":"4ba91052-d0b2-4530-b6c4-1e5368d5aeab","resolution":{"observed_at":"2026-08-12T13:17:42.238276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18264","last_updated":"2023-05-29T17:38:18Z","snapshot_observed_at":"2026-08-18T16:07:07.101501Z","submitted_at":"2023-05-29T17:38:18Z","title":"Gen-L-Video: Multi-Text to Long Video Generation via Temporal Co-Denoising","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18264","snapshot_observed_at":"2026-08-12T13:17:41.895638Z","title":"Gen-l-video: Multi-text to long video generation via temporal co-denoising","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.895638Z"},"links":{"cited_paper":"/paper/2305.18264","citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:f4d738772584f57eb4bb7b86320691c713bc8f2de033665620b0cf8dab9fa9fe","observation_id":"6487a23f-d84f-4c4d-9561-9a022dbf9b4e","resolution":{"observed_at":"2026-08-12T13:17:41.895638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08701","last_updated":"2024-07-11T17:34:51Z","snapshot_observed_at":"2026-08-16T13:34:59.705524Z","submitted_at":"2024-07-11T17:34:51Z","title":"Live2Diff: Live Stream Translation via Uni-directional Attention in Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08701","snapshot_observed_at":"2026-08-12T13:17:41.900937Z","title":"Live2diff: Live stream translation via uni-directional attention in video diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.900937Z"},"links":{"cited_paper":"/paper/2407.08701","citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:c36106cd34e71084a660d327c506253f9ed18aec34df33516e39d59a7da0b830","observation_id":"c641ef26-45f0-4153-b476-ae169edd4f44","resolution":{"observed_at":"2026-08-12T13:17:41.900937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:17:42.208786Z","title":"Detailed Training Objectives Recall that (cf","venue":null,"work_id":"17f2ebac-c2a4-497f-9b6b-4cb57d62341a","year":2020},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.912253Z"},"links":{"citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:dff8a4790156c30d50a71778e80a14b27844fc2fc52b3e4714883092a600d72a","observation_id":"f71f2c5c-8d78-4e8a-9b06-5f24c7ced382","resolution":{"observed_at":"2026-08-12T13:17:42.213116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:17:42.196766Z","title":"(6) Since q and pθ are both Gaussian, DKL is determined by the mean µθ and covariance Σθ","venue":null,"work_id":"31c02a2b-e563-4294-ba1a-5c1ffdc5abb2","year":2020},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.916414Z"},"links":{"citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:2afe61ed3992a0f480034367e270db377da4d9c63b0d3268b3babd43e11f7a6e","observation_id":"4b9ec7c7-b9a2-4ced-8f22-ec60238c960d","resolution":{"observed_at":"2026-08-12T13:17:42.200788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:17:42.170636Z","title":"UCF101 (Soomro et al., 2012)","venue":null,"work_id":"9b2c18cd-a098-4848-9075-878dab0e7e94","year":2012},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.926030Z"},"links":{"citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:51632e02cb6f3bb6a6d5d2974527a7bd2b3c4e89e0c5213f554fb923ec29b312","observation_id":"140c8a1b-b74b-4553-9e53-33a4d52b8239","resolution":{"observed_at":"2026-08-12T13:17:42.174766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:17:42.145616Z","title":"the first AR step","venue":null,"work_id":"14886816-9b0b-49bd-a3c8-1305ee60f830","year":2025},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.934408Z"},"links":{"citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:bad2cb707e60d5022eea1303e5b0608899b08ed4e6ccb37c5c7b4bb7112a8a4a","observation_id":"d94123b4-342e-4fbb-91a6-6ef3eba00802","resolution":{"observed_at":"2026-08-12T13:17:42.149972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:17:42.132130Z","title":"VBench is pri- marily designed for text-to-video evaluation","venue":null,"work_id":"dfe836e1-a2ad-4176-a026-c98c7384c248","year":2025},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.938298Z"},"links":{"citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:1840cfb602abefc86ec67c33614015201680f7c41d5e2e17a07710c961a940b3","observation_id":"691f1efa-f1b2-4484-854d-4a19ac3262fb","resolution":{"observed_at":"2026-08-12T13:17:42.136769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:17:42.097313Z","title":null,"venue":null,"work_id":"045f7fc9-ec92-434e-9430-aea8b759ad60","year":2020},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.946523Z"},"links":{"citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:137bd798548c3cd228215595fe026455dcf8518c11d91f68453647f56b4a54d6","observation_id":"6272dc5d-cf28-43a0-bb03-4a95bc4181a2","resolution":{"observed_at":"2026-08-12T13:17:42.104629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:17:42.117698Z","title":"Method Aesthetic Imaging Motion Temporal Quality Quality Smoothness Flickering OS-Ext 44.39 50.74 98.93 98.57 Ca2-VDM 44.30 50.55 97.59 97.14 OS-Ext baseline","venue":null,"work_id":"5629f066-feb8-4ca7-8c7d-e572c807dbba","year":2024},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":256,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.941929Z"},"links":{"citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:ab233a3fd7d2f366e3a61a32d28ae9697faaf15af33ad4bec21ad383721f6ae5","observation_id":"d5fe8987-d9ed-498f-b2b1-eafd2b7f8cba","resolution":{"observed_at":"2026-08-12T13:17:42.123203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:17:42.221183Z","title":"Fvd: A new metric for video generation","venue":null,"work_id":"8a08db51-912d-4e94-b27a-bcb083eb746f","year":2019},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.890848Z"},"links":{"citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:6468ea68d6222562857923f05a130330964dd3a9e1cda2b88056555429890082","observation_id":"25028251-2f52-4166-a5f7-5deb884ed57d","resolution":{"observed_at":"2026-08-12T13:17:42.226059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-16T21:21:44.768787Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-12T13:17:41.886233Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.886233Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:c5b6056cb05bae3ef51c81db11e74ebd288e223c091991d78e8329bfac5f61d4","observation_id":"00316872-6dee-4c52-8ac8-59f10b20f853","resolution":{"observed_at":"2026-08-12T13:17:41.886233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:17:42.158686Z","title":"We followed prior works (Blattmann et al., 2023b; Ge et al., 2022; Ren et al.,","venue":null,"work_id":"712aab9d-478b-453e-bbb3-c36d2ac28465","year":2022},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.930503Z"},"links":{"citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:cf803c86a8c49019169c1ab3cb7a9dda54a153271e1aa852c287e800233822d7","observation_id":"6952da28-5f11-486c-a47a-a2b98f5c3a03","resolution":{"observed_at":"2026-08-12T13:17:42.162530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04145","snapshot_observed_at":"2026-08-12T13:17:41.906371Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.906371Z"},"links":{"cited_paper":"/paper/2311.04145","citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:e6706ac3b2f461b07cca6fd2df52c94d91c6525459abb8f5d712bcc5976020fe","observation_id":"c4c143c6-06d0-4e4f-8f81-814009148a4d","resolution":{"observed_at":"2026-08-12T13:17:41.906371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:17:42.183660Z","title":"A white tiger in a zoo swimming in a lake…","venue":null,"work_id":"8c3fc373-71ea-49d0-9fec-e5b266d06a34","year":2016},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.921214Z"},"links":{"citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:5fb567822893f3dbe32d2080279e7a6e3b401c010b3bc7545e37eece7bbe7ff9","observation_id":"3e2575e0-735c-4a0b-954a-33c95ab3eaf0","resolution":{"observed_at":"2026-08-12T13:17:42.187964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-08-17T16:16:01.560363Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-12T13:17:41.861604Z","title":"La- tent video diffusion models for high-fidelity long video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.861604Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:df61b3c59bd51f856e23b0780d73f2a37ec1b1b409d0b1568c9a0245ac596756","observation_id":"78c53871-ec54-46a2-8ef7-7592e89ca92c","resolution":{"observed_at":"2026-08-12T13:17:41.861604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12491","last_updated":"2025-07-08T17:45:49Z","snapshot_observed_at":"2026-08-19T22:45:24.812630Z","submitted_at":"2023-12-19T18:18:33Z","title":"StreamDiffusion: A Pipeline-level Solution for Real-time Interactive Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12491","snapshot_observed_at":"2026-08-12T13:17:41.866200Z","title":"Streamdiffusion: A pipeline-level solu- tion for real-time interactive generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.866200Z"},"links":{"cited_paper":"/paper/2312.12491","citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:06d35dd2c3153dc279225a5ea988dee2b9016ebbe9170170d699ec30ce77391f","observation_id":"968da582-aa1a-404c-bb2c-3491e5f0e446","resolution":{"observed_at":"2026-08-12T13:17:41.866200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-20T09:39:07.545813Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-12T13:17:41.855795Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:41.855795Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2411.16375"},"observation_digest":"sha256:fa7e9a71fc9fec2f7375f521a6debfdbc60b12003ad664f450f0bd2301be689c","observation_id":"9f6ae92b-648b-417e-bf98-e2782f8b95d1","resolution":{"observed_at":"2026-08-12T13:17:41.855795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.16375","last_updated":"2025-05-21T10:38:01Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T01:27:04.025030Z","submitted_at":"2024-11-25T13:33:41Z","title":"Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 33 inbound Pith citation observations for arXiv:2411.16375."}