{"as_of":"2026-08-08T18:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:92040ca10f9a3a395c70d05a487c5617d1084eec31d348eaf37e2773d8763b85","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":65,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:45:11.296944Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T09:49:44.815320Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-07T13:45:11.296944Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:11.296944Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:64103dd72d89c9f4595274cc4bbfd7c361c799f095ed99c6a757c3f719d7c1dc","observation_id":"28a836d7-a604-44bd-b446-d255f7676526","resolution":{"observed_at":"2026-08-07T13:45:11.296944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-07T13:44:50.914597Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21136","last_updated":"2025-06-06T07:47:22Z","snapshot_observed_at":"2026-08-07T16:39:52.214916Z","submitted_at":"2025-05-27T12:50:36Z","title":"SageAttention2++: A More Efficient Implementation of SageAttention2","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:50.914597Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2505.21136"},"observation_digest":"sha256:9ecf21aa22fa869e4f5599aeb0cc7967a11247a15e8e8d92b6bfa9842ab9709a","observation_id":"e310da7f-e507-47da-9b95-4f8ec4dc6b43","resolution":{"observed_at":"2026-08-07T13:44:50.914597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-07T11:15:17.692975Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03065","last_updated":"2025-06-03T16:42:37Z","snapshot_observed_at":"2026-08-08T15:50:29.003648Z","submitted_at":"2025-06-03T16:42:37Z","title":"Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion Transformers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:15:17.692975Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2506.03065"},"observation_digest":"sha256:eadb7ab6d203d1eddcbe3c7ccb4226432fcd24bbee66f70e09fe2fb5996b8150","observation_id":"e7e096eb-6989-47c4-b97d-ae330f0af6cf","resolution":{"observed_at":"2026-08-07T11:15:17.692975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-07T11:14:09.579398Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03123","last_updated":"2025-08-06T03:03:38Z","snapshot_observed_at":"2026-08-08T03:29:19.267049Z","submitted_at":"2025-06-03T17:55:04Z","title":"Dual-Expert Consistency Model for Efficient and High-Quality Video Generation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:09.579398Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2506.03123"},"observation_digest":"sha256:d31685dae2d45baa99e6dd1c1ca977dd72d5825b3ebc07bc4f2a48a084fe527a","observation_id":"8888815c-1f7c-436d-bf57-7b8b239f0207","resolution":{"observed_at":"2026-08-07T11:14:09.579398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-07T11:18:58.832753Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03275","last_updated":"2025-06-03T18:03:32Z","snapshot_observed_at":"2026-08-07T17:48:20.441137Z","submitted_at":"2025-06-03T18:03:32Z","title":"Chipmunk: Training-Free Acceleration of Diffusion Transformers with Dynamic Column-Sparse Deltas","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:18:58.832753Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2506.03275"},"observation_digest":"sha256:ec90cd01e19988df13a5cff6b900afdba1b8af70332c7ac860b4c163c08bbe55","observation_id":"0f8e8662-d508-44ac-99ac-8055f127d9e2","resolution":{"observed_at":"2026-08-07T11:18:58.832753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-06T23:51:05.488394Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16054","last_updated":"2025-06-19T06:25:02Z","snapshot_observed_at":"2026-08-07T13:41:59.610268Z","submitted_at":"2025-06-19T06:25:02Z","title":"PAROAttention: Pattern-Aware ReOrdering for Efficient Sparse and Quantized Attention in Visual Generation Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:05.488394Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2506.16054"},"observation_digest":"sha256:f875d541d38bfe556c86399e3902c8362ef0561d6eaa47ec8614cac603b4b0b9","observation_id":"eb3176f0-b26e-4050-811a-2033d5ee0502","resolution":{"observed_at":"2026-08-06T23:51:05.488394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-06T21:41:37.039836Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23618","last_updated":"2025-06-30T08:24:13Z","snapshot_observed_at":"2026-08-07T14:18:40.044917Z","submitted_at":"2025-06-30T08:24:13Z","title":"TurboVSR: Fantastic Video Upscalers and Where to Find Them","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T21:41:37.039836Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2506.23618"},"observation_digest":"sha256:920a1ef90463b5437aaa304a6dc04a49f466f7942c2e2eec6911ca289cb2988c","observation_id":"717e076e-05f6-4bc1-a421-d25a846e2616","resolution":{"observed_at":"2026-08-06T21:41:37.039836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-06T21:34:05.295827Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23858","last_updated":"2025-06-30T13:52:31Z","snapshot_observed_at":"2026-08-08T15:17:52.819952Z","submitted_at":"2025-06-30T13:52:31Z","title":"VMoBA: Mixture-of-Block Attention for Video Diffusion Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:34:05.295827Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2506.23858"},"observation_digest":"sha256:ca6ec37068b9b86af16503047c4fe897f411fd7e8ca4e1e11cbcb28191a4ac2c","observation_id":"bf59e288-1278-4493-969b-8c959b7228cc","resolution":{"observed_at":"2026-08-06T21:34:05.295827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-06T21:28:21.806986Z","title":"Sparse videogen: Accelerating video dif- fusion transformers with spatial-temporal sparsity,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-07T22:12:22.087190Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.806986Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:67de20e4bf43eb8c9f3f239e87bb60306b433100e70f2204ccd9de3704b230e9","observation_id":"44e63883-ca03-4026-8c47-1279fea49fa5","resolution":{"observed_at":"2026-08-06T21:28:21.806986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-06T16:26:45.392305Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.13546","last_updated":"2026-07-03T09:09:34Z","snapshot_observed_at":"2026-08-06T16:19:48.080321Z","submitted_at":"2025-07-17T21:36:36Z","title":"NABLA: Neighborhood Adaptive Block-Level Attention","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:45.392305Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2507.13546"},"observation_digest":"sha256:c78091e3250d3c3b9016fb8296c255fc3b13f3deccb6c3c580530709aede2bcf","observation_id":"488f357b-a0cb-44cb-a952-f1d1a14d6909","resolution":{"observed_at":"2026-08-06T16:26:45.392305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-05T17:45:18.378641Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.15761","last_updated":"2025-08-26T10:56:04Z","snapshot_observed_at":"2026-08-05T17:45:13.859636Z","submitted_at":"2025-08-21T17:56:10Z","title":"Waver: Wave Your Way to Lifelike Video Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T17:45:18.378641Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2508.15761"},"observation_digest":"sha256:3f0835dceea579579f86a6da7499f42dabdd1d0088717f133fc657014fc1daad","observation_id":"12b00058-715c-45e1-8ef1-64774960aa2a","resolution":{"observed_at":"2026-08-05T17:45:18.378641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-05T17:42:59.370738Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.16212","last_updated":"2025-08-25T03:07:02Z","snapshot_observed_at":"2026-08-07T18:02:44.608518Z","submitted_at":"2025-08-22T08:36:58Z","title":"OmniCache: A Trajectory-Oriented Global Perspective on Training-Free Cache Reuse for Diffusion Transformer Models","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T17:42:59.370738Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2508.16212"},"observation_digest":"sha256:d46a2dbba8cc77f5e5256a5a6d1f7ab874afcdbc10d58cf349d583d01aa427d6","observation_id":"2ffb7943-4b97-4d80-80f5-79b3fd6fc82c","resolution":{"observed_at":"2026-08-05T17:42:59.370738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-04T16:07:02.071295Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.16518","last_updated":"2026-06-04T19:42:40Z","snapshot_observed_at":"2026-08-07T17:09:09.130708Z","submitted_at":"2025-09-20T03:48:32Z","title":"FG-Attn: Leveraging Fine-Grained Sparse Attention in Video Diffusion Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T16:07:02.071295Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2509.16518"},"observation_digest":"sha256:f9c80b85cf17f6d9849ed23883f008028e93b3c1d2ebf8c942b40fd22971df35","observation_id":"a0c6e77e-7b67-44f3-8d44-0d7380e0be90","resolution":{"observed_at":"2026-08-04T16:07:02.071295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2509.23980","last_updated":"2026-04-28T18:02:49Z","snapshot_observed_at":"2026-07-06T22:31:00.843452Z","submitted_at":"2025-09-28T17:08:51Z","title":"Towards Redundancy Reduction in Diffusion Models for Efficient Video Super-Resolution","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T11:47:22.725217Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2509.23980"},"observation_digest":"sha256:fb5b40ffb3c2db253b867d7f64cf1dc0c1644947330e6c21d079a4df8ba7da70","observation_id":"5f5d2aef-9f1a-4560-b2ab-e7ddb075913f","resolution":{"observed_at":"2026-05-18T11:51:20.342942Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-04T09:20:07.411349Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:07.411349Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:22f5bd842ae48e8ab07c5e4f7a9a57dedfa9aaa158e410c6c9dbbc369bb8b615","observation_id":"fc7f59fe-43c7-43d8-aebd-faa67ca10143","resolution":{"observed_at":"2026-08-04T09:20:07.411349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-03T22:12:45.435647Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.12035","last_updated":"2026-07-21T06:26:07Z","snapshot_observed_at":"2026-08-06T02:30:30.711903Z","submitted_at":"2025-11-15T05:07:31Z","title":"Timeripple: Accelerating vDiTs by Understanding the Spatio-Temporal Correlations in Latent Space","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T22:12:45.435647Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2511.12035"},"observation_digest":"sha256:153c58ce1d9961003d38996c29d7a044ea3b8d3b7bc1819ad63c1efbb950ef34","observation_id":"29858386-6753-4d0a-b7d9-e4e9a1103b10","resolution":{"observed_at":"2026-08-03T22:12:45.435647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-03T15:46:12.720965Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.15702","last_updated":"2026-07-01T03:39:09Z","snapshot_observed_at":"2026-08-06T15:52:47.972204Z","submitted_at":"2025-12-17T18:53:29Z","title":"End-to-End Training for Autoregressive Video Diffusion via Self-Resampling","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T15:46:12.720965Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2512.15702"},"observation_digest":"sha256:c2728e026cab838bf9164c0c0dbef81b29a9ba9ee04f867b9bb3fc1d3037d2b8","observation_id":"7d0d5553-bf7c-4ced-bdb5-657b68c2f09f","resolution":{"observed_at":"2026-08-03T15:46:12.720965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-03T15:35:16.759708Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.16615","last_updated":"2026-07-23T12:12:25Z","snapshot_observed_at":"2026-08-07T23:52:07.948019Z","submitted_at":"2025-12-18T14:53:12Z","title":"Trainable Log-linear Sparse Attention for Efficient Diffusion Transformers","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T15:35:16.759708Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2512.16615"},"observation_digest":"sha256:42d0c6eaf2fcc94054059f562fb920d9ccf1b58b6af530a7dc581e828f8a522d","observation_id":"c3ebcfb7-2543-4843-82e6-59217e08f0c9","resolution":{"observed_at":"2026-08-03T15:35:16.759708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-03T13:35:50.008026Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.23851","last_updated":"2026-06-20T17:45:12Z","snapshot_observed_at":"2026-08-03T13:35:49.257640Z","submitted_at":"2025-12-29T20:29:21Z","title":"TinyHistory: Lightweight Video History Embeddings via Two-Stage Context Learning","version":6},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T13:35:50.008026Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2512.23851"},"observation_digest":"sha256:dd81242cb84601f2205efa71d278271b2b03e3f00a5134d0387192fa673d10ad","observation_id":"40e70530-067d-413c-9cb8-5e8c17ed031b","resolution":{"observed_at":"2026-08-03T13:35:50.008026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-03T10:56:16.020021Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.08303","last_updated":"2026-07-06T07:20:34Z","snapshot_observed_at":"2026-08-07T13:59:11.336528Z","submitted_at":"2026-01-13T07:46:46Z","title":"SnapGen++: Unleashing Diffusion Transformers for Efficient High-Fidelity Image Generation on Edge Devices","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-03T10:56:16.020021Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2601.08303"},"observation_digest":"sha256:99092ae3dc9bfb7d060decb31e0b45bff72753f8c61530f8df994b747c059048","observation_id":"caa6157e-9703-4170-913b-e912246b9dfc","resolution":{"observed_at":"2026-08-03T10:56:16.020021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-03T10:35:06.618716Z","title":"Sparse videogen: Accelerat- ingvideodiffusiontransformerswithspatial-temporal sparsity.arXiv preprint arXiv:2502.01776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09881","last_updated":"2026-07-09T22:49:12Z","snapshot_observed_at":"2026-08-03T12:37:49.883319Z","submitted_at":"2026-01-14T21:30:03Z","title":"Transition Matching Distillation for Fast Video Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T10:35:06.618716Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2601.09881"},"observation_digest":"sha256:8531fd8cbba164e91d942a7228936659a8eec816e2b26d667c81b592a2d0e9b1","observation_id":"03b351ad-57de-4fe1-ae9d-5270f8adcd29","resolution":{"observed_at":"2026-08-03T10:35:06.618716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-03T10:37:47.346990Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.11641","last_updated":"2026-07-01T07:39:26Z","snapshot_observed_at":"2026-08-06T05:59:57.373243Z","submitted_at":"2026-01-14T16:25:39Z","title":"Mixture of Distributions Matters: Dynamic Sparse Attention for Efficient Video Diffusion Transformers","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T10:37:47.346990Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2601.11641"},"observation_digest":"sha256:36a07a488054082b2045391a2e3d290db8be2d8332a0ef755fbb9fea582b822e","observation_id":"12119fda-2811-4a23-a6ff-7627ad1cdcea","resolution":{"observed_at":"2026-08-03T10:37:47.346990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-03T05:30:22.346810Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-21T17:32:01.642256Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2602.02214"},"observation_digest":"sha256:c429d055f2c141ac3424021e3947db2ccda8b94df7093494fba9ed53ae3208d7","observation_id":"79c64972-fb6b-44b8-9633-1f12f4bcbe5d","resolution":{"observed_at":"2026-05-21T17:32:01.847359Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-03T05:30:22.346810Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T11:48:00.633421Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2602.02214"},"observation_digest":"sha256:6db11c174a022ce14c9a670bb1ab188fbe966e279375ee5014a18c09c676c8ad","observation_id":"b50e13c0-b11d-4195-a62f-4b639e46a6ed","resolution":{"observed_at":"2026-05-22T11:51:29.979301Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-03T05:30:28.604102Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-03T05:30:22.346810Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":5},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T05:30:28.604102Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2602.02214"},"observation_digest":"sha256:bb02a3bc51e40b192a0acf28845b23c7e6dd39efc3d8078afce4ed670b6957e1","observation_id":"fbebeb35-b960-4f6f-bae0-f6c268a5e08d","resolution":{"observed_at":"2026-08-03T05:30:28.604102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2602.02958","last_updated":"2026-05-05T23:46:52Z","snapshot_observed_at":"2026-08-06T01:45:17.613487Z","submitted_at":"2026-02-03T00:54:32Z","title":"Quant VideoGen: Auto-Regressive Long Video Generation via 2-Bit KV-Cache Quantization","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T07:58:24.456859Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2602.02958"},"observation_digest":"sha256:e7d95d0d2f00f59ecc8b3a0440f23cbbddb05562c6f1d9742f8d85792a96dc61","observation_id":"b14e174c-2216-42b4-9311-00c1c05a1efa","resolution":{"observed_at":"2026-05-16T08:00:44.646845Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-03T04:33:11.377277Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.04789","last_updated":"2026-08-01T03:31:24Z","snapshot_observed_at":"2026-08-06T23:10:56.703504Z","submitted_at":"2026-02-04T17:41:53Z","title":"Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T04:33:11.377277Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2602.04789"},"observation_digest":"sha256:9977f832d01f194f0ecc1bc414492bded772a788983f97b50d7f262a4f262105","observation_id":"bd3b27e8-69d2-4be7-8ddd-69213ce2fd4c","resolution":{"observed_at":"2026-08-03T04:33:11.377277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-04T00:38:17.262351Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.04789","last_updated":"2026-08-01T03:31:24Z","snapshot_observed_at":"2026-08-06T23:10:56.703504Z","submitted_at":"2026-02-04T17:41:53Z","title":"Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T00:38:17.262351Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2602.04789"},"observation_digest":"sha256:ea4e9e800e032adbb8d0f5dcb8922d5d9e555c9aceb45239ca924e696523c5b2","observation_id":"2e0fb8c7-50a5-40f6-a6dd-35b2376f3d78","resolution":{"observed_at":"2026-08-04T00:38:17.262351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2602.22575","last_updated":"2026-05-05T13:29:50Z","snapshot_observed_at":"2026-07-06T22:47:06.893212Z","submitted_at":"2026-02-26T03:30:28Z","title":"S2O: Early Stopping for Sparse Attention via Online Permutation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T19:32:52.948154Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2602.22575"},"observation_digest":"sha256:f0306a6a5c195ca5957986ecd9587d8cb258d272ebd66e3ec4ea4ccfcfaa6cc0","observation_id":"ecaa71af-89a8-40c4-a854-a7c060b3b420","resolution":{"observed_at":"2026-05-15T19:36:32.881938Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2603.05811","last_updated":"2026-04-28T22:44:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-06T01:49:47Z","title":"Video Compression Meets Video Generation: Latent Inter-Frame Pruning with Attention Recovery","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T16:05:36.307084Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2603.05811"},"observation_digest":"sha256:7f4e5d34ae021d042906e3cb6d7fef082eb15dc3e9dc5ca09bf17b757142d4fb","observation_id":"237d2c6b-f340-43d5-94ce-b73109df66cc","resolution":{"observed_at":"2026-05-15T16:06:14.412858Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2603.18636","last_updated":"2026-05-08T04:13:25Z","snapshot_observed_at":"2026-07-06T22:49:42.664225Z","submitted_at":"2026-03-19T09:00:08Z","title":"Attention Sparsity is Input-Stable: Training-Free Sparse Attention for Video Generation via Offline Sparsity Profiling and Online QK Co-Clustering","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T08:55:52.757489Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2603.18636"},"observation_digest":"sha256:b7c6709dbe58aebf8d997afe10b62b8a1f0c6b53de2e7db4ce32d5da978b8d1b","observation_id":"033b80b0-a7a8-4f85-8da4-f7a1b3b8e1b0","resolution":{"observed_at":"2026-05-15T08:59:53.189960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:ce3fc3982c72490673dbee65d6ff809fe838c3e1c3e7541f493172a14b0d98ba","observation_id":"0e6c0224-9558-48ca-bf5d-0bd1bc36ccfb","resolution":{"observed_at":"2026-05-21T18:14:17.576394Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2604.10103","last_updated":"2026-04-28T08:33:18Z","snapshot_observed_at":"2026-07-06T22:58:47.599383Z","submitted_at":"2026-04-11T08:54:07Z","title":"Long-Horizon Streaming Video Generation via Hybrid Attention with Decoupled Distillation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T16:10:54.363560Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2604.10103"},"observation_digest":"sha256:ac6aec6a7cfe565e2c0b3921cef5295ffa4537d692aa3105abb4354881511ca3","observation_id":"fd7d2427-4387-4476-b61f-0a66bdd30ead","resolution":{"observed_at":"2026-05-11T09:11:10.460354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2604.15911","last_updated":"2026-04-17T10:11:39Z","snapshot_observed_at":"2026-07-06T23:03:21.422544Z","submitted_at":"2026-04-17T10:11:39Z","title":"Efficient Video Diffusion Models: Advancements and Challenges","version":1},"reference_index":152,"source":"pdf_text","source_observed_at":"2026-05-10T08:28:29.706249Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2604.15911"},"observation_digest":"sha256:79ae7d5175c239e5de7edf566c50a3b23013926ef21ba9b890195c3fe08114dc","observation_id":"f8708ad2-5f18-43fa-ba59-6d9c95b2a0ec","resolution":{"observed_at":"2026-05-10T09:03:25.714069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2604.18215","last_updated":"2026-04-21T16:05:42Z","snapshot_observed_at":"2026-07-06T23:05:08.728446Z","submitted_at":"2026-04-20T13:00:17Z","title":"Memorize When Needed: Decoupled Memory Control for Spatially Consistent Long-Horizon Video Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T04:49:44.525757Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2604.18215"},"observation_digest":"sha256:7a19c38a9d73c6d8b150e5311bf59c2e54d300a098a222b40b932ad2c719648d","observation_id":"f685719a-ab53-4a16-b658-985b3581a6d3","resolution":{"observed_at":"2026-05-10T11:35:19.138279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2604.18348","last_updated":"2026-04-20T14:43:36Z","snapshot_observed_at":"2026-07-06T23:05:13.178333Z","submitted_at":"2026-04-20T14:43:36Z","title":"AdaCluster: Adaptive Query-Key Clustering for Sparse Attention in Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T05:09:46.155328Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2604.18348"},"observation_digest":"sha256:a705167b195ba3f36d153b1072e61f9761ea306fcabf5e0ad43bc559711015e8","observation_id":"15acc78b-a1d9-4421-9b00-e34d473a2ca2","resolution":{"observed_at":"2026-05-10T09:43:49.671215Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2604.20470","last_updated":"2026-04-22T11:56:29Z","snapshot_observed_at":"2026-08-06T00:58:40.705854Z","submitted_at":"2026-04-22T11:56:29Z","title":"DynamicRad: Content-Adaptive Sparse Attention for Long Video Diffusion","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-10T01:25:27.819753Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2604.20470"},"observation_digest":"sha256:389d81cdb97be19d6e587bc7a6191ca883ae8ce3e4813d234f94f4e8b36481cb","observation_id":"86555e28-e483-46d4-9c50-672909cb7cf1","resolution":{"observed_at":"2026-05-11T13:36:07.908341Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2605.14191","last_updated":"2026-05-13T23:13:29Z","snapshot_observed_at":"2026-08-01T23:13:44.447855Z","submitted_at":"2026-05-13T23:13:29Z","title":"CoReDiT: Spatial Coherence-Guided Token Pruning and Reconstruction for Efficient Diffusion Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T04:47:32.476614Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2605.14191"},"observation_digest":"sha256:3a993794074196d415bf380991c4b6a2c7e1d95c2d9eafe55eabfea78204925b","observation_id":"65b90f58-c4ac-4e88-bdd1-7390145cb356","resolution":{"observed_at":"2026-05-15T04:49:44.342655Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2605.14513","last_updated":"2026-05-14T07:57:55Z","snapshot_observed_at":"2026-08-02T01:59:59.234796Z","submitted_at":"2026-05-14T07:57:55Z","title":"HASTE: Training-Free Video Diffusion Acceleration via Head-Wise Adaptive Sparse Attention","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T05:17:48.403406Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2605.14513"},"observation_digest":"sha256:1099ddec2abdea0ab532c2577ae8290704410762cd57ff318f8b7738694adb49","observation_id":"5f9cecb8-8c3e-4cb4-9cc4-a890597178d1","resolution":{"observed_at":"2026-05-15T05:19:46.250983Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2605.17633","last_updated":"2026-05-17T19:54:22Z","snapshot_observed_at":"2026-07-06T23:28:36.134614Z","submitted_at":"2026-05-17T19:54:22Z","title":"SparseSAM: Structured Sparsification of Activations in Segment Anything Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T13:45:26.106499Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2605.17633"},"observation_digest":"sha256:fe9b1ed42c2893bd02d82bfdee7871b7c5274755fe2d17cb4fcd44575cb94f41","observation_id":"ed1dc2ec-a890-4357-8866-461fcf7ce513","resolution":{"observed_at":"2026-05-20T13:48:19.746267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2605.23445","last_updated":"2026-05-22T09:58:23Z","snapshot_observed_at":"2026-08-03T04:13:05.122168Z","submitted_at":"2026-05-22T09:58:23Z","title":"DFSAttn: Dynamic Fine-grained Sparse Attention for Efficient Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-25T04:44:19.628926Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2605.23445"},"observation_digest":"sha256:1012d351e7a9533e1b6ead9775484b851f4eca7a927e89a272db670a8638bd37","observation_id":"64e07104-0506-4a3f-8e73-5dabbc86bf40","resolution":{"observed_at":"2026-05-25T04:45:20.097693Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2605.25798","last_updated":"2026-05-25T12:48:17Z","snapshot_observed_at":"2026-08-03T18:16:15.377656Z","submitted_at":"2026-05-25T12:48:17Z","title":"DiSC: Resolution-Scalable Acceleration of Diffusion Models by Exploiting Sparsity and Cached Token Reuse with Hash-based Distribution","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-29T19:33:05.248105Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2605.25798"},"observation_digest":"sha256:91cc9e0d01a950c96579fce81eaf238740bb796891a5b806c3101e130b8b1bb5","observation_id":"33bf7c9d-bf25-473a-bfa4-4579457705b9","resolution":{"observed_at":"2026-06-29T19:33:53.916733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2605.26632","last_updated":"2026-06-01T03:03:29Z","snapshot_observed_at":"2026-07-06T23:36:29.930024Z","submitted_at":"2026-05-26T07:09:49Z","title":"RT-Lynx: Putting the GEMM Sparsity In a Right Way for Diffusion Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-29T19:40:42.033793Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2605.26632"},"observation_digest":"sha256:0f8f1229c6dce1f98d3fce16ea9380d3aea2706d391a81c4f5f9709acb5dc122","observation_id":"282da279-6c72-4d83-8773-c6ced65095f5","resolution":{"observed_at":"2026-06-29T19:43:54.747044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2605.28691","last_updated":"2026-05-27T16:19:45Z","snapshot_observed_at":"2026-07-06T23:38:14.056361Z","submitted_at":"2026-05-27T16:19:45Z","title":"OSP-Next: Efficient High-Quality Video Generation with Sparse Sequence Parallelism, HiF8 Quantization, and Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T13:06:02.201607Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2605.28691"},"observation_digest":"sha256:3ed899874b2cd30974f3caf2f3e9843140abf18c4b5935077544f4e3503f81da","observation_id":"d4b1cc71-f3b3-44e6-b793-4447d2ac072f","resolution":{"observed_at":"2026-06-29T13:13:27.533279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2605.30325","last_updated":"2026-05-28T17:57:07Z","snapshot_observed_at":"2026-07-06T23:39:38.845840Z","submitted_at":"2026-05-28T17:57:07Z","title":"Veda: Scalable Video Diffusion via Distilled Sparse Attention","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T07:54:13.390911Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2605.30325"},"observation_digest":"sha256:af20482885a80976d42f0e284c9e47aa47a3e8416e2cb07805602e7c826a418b","observation_id":"99cdccd7-71f1-408e-a760-0cf1e75ddf3f","resolution":{"observed_at":"2026-06-29T08:03:14.720126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2605.31057","last_updated":"2026-05-29T09:28:49Z","snapshot_observed_at":"2026-08-06T22:59:45.324056Z","submitted_at":"2026-05-29T09:28:49Z","title":"LVSA: Training-Free Sparse Attention for Long Video Diffusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T22:35:11.610183Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2605.31057"},"observation_digest":"sha256:0e7d39911c99b456ef9168a6e5be894db707aae6531b0857863979315d7e1d81","observation_id":"f6732574-dd6f-4a64-91b2-1727272b69f0","resolution":{"observed_at":"2026-06-28T22:42:45.076275Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2605.31158","last_updated":"2026-06-18T05:06:04Z","snapshot_observed_at":"2026-07-06T23:40:22.583302Z","submitted_at":"2026-05-29T11:06:03Z","title":"Light Interaction: Training-Free Inference Acceleration for Interactive Video World Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T22:43:32.749425Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2605.31158"},"observation_digest":"sha256:a9b3c5d42bda36b24d960da6848406d7dc8b933c9007cedb19a402cf75e0844b","observation_id":"79586b40-ad51-4cad-9c63-c8ea058d3fc4","resolution":{"observed_at":"2026-07-01T19:26:00.145516Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2606.06309","last_updated":"2026-06-04T15:49:37Z","snapshot_observed_at":"2026-08-02T23:02:02.731697Z","submitted_at":"2026-06-04T15:49:37Z","title":"RhymeFlow: Training-Free Acceleration for Video Generation with Asynchronous Denoising Flow Scheduling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T02:08:44.257127Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2606.06309"},"observation_digest":"sha256:30d8c127210f0391ed2681703fee0f3bb8736ed217fcce5bfdb9c31e4acfce39","observation_id":"7e67f4da-b947-4130-a9e0-0ed777b9f8bf","resolution":{"observed_at":"2026-07-02T12:26:56.724770Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2606.23019","last_updated":"2026-06-22T08:32:07Z","snapshot_observed_at":"2026-07-31T17:52:55.153198Z","submitted_at":"2026-06-22T08:32:07Z","title":"ScalingAttention: Discovering Intrinsic Sparse Attention Topology for Video Diffusion Transformers","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-26T09:22:55.731241Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2606.23019"},"observation_digest":"sha256:4a9bd82f6e67c284ab21f7f0978d8401432df6bec0c65fe0406ed888fcf36dab","observation_id":"800a0f5a-6871-4465-85f9-71a6ab88187a","resolution":{"observed_at":"2026-07-04T09:49:44.816794Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2606.23743","last_updated":"2026-06-24T14:59:15Z","snapshot_observed_at":"2026-07-06T23:58:25.400508Z","submitted_at":"2026-06-21T17:23:20Z","title":"Sol Video Inference Engine: Agent-Native Full-Stack Acceleration Framework for Efficient Video Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T11:05:44.972128Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2606.23743"},"observation_digest":"sha256:8c1218c4d39be3412b89c15975d88659345448c376f25c9ae4265332cc6ec142","observation_id":"f30539c6-8789-4c39-9d06-b6a6890d702e","resolution":{"observed_at":"2026-07-04T08:49:41.596153Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2606.30557","last_updated":"2026-06-29T16:51:56Z","snapshot_observed_at":"2026-08-02T04:52:55.899592Z","submitted_at":"2026-06-29T16:51:56Z","title":"EcoVideo: Entropy-Orchestrated Video Generation Paradigm in Cloud-Edge Dynamics","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T06:15:31.587641Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2606.30557"},"observation_digest":"sha256:19e430af9165966019e0f11f5592d4ff6e4d297d8fa075fd822af512b9a144a5","observation_id":"9e76f868-216d-4563-a5d4-88eeb61ebbbe","resolution":{"observed_at":"2026-06-30T07:14:22.140642Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":"2502.01776","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-04T09:49:44.815320Z","title":"Sparse videogen: Acceler- ating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776","venue":null,"work_id":"178063b3-8569-4875-a453-50fafdeecd54","year":2025},"citing_paper":{"arxiv_id":"2606.30849","last_updated":"2026-06-29T19:26:13Z","snapshot_observed_at":"2026-08-02T00:44:38.626792Z","submitted_at":"2026-06-29T19:26:13Z","title":"SyncCache: Exploiting Asymmetric Dynamics for Fast Audio-Driven Portrait Animation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-01T06:13:11.504526Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2606.30849"},"observation_digest":"sha256:3be16ec5a6b8d8530c4fd5cba166dca75e5cc550568155bbbf987a61cab3bc33","observation_id":"34383717-cb27-4789-97c3-20285c38ae0c","resolution":{"observed_at":"2026-07-01T09:45:40.316344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-12T01:12:13.747675Z","title":"arXiv preprint arXiv:2502.01776 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03612","last_updated":"2026-07-03T22:01:35Z","snapshot_observed_at":"2026-08-03T07:17:39.441528Z","submitted_at":"2026-07-03T22:01:35Z","title":"SAF3R: Dynamic Sparse Attention for Feed-Forward 3D Reconstruction Transformers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-12T01:12:13.747675Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2607.03612"},"observation_digest":"sha256:7309a9e7a5c0cc35f0be46b7e1eccc4d271cf127f1e8f5414097e547d0ff828e","observation_id":"7acff67a-d000-43a3-9681-d355d9067ea5","resolution":{"observed_at":"2026-07-12T01:12:13.747675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-14T07:11:45.493916Z","title":"arXiv preprint arXiv:2502.01776 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11081","last_updated":"2026-07-13T04:44:14Z","snapshot_observed_at":"2026-08-02T08:42:24.891322Z","submitted_at":"2026-07-13T04:44:14Z","title":"Controlling Motion Transfer in Diffusion Transformers via Attention Heads","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-14T07:11:45.493916Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2607.11081"},"observation_digest":"sha256:d640a4420080e1bea075daa124cce2d50b8ce1b9dfbdc45b44d98cfb5aee2177","observation_id":"3480828d-6d6b-4a0e-a372-973e60cbff29","resolution":{"observed_at":"2026-07-14T07:11:45.493916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-02T06:40:16.756592Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12358","last_updated":"2026-07-16T04:34:12Z","snapshot_observed_at":"2026-08-07T15:23:16.030924Z","submitted_at":"2026-07-14T05:17:24Z","title":"ACID: Adaptive Caching for vIDeo generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T06:40:16.756592Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2607.12358"},"observation_digest":"sha256:55e3b0be3b94da9859769e8159c5d553cfbed1b4f1ad9a0532bceb835e56a1ac","observation_id":"25f0dc1f-cc73-47b9-9044-a0c35f4a2caa","resolution":{"observed_at":"2026-08-02T06:40:16.756592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-02T03:51:52.201118Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13770","last_updated":"2026-07-15T12:31:19Z","snapshot_observed_at":"2026-08-07T21:19:01.846235Z","submitted_at":"2026-07-15T12:31:19Z","title":"Kaleido: Algorithm-Hardware Co-Design for Video Diffusion Transformers by Exploiting Latent Space Correlations","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-02T03:51:52.201118Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2607.13770"},"observation_digest":"sha256:905052a8a47e1d25e2a73b2915aafb24095cc56c1cbc785e771ac540d31f0ce0","observation_id":"85664d8c-dcf4-4452-92cc-75a0efeaaac4","resolution":{"observed_at":"2026-08-02T03:51:52.201118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-01T22:45:28.423325Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-08T08:12:24.528162Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:28.423325Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:97e15189dd5d4d0ecdfbdcfb8b9d5cdc1fc3e7653c802bd6e846b97167fa8f9e","observation_id":"96c6444f-561d-4539-8dc0-c48ba40df209","resolution":{"observed_at":"2026-08-01T22:45:28.423325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-01T15:29:45.954883Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18436","last_updated":"2026-07-20T18:37:58Z","snapshot_observed_at":"2026-08-06T20:51:47.915284Z","submitted_at":"2026-07-20T18:37:58Z","title":"Surprise Forcing: What to Remember, When to Skip in Long Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T15:29:45.954883Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2607.18436"},"observation_digest":"sha256:b8aa9cd42b762089eb842d7ddc6978e7f7eb3cac929c7521b8be28e5ea6009fc","observation_id":"71237a44-5ff7-43b0-90c8-cd58819ff435","resolution":{"observed_at":"2026-08-01T15:29:45.954883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-01T07:09:08.982968Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21553","last_updated":"2026-07-23T17:36:05Z","snapshot_observed_at":"2026-08-08T06:21:14.732992Z","submitted_at":"2026-07-23T17:36:05Z","title":"SANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T07:09:08.982968Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2607.21553"},"observation_digest":"sha256:8c410828a3db62eddec80a32a0c27aa93f710ec12da3ef59ba00fb5f4abde48e","observation_id":"9653e097-2e9c-4e36-a90a-2cbb82949270","resolution":{"observed_at":"2026-08-01T07:09:08.982968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-02T11:58:30.811138Z","title":"Sparse VideoGen : Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:30.811138Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:5949884982d48e6f52a51040fc929e570dfdb7b6929da3beb97cef0f4e686ae6","observation_id":"d4b9599c-978b-4803-9284-d698d4c5d12c","resolution":{"observed_at":"2026-08-02T11:58:30.811138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-07-31T02:16:08.242540Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28611","last_updated":"2026-07-30T17:58:02Z","snapshot_observed_at":"2026-08-03T00:12:46.043696Z","submitted_at":"2026-07-30T17:58:02Z","title":"Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-31T02:16:08.242540Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2607.28611"},"observation_digest":"sha256:197b2fb99c8e76ed079ce736f65b70057daa87d459e702d8339879356b19b2c0","observation_id":"9f33261d-732d-49fe-878b-39018db1bfa9","resolution":{"observed_at":"2026-07-31T02:16:08.242540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-04T06:45:49.417885Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02474","last_updated":"2026-08-03T16:42:54Z","snapshot_observed_at":"2026-08-07T12:23:54.414253Z","submitted_at":"2026-08-03T16:42:54Z","title":"EchoCache: Energy-Guided Cross-Modal Caching for Efficient Audio-Driven Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T06:45:49.417885Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2608.02474"},"observation_digest":"sha256:b5eef0d2568e7e0c46e22dd895f82200ae7b0355fa6170faaca8119958849a73","observation_id":"e0991f63-ee9f-4291-9d57-b0a7d8a4bdf9","resolution":{"observed_at":"2026-08-04T06:45:49.417885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-04T06:03:07.185566Z","title":"arXiv preprint arXiv:2502.01776 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02504","last_updated":"2026-08-03T17:05:15Z","snapshot_observed_at":"2026-08-06T23:38:50.825846Z","submitted_at":"2026-08-03T17:05:15Z","title":"Token Radius Attention for Efficient Video Generation","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-08-04T06:03:07.185566Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2608.02504"},"observation_digest":"sha256:e19b392e7cd36cfa78a2962e0ecd8d82b293c9ee9ad23d6d05a2fbcc7de48c98","observation_id":"50cf944d-afd2-459c-8591-a4feb3e27e20","resolution":{"observed_at":"2026-08-04T06:03:07.185566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-05T20:50:04.013151Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03335","last_updated":"2026-08-04T08:47:57Z","snapshot_observed_at":"2026-08-08T15:40:55.073428Z","submitted_at":"2026-08-04T08:47:57Z","title":"SPADE: An Input-Adaptive Sparse Attention Engine for Fast Video Diffusion Models Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T20:50:04.013151Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2608.03335"},"observation_digest":"sha256:2842fc8ee825d83f8418e67a26b16e976a212d07795068fa7ab681523dfe374e","observation_id":"2fb1c392-37b1-432d-936b-09a318b8a644","resolution":{"observed_at":"2026-08-05T20:50:04.013151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-06T13:04:14.205005Z","title":"arXiv preprint arXiv:2502.01776 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04956","last_updated":"2026-08-05T15:27:26Z","snapshot_observed_at":"2026-08-08T18:13:00.674697Z","submitted_at":"2026-08-05T15:27:26Z","title":"ContextMaster: Interactive Multi-Shot Video Creation via Fixed-Budget Sparse Context Routing","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T13:04:14.205005Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2608.04956"},"observation_digest":"sha256:d0dacaaa0f15c1c37976147d1c24b300687b772689a381bbb610bb277933ae7a","observation_id":"6f7f4991-0c42-4061-b600-9f7b66cdf7cf","resolution":{"observed_at":"2026-08-06T13:04:14.205005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.01776/citation-record","integrity":"/paper/2502.01776/integrity","json":"/paper/2502.01776/citation-record.json","paper":"/paper/2502.01776"},"outbound":[],"paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 65 inbound Pith citation observations for arXiv:2502.01776."}