{"as_of":"2026-08-14T23:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bc78e936f4310b1476707211c5db02d824f5e594850275d450504c95f4659109","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T12:31:11.886858Z","state":"measured"},{"denominator":93,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":93,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":23,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:51:05.533597Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T08:49:41.575846Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-08-06T23:51:05.533597Z","title":"Sparse videogen2: Accelerate video generation with sparse attention via semantic-aware permutation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16054","last_updated":"2025-06-19T06:25:02Z","snapshot_observed_at":"2026-08-14T14:28:08.552803Z","submitted_at":"2025-06-19T06:25:02Z","title":"PAROAttention: Pattern-Aware ReOrdering for Efficient Sparse and Quantized Attention in Visual Generation Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:05.533597Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2506.16054"},"observation_digest":"sha256:8ae711dddb3813897aad32e1cce3ad12e1fa25ec1b6a4aeb190b32c7540dfd39","observation_id":"e89ccf27-81f0-47fa-897b-42b273e38716","resolution":{"observed_at":"2026-08-06T23:51:05.533597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-08-04T16:07:02.079811Z","title":"Sparse videogen2: Accel- erate video generation with sparse attention via semantic- aware permutation.arXiv preprint arXiv:2505.18875,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.16518","last_updated":"2026-06-04T19:42:40Z","snapshot_observed_at":"2026-08-14T00:16:34.761331Z","submitted_at":"2025-09-20T03:48:32Z","title":"FG-Attn: Leveraging Fine-Grained Sparse Attention in Video Diffusion Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T16:07:02.079811Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2509.16518"},"observation_digest":"sha256:c944dc2add361581670d6bdbfe931fc6a61f2307cd2f74b5f8d9205dcf696c4b","observation_id":"22a64801-0ee0-4a1d-8514-069e84b0f657","resolution":{"observed_at":"2026-08-04T16:07:02.079811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-08-04T09:20:07.773723Z","title":"Sparse videogen2: Accelerate video generation with sparse attention via semantic-aware permutation.arXiv preprint arXiv:2505.18875,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.16325","last_updated":"2026-07-01T00:44:38Z","snapshot_observed_at":"2026-08-07T11:01:31.595493Z","submitted_at":"2025-10-18T03:15:26Z","title":"UltraImageGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T09:20:07.773723Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2510.16325"},"observation_digest":"sha256:c374c20776bb31a9f652ccb6815709db64fa8f6b4d63d2efe85328b8fd66b789","observation_id":"a98bc80e-4815-4f0c-8dd3-b515437ca70b","resolution":{"observed_at":"2026-08-04T09:20:07.773723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-08-03T15:35:16.997670Z","title":"Sparse videogen2: Accelerate video generation with sparse attention via semantic-aware permutation.arXiv preprint arXiv:2505.18875, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.16615","last_updated":"2026-07-23T12:12:25Z","snapshot_observed_at":"2026-08-12T19:34:11.336309Z","submitted_at":"2025-12-18T14:53:12Z","title":"Trainable Log-linear Sparse Attention for Efficient Diffusion Transformers","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T15:35:16.997670Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2512.16615"},"observation_digest":"sha256:0ff27428101f1521aeff55303398f69c964aad8ad0732e141ccddde639d6145f","observation_id":"3549f437-ce7f-46d8-b83a-21050beea9c6","resolution":{"observed_at":"2026-08-03T15:35:16.997670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-08-03T10:35:06.628928Z","title":"Sparse videogen2: Accelerate video generation with sparse attention via semantic-aware permutation.arXiv preprint arXiv:2505.18875, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09881","last_updated":"2026-07-09T22:49:12Z","snapshot_observed_at":"2026-08-09T17:44:11.904091Z","submitted_at":"2026-01-14T21:30:03Z","title":"Transition Matching Distillation for Fast Video Generation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T10:35:06.628928Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2601.09881"},"observation_digest":"sha256:3b2a624f535fc771f87feed1f7e840ecb7a97972b08ba34f193e489121c1c4b0","observation_id":"22646c0a-ffa2-4599-8361-4c78be80735c","resolution":{"observed_at":"2026-08-03T10:35:06.628928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2602.02958","last_updated":"2026-05-05T23:46:52Z","snapshot_observed_at":"2026-08-13T20:12:55.440957Z","submitted_at":"2026-02-03T00:54:32Z","title":"Quant VideoGen: Auto-Regressive Long Video Generation via 2-Bit KV-Cache Quantization","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T07:58:24.456859Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2602.02958"},"observation_digest":"sha256:6941c8a58588c3eafb27814983b51a46d2ad1b5747835ba358729be87e8dc675","observation_id":"e3c7b157-bc6a-4af0-98c2-61d633914bb5","resolution":{"observed_at":"2026-05-16T08:00:44.693905Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2602.22575","last_updated":"2026-05-05T13:29:50Z","snapshot_observed_at":"2026-08-13T13:45:48.461721Z","submitted_at":"2026-02-26T03:30:28Z","title":"S2O: Early Stopping for Sparse Attention via Online Permutation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T19:32:52.948154Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2602.22575"},"observation_digest":"sha256:0d444b065c618b8015a12fbe71bcccc78203166b1ade479e0364779b4f905634","observation_id":"ff2d333c-5f5b-4a75-8d68-78c962792988","resolution":{"observed_at":"2026-05-15T19:36:32.957594Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2603.05811","last_updated":"2026-04-28T22:44:43Z","snapshot_observed_at":"2026-08-13T20:50:15.487718Z","submitted_at":"2026-03-06T01:49:47Z","title":"Video Compression Meets Video Generation: Latent Inter-Frame Pruning with Attention Recovery","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T16:05:36.307084Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2603.05811"},"observation_digest":"sha256:9939bf26af1ce105fcce4d94546294df6f40565d736833a668579a7adf26283b","observation_id":"291ec135-572d-46c1-b769-2e9538898d3f","resolution":{"observed_at":"2026-05-15T16:06:14.405632Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2603.18636","last_updated":"2026-05-08T04:13:25Z","snapshot_observed_at":"2026-08-14T21:10:09.483728Z","submitted_at":"2026-03-19T09:00:08Z","title":"Attention Sparsity is Input-Stable: Training-Free Sparse Attention for Video Generation via Offline Sparsity Profiling and Online QK Co-Clustering","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T08:55:52.757489Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2603.18636"},"observation_digest":"sha256:9a151244030949679efb8bdf7e9846cdcccb9e3bf7a81c90a43aea2d92e39523","observation_id":"a9603e02-a756-46a0-aa5c-429d9ad3f15e","resolution":{"observed_at":"2026-05-15T08:59:53.176331Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2603.21002","last_updated":"2026-05-18T13:08:31Z","snapshot_observed_at":"2026-07-06T22:50:01.539214Z","submitted_at":"2025-11-25T18:54:45Z","title":"SURF: Signature-Retained Fast Video Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-21T18:11:39.642701Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2603.21002"},"observation_digest":"sha256:999fe3b15172eca3eab449d7c12850248837c94256e3558e7f924b4c727e3b6a","observation_id":"ef0157d1-3b00-4a16-8877-2d00dcfbd723","resolution":{"observed_at":"2026-05-21T18:14:17.561929Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2604.18348","last_updated":"2026-04-20T14:43:36Z","snapshot_observed_at":"2026-08-12T15:33:21.961041Z","submitted_at":"2026-04-20T14:43:36Z","title":"AdaCluster: Adaptive Query-Key Clustering for Sparse Attention in Video Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T05:09:46.155328Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2604.18348"},"observation_digest":"sha256:1c964020f9582b2c202a1fd51aecb32d241fb7099db47c6d73726ebd8a876bbd","observation_id":"846da531-7bab-4306-ae18-cb30e3f9e8f0","resolution":{"observed_at":"2026-05-10T09:43:49.696632Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2605.14513","last_updated":"2026-08-09T11:22:36Z","snapshot_observed_at":"2026-08-13T23:28:05.016436Z","submitted_at":"2026-05-14T07:57:55Z","title":"HEART: Exploiting Head Heterogeneity in Sparse Attention for Video Diffusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T05:17:48.403406Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2605.14513"},"observation_digest":"sha256:96ee31d1054119411d44ae2c87fb580798fc382b9aa89632e5e3502ab92488b7","observation_id":"99603888-b9f9-490c-a338-f1a1d674335a","resolution":{"observed_at":"2026-05-15T05:19:46.256500Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2605.17248","last_updated":"2026-05-17T04:10:55Z","snapshot_observed_at":"2026-08-02T22:41:54.302633Z","submitted_at":"2026-05-17T04:10:55Z","title":"Image-to-Video Diffusion: From Foundations to Open Frontiers","version":1},"reference_index":154,"source":"pdf_text","source_observed_at":"2026-05-20T15:06:02.084336Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2605.17248"},"observation_digest":"sha256:1acfdb1e26a31dd763edb40df25b4e8b4f9a38f4c07c51ce6b42254dd1c75b65","observation_id":"589b0ab7-2dc1-4681-ac5d-a18ccc71d32f","resolution":{"observed_at":"2026-05-20T15:08:25.081771Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2605.17633","last_updated":"2026-05-17T19:54:22Z","snapshot_observed_at":"2026-08-14T16:21:38.649631Z","submitted_at":"2026-05-17T19:54:22Z","title":"SparseSAM: Structured Sparsification of Activations in Segment Anything Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T13:45:26.106499Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2605.17633"},"observation_digest":"sha256:d5d90b3f829d415ee0809b75da24a8317a56bd528540ac3607a1b46358b5620f","observation_id":"d1f37f47-ae53-40a7-bc1f-3da8e78e282d","resolution":{"observed_at":"2026-05-20T13:48:19.749353Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2605.31057","last_updated":"2026-05-29T09:28:49Z","snapshot_observed_at":"2026-08-06T22:59:45.324056Z","submitted_at":"2026-05-29T09:28:49Z","title":"LVSA: Training-Free Sparse Attention for Long Video Diffusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T22:35:11.610183Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2605.31057"},"observation_digest":"sha256:be2f5566ba2948b847e468ef21acfaf0ee8250c7864ba9e0826de22b1185e825","observation_id":"5ebcd6f2-5814-4db8-bfa4-9825cd037047","resolution":{"observed_at":"2026-06-28T22:42:47.117300Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2605.31158","last_updated":"2026-06-18T05:06:04Z","snapshot_observed_at":"2026-07-06T23:40:22.583302Z","submitted_at":"2026-05-29T11:06:03Z","title":"Light Interaction: Training-Free Inference Acceleration for Interactive Video World Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T22:43:32.749425Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2605.31158"},"observation_digest":"sha256:89efe645c5329b9cc2874756a4feb50f54ea696f6af6faa06e292e37c3153c70","observation_id":"55e67cbd-619d-4eb4-a391-f2de586cb59a","resolution":{"observed_at":"2026-07-01T19:26:00.144896Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2606.06309","last_updated":"2026-06-04T15:49:37Z","snapshot_observed_at":"2026-08-12T12:55:14.826506Z","submitted_at":"2026-06-04T15:49:37Z","title":"RhymeFlow: Training-Free Acceleration for Video Generation with Asynchronous Denoising Flow Scheduling","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T02:08:44.257127Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2606.06309"},"observation_digest":"sha256:0f2c9e5f94f0a5e29f52dbd601c1b08f9ad728448d50a1ef4c500989ec9ed045","observation_id":"ee29d9ba-5436-45fc-a4fa-ba6718c4a8bb","resolution":{"observed_at":"2026-07-02T12:26:56.710428Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":"2505.18875","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-04T08:49:41.575846Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","venue":"cs.CV","work_id":"decf2600-7c29-49c9-b5e5-a399c4eea166","year":2025},"citing_paper":{"arxiv_id":"2606.23743","last_updated":"2026-06-24T14:59:15Z","snapshot_observed_at":"2026-07-06T23:58:25.400508Z","submitted_at":"2026-06-21T17:23:20Z","title":"Sol Video Inference Engine: Agent-Native Full-Stack Acceleration Framework for Efficient Video Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T11:05:44.972128Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2606.23743"},"observation_digest":"sha256:0c69688484ab821ebf93b0abe84bc2e812921f9fb1a6d9fe27c35c0f4a6f1c8b","observation_id":"cc4ab52b-5d71-4a0e-8416-e9e50c74fa76","resolution":{"observed_at":"2026-07-04T08:49:41.577104Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-12T05:28:53.474483Z","title":"Sparse videogen2: Accelerate video generation with sparse attention via semantic-aware permutation.arXiv preprint arXiv:2505.18875, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03012","last_updated":"2026-07-03T06:46:35Z","snapshot_observed_at":"2026-08-14T22:25:08.434652Z","submitted_at":"2026-07-03T06:46:35Z","title":"HyperVAttention: Efficient Sparse Attention with Spatio-Temporal Clustering for Video Diffusion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-12T05:28:53.474483Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2607.03012"},"observation_digest":"sha256:d86d07780ce90fab0b07492076d44aaa0072c5fc752e6ee00bfa1bf92b48497b","observation_id":"feabe630-c3f6-43a9-9df5-4d1fd9845bf9","resolution":{"observed_at":"2026-07-12T05:28:53.474483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-07-12T01:12:13.747675Z","title":"arXiv preprint arXiv:2505.18875 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03612","last_updated":"2026-08-13T10:47:12Z","snapshot_observed_at":"2026-08-14T22:19:37.865973Z","submitted_at":"2026-07-03T22:01:35Z","title":"SAF3R: Dynamic Sparse Attention for Feed-Forward 3D Reconstruction Transformers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-12T01:12:13.747675Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2607.03612"},"observation_digest":"sha256:8d3631e44709ca29c338a05076d85fe36c77b4ed52a0f6e0ca615c0bca5f836d","observation_id":"7a9a6fca-032f-47d2-8b0b-6774ee529a24","resolution":{"observed_at":"2026-07-12T01:12:13.747675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-08-02T03:51:52.683841Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13770","last_updated":"2026-07-15T12:31:19Z","snapshot_observed_at":"2026-08-07T21:19:01.846235Z","submitted_at":"2026-07-15T12:31:19Z","title":"Kaleido: Algorithm-Hardware Co-Design for Video Diffusion Transformers by Exploiting Latent Space Correlations","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-02T03:51:52.683841Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2607.13770"},"observation_digest":"sha256:a788bd236efec87d94efff94480b07d07c69dce4ce060bb59f6daadafaa669aa","observation_id":"217ed1be-9e33-462f-a669-9d41f74ea711","resolution":{"observed_at":"2026-08-02T03:51:52.683841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-08-01T22:45:28.569375Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-08T08:12:24.528162Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:28.569375Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:dd897f5324042f7536aec2ab337fdb8cb70f362271db60ba2e6a88b22065ee20","observation_id":"6096c1b9-6c77-4aea-8d38-1054b820ae48","resolution":{"observed_at":"2026-08-01T22:45:28.569375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-08-05T20:50:04.024042Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03335","last_updated":"2026-08-04T08:47:57Z","snapshot_observed_at":"2026-08-13T00:29:32.107926Z","submitted_at":"2026-08-04T08:47:57Z","title":"SPADE: An Input-Adaptive Sparse Attention Engine for Fast Video Diffusion Models Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T20:50:04.024042Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2608.03335"},"observation_digest":"sha256:1e2b4a0201b49a0738a6b2a5dd4fc3ae71447f8a991adb284e8665c664f61af8","observation_id":"ba37427d-f92c-436b-991b-caf9919d90f6","resolution":{"observed_at":"2026-08-05T20:50:04.024042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.18875/citation-record","integrity":"/paper/2505.18875/integrity","json":"/paper/2505.18875/citation-record.json","paper":"/paper/2505.18875"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-13T14:41:45.809481Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":"2412.03603","doi":"10.48550/arxiv.2412.03603","metadata_source":"pith","pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","venue":"cs.CV","work_id":"881efa7e-7e73-4c66-9cc3-2803e551061c","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:6b658ba2a9bad3ff7f8cae079a4b1863072a9214a809077f988a6463bf4a2407","observation_id":"2537f70f-da02-4681-bfd4-6bbaeb52fb21","resolution":{"observed_at":"2026-05-19T12:32:17.794853Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:534da18093dd2a73c82b39a7a937103b891b776456aeac125692e849ff5b86ef","observation_id":"e8218c3a-2073-4db8-a8cc-2e0a7437eaca","resolution":{"observed_at":"2026-05-19T12:32:17.787357Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":"2408.06072","doi":"10.48550/arxiv.2408.06072","metadata_source":"pith","pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","venue":"cs.CV","work_id":"f38fc088-12aa-4bf4-9ecd-08d3e797ccb7","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:991cd914517636acca316ce77bd707598c539f73364a81cd49ac35db9b50bdb2","observation_id":"33fa6ce1-6959-4194-a317-7c75fb5ef10f","resolution":{"observed_at":"2026-05-19T12:32:17.791026Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity","venue":null,"work_id":"c6e21ae5-7c96-4270-a0cf-17c2d4e2070d","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:4253623bc52f4e80fecce78d5e7c86dedb205b70cc555f5419f6f1e7c83e9b5c","observation_id":"93c9826a-03a7-4853-88ac-11f377f766a8","resolution":{"observed_at":"2026-05-19T12:32:18.165121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quest: Query-aware sparsity for efficient long-context llm inference","venue":null,"work_id":"e3e47f28-cedf-4b0e-9f82-992372cf850d","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:6be3bf9322f73b3738ec9a2d5074e2a2efc39fc568ce8affcd663f1c88d04a61","observation_id":"9a05a5f8-fe71-4a5b-b471-23bf336590aa","resolution":{"observed_at":"2026-05-19T12:32:18.169268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"H2o: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":"847ab23e-7e3c-445a-9f09-6468f94160c5","year":2023},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:3f2001fc705edb323327e84b2411fba652384565b8dcbfda18375a7467e007b1","observation_id":"f1508976-546c-427b-ae89-54cbc51ecc52","resolution":{"observed_at":"2026-05-19T12:32:18.171531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"c4d0bdaa-9302-4f56-9aef-6c2b5c63ec21","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:7454d0e10c6346b1b40d9f34e7723171dcb0f0de5cd75dce8158488070a3ffb7","observation_id":"80fd919b-753d-44aa-8359-baa93949cc4a","resolution":{"observed_at":"2026-05-19T12:32:18.149999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04507","last_updated":"2025-06-04T23:21:39Z","snapshot_observed_at":"2026-08-12T05:38:58.830320Z","submitted_at":"2025-02-06T21:17:09Z","title":"Fast Video Generation with Sliding Tile Attention","version":3},"cited_work":{"arxiv_id":"2502.04507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.04507","snapshot_observed_at":"2026-07-11T01:07:44.493549Z","title":"Spargeattn: Accurate sparse attention accelerat- ing any model inference","venue":"cs.CV","work_id":"c53350cf-72d0-42b0-af6c-8d19e35404e8","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"cited_paper":"/paper/2502.04507","citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:3cb9b0e24804575b12bb29289d89c37b07cfb8957daccb0ab43c836a41eb262a","observation_id":"e06177b4-6ae1-4d06-ae19-270e63434ea9","resolution":{"observed_at":"2026-05-19T12:32:17.783573Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spargeattn: Accurate sparse attention accelerating any model inference","venue":null,"work_id":"d1df81c5-f787-40c1-af74-75d86b11d371","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:6e8b373fd95a03ec4d4f839c28ae04b97fe1b2914969f6b7fd34dd0ae33ff7a6","observation_id":"eb56a12e-c6ac-4dcf-b451-f5eb830942a2","resolution":{"observed_at":"2026-05-19T12:32:18.097464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xattention: Block sparse attention with antidiagonal scoring","venue":null,"work_id":"18de7ea1-0300-4fdf-9091-41fbac2eb44a","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:d15efc1bd66b9e08989b471f9613314123b9f5c912800099d27fd13735aed930","observation_id":"7f3288e8-4ba9-47e5-8225-94ed2abfc77e","resolution":{"observed_at":"2026-05-19T12:32:18.227707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tactic: Adaptive sparse attention with clustering and distribution fitting for long-context llms","venue":null,"work_id":"3b3af637-bdc8-4f99-b664-959d9e0dcd9b","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:89883c550817f85c8b94be7559b1b3c0c18543d113d61d1b1f40db3446063cab","observation_id":"159a33b6-abf2-486d-95cc-3e323f2e78ef","resolution":{"observed_at":"2026-05-19T12:32:18.210844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Abdi, Dongsheng Li, Jianfeng Gao, Yuqing Yang, and Lili Qiu","venue":null,"work_id":"a7ddc794-cce8-483c-8412-c7a4742f3b61","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:6ed98832e404f47307eca778078ad1c65de263d1c454d2124f9d87c9e4b240ad","observation_id":"c718fc7e-c848-4259-b95c-64dd368816db","resolution":{"observed_at":"2026-05-19T12:32:18.112720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pit: Optimization of dynamic sparse deep learning models via permutation invariant transformation","venue":null,"work_id":"3dac5f3d-7fa6-44cd-a46a-aa46a0f02b93","year":2023},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:a393bfed7a4e2e3776aa62862f90da8ac0d8025dd3d7fd2feaf1aca441853a64","observation_id":"52997666-3cf8-4d9f-991b-4fde48c7827d","resolution":{"observed_at":"2026-05-19T12:32:18.084479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nvidia a100 tensor core gpu","venue":null,"work_id":"619fa9b9-f5ef-44a9-818d-67a985e1feb5","year":2021},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:951d54f0acf73b55e130da18823c946032d6aa8a5c57a6b952b3fea5fe0b57eb","observation_id":"8db13696-880a-4936-988f-b04ad74a62f0","resolution":{"observed_at":"2026-05-19T12:32:18.086783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Twilight: Adaptive attention sparsity with hierarchical top-ppruning","venue":null,"work_id":"94025373-4451-4b2a-847c-6e9d331b9935","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:04d5b895f7d6dc06bccac7c0700f0490a0162e9e089d7cc6df83bdfc3094bab9","observation_id":"95e3d407-9dbc-46ac-8091-13103ab07b2d","resolution":{"observed_at":"2026-05-19T12:32:18.147782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flashinfer: Efficient and customizable attention engine for llm inference serving","venue":null,"work_id":"5b64bc92-36d7-4f74-8e88-ae3a9fafbf37","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:8c80cbade4ccc6b02fa4019a1c1ef15fb05cb0e3aee5d79dff3cf6d1a7b85466","observation_id":"840fe29b-463d-46b1-ae4e-b80ae317f6e1","resolution":{"observed_at":"2026-05-19T12:32:18.103225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training-free and adaptive sparse attention for efficient long video generation","venue":null,"work_id":"c46cf10e-5810-4169-ad7d-a58015484e82","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:d4c072c0742bd0f057cf9c184bf05d88fb12d40bb8457584f04e92931988cc77","observation_id":"2021551e-0e02-4a88-a6b4-3660d4536889","resolution":{"observed_at":"2026-05-19T12:32:18.121151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Paroattention: Pattern-aware reordering for efficient sparse and quantized attention in visual generation models","venue":null,"work_id":"9a0a4179-addd-4dbd-8bcc-7acf76c8efda","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:395a4b084b2d0957df40aadda688843e1fefd4d91c4894e14357302d4fca5e9a","observation_id":"e85d07c5-f6a7-417b-b16e-123c353888bc","resolution":{"observed_at":"2026-05-19T12:32:18.157471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dsv: Exploiting dynamic sparsity to accelerate large-scale video dit training","venue":null,"work_id":"2ba060fc-64e6-4802-b9b1-01b124618846","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:9ceb41490fc625f6efe2631565787dd7bbd0bae523cca26ac033cf0e7178f28f","observation_id":"5d509197-af11-443a-b0ef-3c96273412be","resolution":{"observed_at":"2026-05-19T12:32:18.184235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fpsattention: Training-aware fp8 and sparsity co-design for fast video diffusion","venue":null,"work_id":"7a1f98b6-dc83-4e14-8695-abebca56e6b3","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:49bb0cf9e92b1fa12d6753a3f8c54c4afd6ebda6f321734505aea8df2f34f264","observation_id":"44c229bd-b69c-4656-a09e-0a504e9a7179","resolution":{"observed_at":"2026-05-19T12:32:18.238927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"V orta: Efficient video diffusion via routing sparse attention","venue":null,"work_id":"5b6df17f-b45a-4e2b-a0dd-b07149d9dde2","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:6a7c62975573e5ea178197d90b59abc8fb0f8edff625708335b6a6f1e03de8c5","observation_id":"7759e546-41b2-4a8f-8b93-d38d8132966a","resolution":{"observed_at":"2026-05-19T12:32:18.179884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training-free efficient video generation via dynamic token carving","venue":null,"work_id":"67862dd8-cee5-4dd0-834c-d7f7b31d0c22","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:5c8a8c15aee9bb232721cacb48ef9e89d8af223aa7b948bd9f7bb41c6df6e361","observation_id":"29f07946-7c9a-460b-a003-7b64e08dedae","resolution":{"observed_at":"2026-05-19T12:32:18.192903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gonzalez, Ion Stoica, and Lianmin Zheng","venue":null,"work_id":"e0987f89-872b-47b0-b6c0-6ece8b3df6db","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:3a4d9da4095fdb18fdc411d4a6066bcfd7aa74929254e8ca68cf8ccfaa5b0f31","observation_id":"286e141a-3779-4eb9-bef1-3a84e33ce6c7","resolution":{"observed_at":"2026-05-19T12:32:18.175745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Duoattention: Efficient long-context llm inference with retrieval and streaming heads","venue":null,"work_id":"699223d2-767a-41a0-8798-e633a0b60b11","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:34448308def15a48b0b594eff59d37deaa1aea19457c53381df3b3236c299577","observation_id":"7da7980f-10ca-4742-b06d-15bb39e5567d","resolution":{"observed_at":"2026-05-19T12:32:18.162807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Minference 1.0: Accelerating pre-filling for long-context llms via dynamic sparse attention.NeurIPS","venue":null,"work_id":"de5c0458-6430-49d4-850d-93c11cc5567d","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:7db9b5983e95a84c4c4be5dce380d4de9bdb82df2acaeb4619296a498243d84d","observation_id":"fa08fa0d-d517-4704-8097-feb0ea3ccead","resolution":{"observed_at":"2026-05-19T12:32:18.167181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flexprefill: A context-aware sparse attention mechanism for efficient long-sequence inference","venue":null,"work_id":"50ebb2c5-f070-4d4c-a203-21c60ea0d05c","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:31e2918fae3e2e290296debaaa09b893c4a4395cedb183dccec9df3dbc550fc7","observation_id":"5eb50740-63f7-4a09-b573-0383467a6626","resolution":{"observed_at":"2026-05-19T12:32:18.177827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seerattention: Learning intrinsic sparse attention in your llms","venue":null,"work_id":"63c9f462-cf89-4899-9d19-a39a0a452c54","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:21dd05f97925d7cfc26d0cbb6f4ac28ca25aa3d076a02a6b550dbf444222d76d","observation_id":"c113d191-abed-47c2-a533-3a99373dc5f0","resolution":{"observed_at":"2026-05-19T12:32:18.186147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Infllm: Training-free long-context extrapolation for llms with an efficient context memory","venue":null,"work_id":"812a61dc-190c-420c-a003-118765435ef0","year":null},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:2b06f5031df4d382fa09945e33d0024c7b09cbabf9f2a5f86dd33cca8d3a72fa","observation_id":"da24cd2c-1e15-4b55-96cf-c371ca9cfc63","resolution":{"observed_at":"2026-05-19T12:32:18.206519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lm-infinite: Zero-shot extreme length generalization for large language models","venue":null,"work_id":"69037789-d99d-4b66-bacd-1641b9569954","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:41f94a0782994e10eb7b661065ec86edfee4d46e71a85bbf4b50f6c9d8bb2964","observation_id":"24c83ab8-b571-490e-8d12-dfa448af0fb9","resolution":{"observed_at":"2026-05-19T12:32:18.204176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention","venue":null,"work_id":"b4e02385-7ef8-48d0-aa99-67b5571d3eb5","year":2020},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:6655eafbbc59e0fed095fce6479a9eba70efae201dbd8fb33a725638ad312a10","observation_id":"0a305fb3-fea6-4177-918c-2862616b3ce4","resolution":{"observed_at":"2026-05-19T12:32:18.212855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gated linear attention transformers with hardware-efficient training","venue":null,"work_id":"2d2ca4f9-cda7-4132-bb1b-18fe8e37dfc8","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:0ae49c2c9c6639b3bff7b4f5de939809b6ebb6e7d77059ff644debd2b8bd6732","observation_id":"a7566cf6-7123-485c-8dcc-4ed500f16288","resolution":{"observed_at":"2026-05-19T12:32:18.217282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gated delta networks: Improving mamba2 with delta rule","venue":null,"work_id":"d6c98eed-7b56-490c-833f-5464db3ec3c3","year":null},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:da8f22a559dbca4af3354594344b8da6defaffe9f2f1e4dfba7566fecd1b0980","observation_id":"58963b27-25e1-4f5b-92b7-4671a964b527","resolution":{"observed_at":"2026-05-19T12:32:18.194970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":"141be743-f5b0-4af2-8d70-070993e17631","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:90c54864adf2561783981f90172862bde98d02c8186999bffb69c42c3b996d9a","observation_id":"13df249f-8f7a-4d85-b2f7-bf2bb4a48ddb","resolution":{"observed_at":"2026-05-19T12:32:18.197028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality","venue":null,"work_id":"b13acd34-b96a-4885-84f3-64fc8cd956e5","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:c4327607ed4741edb1a6c275e1174cec85fccc1cf02fdd3abf56090972cc3870","observation_id":"aefa0269-7f55-406f-9722-94deb9bc4d00","resolution":{"observed_at":"2026-05-19T12:32:18.232631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Matten: Video generation with mamba-attention","venue":null,"work_id":"6c10176f-c07a-4620-955d-093ccacf6ab8","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:60b42eea66f8c74a4ccfc0d3517708ef5c15b35732cc88c13772d3fd4290db11","observation_id":"9628708a-d30f-4802-92a2-7eae5f9401eb","resolution":{"observed_at":"2026-05-19T12:32:18.135581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jha, and Xiaoliang Dai","venue":null,"work_id":"b2f1185e-8e49-4220-9484-c6479c6d6104","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:7f4b071ddb48ddc62501a54545e8e8a264f0d645e744fea4b4b34d40150d523f","observation_id":"31a528f5-9f22-4214-b981-f1c94d1bfbe6","resolution":{"observed_at":"2026-05-19T12:32:18.137857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M4v: Multi-modal mamba for text-to-video generation","venue":null,"work_id":"17cc7967-37a2-4ec2-893a-c645ea891a31","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:a1b04ba0440de8da9061a0ff7e15f3222983e2a81e7622cbd5404bfa23ba003e","observation_id":"86e7dbdf-3718-4bb0-819f-fa7416ce5c83","resolution":{"observed_at":"2026-05-19T12:32:18.145405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Long-context state-space video world models","venue":null,"work_id":"0735bb10-1d7b-46ac-94e7-b4e56a67254b","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:59bda4635ae1524625abeb12c77ee73f9fb787c2b283e273bd3657a1e7b6840f","observation_id":"dfcfeb64-ca33-4d3c-a43f-26ed255a3e98","resolution":{"observed_at":"2026-05-19T12:32:18.124789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"One-minute video generation with test-time training","venue":null,"work_id":"944b3903-4159-4906-9945-56aa86fcda57","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:99fdb9c3dc29466e6df334a88897fff84330c8de05d87f42673440e0ff5f910e","observation_id":"ce46575f-4ede-4ebd-ba4e-887aa5694062","resolution":{"observed_at":"2026-05-19T12:32:18.152280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sana 1.5: Efficient scaling of training-time and inference-time compute in linear diffusion transformer","venue":null,"work_id":"42f7d049-70a7-445f-aa95-1eec393cbb13","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:14d7ee96b8d16ddd00da042a495c16b52d21e8dc745c0746ab2fa7f930de29a2","observation_id":"7957d81f-16c5-4570-9050-3575dc711de2","resolution":{"observed_at":"2026-05-19T12:32:18.118560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sana: Efficient high-resolution image synthesis with linear diffusion transformers","venue":null,"work_id":"d350ef3d-81d1-4a2a-b0f2-d364e3f071e3","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:ce15f397c6532951ce1c5af083d8282d75745e2df078749084e4533220067f4d","observation_id":"44fb9ebb-1771-4905-a036-c53f03a25d00","resolution":{"observed_at":"2026-05-19T12:32:18.107048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sana-video: Efficient video generation with block linear diffusion transformer","venue":null,"work_id":"35d813f4-5601-48f9-9ca0-b54cc33336ac","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:da14c614e446c814e0f2cf6c5ad4f30dc88f009759d58beaf007923fbc54f11a","observation_id":"58b54b5a-34b4-48dd-b475-54b6b44bbea6","resolution":{"observed_at":"2026-05-19T12:32:18.214932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dc-ae 1.5: Accelerating diffusion model convergence with structured latent space","venue":null,"work_id":"672a3b06-9743-4847-8ca7-4a59db8439ba","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:0e2087133439ed8d10d6be3f6bcccb53089ff91893b6350e271b836184755027","observation_id":"18d6f934-5b06-4963-94ee-80a8c9cab297","resolution":{"observed_at":"2026-05-19T12:32:18.094956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dc-gen: Post-training diffusion acceleration with deeply compressed latent space","venue":null,"work_id":"5cd9a64c-a70b-46f2-9bf5-45450eb860fe","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:d88b606fc3328bb02adaafd8a2688e384e51f77d5fd98349d0bc0da75f0a6c5f","observation_id":"ec204da9-7ebf-459c-9461-88d2df39bc9e","resolution":{"observed_at":"2026-05-19T12:32:18.190403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep compression autoencoder for efficient high-resolution diffusion models","venue":null,"work_id":"02365383-81d8-468f-a8e0-3dfca57a69cf","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:27f740fd425706cdbb4fd0b1b336113f147a307fcdc0e57fdb1d5aca36c7b346","observation_id":"d4edabc1-0588-4de3-bb94-7ed9106497f0","resolution":{"observed_at":"2026-05-19T12:32:18.221304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From slow bidirectional to fast autoregressive video diffusion models.CVPR","venue":null,"work_id":"2297fd9b-08a9-49b1-b0b8-add40b31618a","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:85fd2e054cb17a03df10fa5faa40bf64d87d23af2fbadc8cdaeacf09a2551fb1","observation_id":"125bd7a6-d8b6-4a03-8428-a7a73afc19a2","resolution":{"observed_at":"2026-05-19T12:32:18.092014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion","venue":null,"work_id":"9f88aba3-a8bb-4826-a94b-e5b98bd1a19f","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:d894833042b45aa6061c0242e4eade24bf5b6c3227e7a505d612ccc47e0e25b2","observation_id":"372c3b89-31c4-4b5c-b4bc-801216a69a45","resolution":{"observed_at":"2026-05-19T12:32:18.089548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Longlive: Real-time interactive long video generation","venue":null,"work_id":"9409e6fb-8444-4f66-a5e0-05f30c7ff54c","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:160de31a3a3f34febbdfd92a5b1cc127de67ff1492f826ec1b482d9828072786","observation_id":"2b6b2d44-a86c-462c-85de-5264b8d2a3eb","resolution":{"observed_at":"2026-05-19T12:32:18.109744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Packing input frame context in next-frame prediction models for video generation","venue":null,"work_id":"ed852bc5-be7a-4ee7-8958-f3b03adcaa87","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:6a901b91e83bc5ba8ace8d89a2e067b48c3facc1c90eecc60cf00832c4f68b82","observation_id":"533b168c-9d7f-4ac9-8832-17521e7c0d4b","resolution":{"observed_at":"2026-05-19T12:32:18.115389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Riflex: A free lunch for length extrapolation in video diffusion transformers","venue":null,"work_id":"1727ff22-f3a4-41ad-af9f-e4e425a7e451","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:6f7f25c5458286a028fe9661a6aa24cb90521652e84251e0b432cba00b21c0fd","observation_id":"f1079082-803b-47c3-a9d5-53470c28ab24","resolution":{"observed_at":"2026-05-19T12:32:18.132651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Freelong++: Training-free long video generation via multi-band spectralfusion","venue":null,"work_id":"e7bc0709-0f2e-47ee-b238-10cf5ef81c7c","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:899187dcdb2fedf0a64e151fc69f7850055409a19c894659cc9cefff40398c16","observation_id":"cf39c2d1-72e5-42e2-a284-7b310e0fd138","resolution":{"observed_at":"2026-05-19T12:32:18.173668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Radial attention: o(nlogn)sparse attention with energy decay for long video generation","venue":null,"work_id":"7e83d358-3e3e-4ddc-a134-ab9e28178f24","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:889342827d9eda80d5bb8e0eecbba2799bb55daba7293f0e64dc8cac897555d2","observation_id":"4d0b5709-2c26-4802-8cf8-8ef303a094ad","resolution":{"observed_at":"2026-05-19T12:32:18.182168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vmoba: Mixture-of-block attention for video diffusion models","venue":null,"work_id":"b116eb6a-4318-461f-8087-066d86ed8862","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:a4fd74d1f5edd88edbedb493aaed0f2685d71cf88c8df43ad753a6556088727d","observation_id":"e25fb630-5168-430a-8269-344b7e89c357","resolution":{"observed_at":"2026-05-19T12:32:18.199216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mixture of contexts for long video generation","venue":null,"work_id":"400d7f21-dde1-45bb-bb13-00cfa604296e","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:10391f5c9677d14a5f3eb8a677b85ee05b54bfb84340f5b0dc9226dd203128df","observation_id":"db67d38b-0a68-43f2-a93b-d4d6661ba170","resolution":{"observed_at":"2026-05-19T12:32:18.234739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vsa: Faster video diffusion with trainable sparse attention","venue":null,"work_id":"079a7c3d-e72b-4744-a283-811fcdb1bc49","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:ffd2659bdc58883c1f0967182516c8e2033095658563f70c8c8da4a398c8586c","observation_id":"e30d6ca1-34cd-4e7e-a609-d380fd5f5480","resolution":{"observed_at":"2026-05-19T12:32:18.127350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0391d798-c29a-49b1-a85b-305407e8114e","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:ee87596ce308839d6ea1ca327deca760e3dcae2cbb44edf04e41ddbca823f1c9","observation_id":"e1f0bd77-78d4-4eb3-bc90-60c619725738","resolution":{"observed_at":"2026-05-19T12:32:18.129847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dicache: Let diffusion model determine its own cache","venue":null,"work_id":"2b596bb9-3c1d-4d50-9bce-c632eec7e03d","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:e89d4d59555ed3cd04c1a8230afa50e9b77fb45c8ee4853bd842742f966e3722","observation_id":"53eb6a6c-9beb-46b1-bf67-0fd3dde35eae","resolution":{"observed_at":"2026-05-19T12:32:18.100078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omnicache: A trajectory-oriented global perspective on training-free cache reuse for diffusion transformer models","venue":null,"work_id":"9b8978b6-ee47-4061-86e1-4c72766e55b2","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:0611065e9f40d58a31d3dd2e0a0a41dd03e7f950ad85fc8435a45d120199ffc9","observation_id":"8b67fa98-ae9e-4a7c-9120-46b55c84b0bf","resolution":{"observed_at":"2026-05-19T12:32:18.188242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Timestep embedding tells: It’s time to cache for video diffusion model","venue":null,"work_id":"16684ecb-f850-4829-a190-92898e4a3e9d","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:a39f15fc11dea5dab1782f7d59662862501af10a66e14e3242d65f79cd8f0114","observation_id":"78fd1925-4d02-4400-b841-d9ebf2b03199","resolution":{"observed_at":"2026-05-19T12:32:18.140629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Less is enough: Training-free video diffusion acceleration via runtime-adaptive caching","venue":null,"work_id":"69fa1477-a91a-4319-ab29-7d0cc43880d6","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:b4cf84b8360495da51cfbcdf7084aa4d715ba4cfd0ee27a827745e45d785276a","observation_id":"aa5f96eb-bc95-4b59-b430-58564b9bf8ce","resolution":{"observed_at":"2026-05-19T12:32:18.154913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention is all you need.NeurIPS","venue":null,"work_id":"e58087ff-f5d6-4c7b-8c16-7f09d5c43c5b","year":2017},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:b2d3a8b252e7609b0445e095218d9782d069c096a3a4eed8e6b9a275ba583be7","observation_id":"91bd1d1e-5e92-4ddc-846d-b4579cd75e0e","resolution":{"observed_at":"2026-05-19T12:32:18.160146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sparsetir: Composable abstractions for sparse compilation in deep learning","venue":null,"work_id":"b5d540ae-0ba8-493c-a4c5-f70543d2b9a4","year":2023},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:754be7b8ae59ea1513793f7d5f16c153516448a149c900fc5498c4a069ef8491","observation_id":"5de9e7a9-d031-4a6c-9d25-790dd419fdeb","resolution":{"observed_at":"2026-05-19T12:32:18.143145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"k-means++: the advantages of careful seeding","venue":null,"work_id":"36ba1218-f304-4a84-897a-21c4d4e07528","year":null},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:00f20a05c56698b1e2438c8a07500595ffa5bcd2e8654fabde00f26a40ed8c80","observation_id":"0a99f2b0-ef7f-4027-b9c3-34ca444b7137","resolution":{"observed_at":"2026-05-19T12:32:18.240936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"167a8a10-f08d-457d-9637-34626c8adcf9","year":null},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:d612c2ee3426d8bbcb0ea8dc0e27dcef9ddb95227a99a23aa13070ba13c6392b","observation_id":"3dca4c0b-de10-4bf1-9da9-1b0dd942d958","resolution":{"observed_at":"2026-05-19T12:32:18.223285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Real-time video generation with pyramid attention broadcast","venue":null,"work_id":"e78d61be-d074-4aaa-b767-43e3dac1e0ce","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:895e13ac3511fdd5805978f8ca79cd4263d766a890148ffb1c9ea030b6c93ac1","observation_id":"09b20feb-9eb7-40c9-ba88-d1f6d497be9c","resolution":{"observed_at":"2026-05-19T12:32:18.225339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flashattention-3: Fast and accurate attention with asynchrony and low-precision.NeurIPS","venue":null,"work_id":"74539729-2d8a-4562-a396-ab222b0234f5","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:59d0236b833ae2f261003527834942dd3623a28c921a39cbb676774464a372d8","observation_id":"ba2cbdd2-69d8-4773-9b1d-f63845eb255a","resolution":{"observed_at":"2026-05-19T12:32:18.230203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flex attention: A programming model for generating optimized attention kernels","venue":null,"work_id":"035ced25-13eb-4a2a-81ac-f45b1563f3fe","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:8f3495980f4d6c1d7e4fa31c3e3e4514b0adb086bbad80ef598889bb779de106","observation_id":"e1337fd2-5685-4276-ac9f-b428a6f66119","resolution":{"observed_at":"2026-05-19T12:32:18.236752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"c5f14a67-fc71-4eee-bcef-b2e3f1ae434b","year":2023},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:80c4281392fef1ce97c916c61ec9eedc75c0bf7128d609503059840165259658","observation_id":"24beb2f5-1cc7-42f8-aebd-e3b3f7ccfec7","resolution":{"observed_at":"2026-05-19T12:32:18.208627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"[Yes] \" is generally preferable to","venue":null,"work_id":"8771927d-02cb-47f9-aa81-e9ca6ae88fef","year":2024},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:bd49f9dca8a454c4020b3d51fa4186bf8278d2c996d6ecf45fa0aaf1df50a19d","observation_id":"b9241d7b-0221-4ecb-853a-e957a6b044a5","resolution":{"observed_at":"2026-05-19T12:32:18.219206Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":"786abdbc-e58f-4838-8cfd-1bf2090e13a5","year":2025},"citing_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-19T12:31:11.886858Z"},"links":{"citing_paper":"/paper/2505.18875"},"observation_digest":"sha256:69ef5e9f9e9b445174fb7888741c41c0c92f104780e6184bd04728bfef92ec16","observation_id":"5381e0fc-ca49-434d-baca-b685f0013007","resolution":{"observed_at":"2026-05-19T12:32:18.201593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","latest_version":5,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":3,"verified_fuzzy":63},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 23 inbound Pith citation observations for arXiv:2505.18875."}