{"as_of":"2026-08-08T11:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:da413921fd3db62e23faedca81f5cb598f05e235d0884fc6c88b75b3d4d9b63b","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:45:11.721662Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:51:04.877354Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T19:18:19.379629Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21036","snapshot_observed_at":"2026-08-06T23:51:04.877354Z","title":"Rainfusion: Adaptive video generation acceleration via multi-dimensional visual redundancy","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16054","last_updated":"2025-06-19T06:25:02Z","snapshot_observed_at":"2026-08-07T13:41:59.610268Z","submitted_at":"2025-06-19T06:25:02Z","title":"PAROAttention: Pattern-Aware ReOrdering for Efficient Sparse and Quantized Attention in Visual Generation Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:04.877354Z"},"links":{"cited_paper":"/paper/2505.21036","citing_paper":"/paper/2506.16054"},"observation_digest":"sha256:1b357a6f79c39a57ac50cac4950bef4d89d88366f545bf5fb01e0ad1d01c7211","observation_id":"bf589556-c1e2-4d91-8b0d-f413ca89f1fc","resolution":{"observed_at":"2026-08-06T23:51:04.877354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"cited_work":{"arxiv_id":"2505.21036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21036","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rainfusion: Adaptive video generation acceleration via multi-dimensional visual redundancy","venue":null,"work_id":"a6bfc322-49cb-4f3c-bf04-19fcfb1e39b5","year":2025},"citing_paper":{"arxiv_id":"2512.24086","last_updated":"2026-04-20T08:06:06Z","snapshot_observed_at":"2026-07-06T22:40:23.205898Z","submitted_at":"2025-12-30T08:55:20Z","title":"RainFusion2.0: Temporal-Spatial Awareness and Hardware-Efficient Block-wise Sparse Attention","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-16T19:16:41.344504Z"},"links":{"cited_paper":"/paper/2505.21036","citing_paper":"/paper/2512.24086"},"observation_digest":"sha256:a3f3b915ce32be7a7b8a52dc53643b827c3866bd708746fc241bf63fc73a430f","observation_id":"4a686bba-b8af-4dd5-a5ef-bc2827d95f69","resolution":{"observed_at":"2026-05-16T19:18:19.381537Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"cited_work":{"arxiv_id":"2505.21036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21036","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rainfusion: Adaptive video generation acceleration via multi-dimensional visual redundancy","venue":null,"work_id":"a6bfc322-49cb-4f3c-bf04-19fcfb1e39b5","year":2025},"citing_paper":{"arxiv_id":"2603.18636","last_updated":"2026-05-08T04:13:25Z","snapshot_observed_at":"2026-07-06T22:49:42.664225Z","submitted_at":"2026-03-19T09:00:08Z","title":"Attention Sparsity is Input-Stable: Training-Free Sparse Attention for Video Generation via Offline Sparsity Profiling and Online QK Co-Clustering","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T08:55:52.757489Z"},"links":{"cited_paper":"/paper/2505.21036","citing_paper":"/paper/2603.18636"},"observation_digest":"sha256:2e87c63e827c12628bddbd31b293f1e5d3860dd87275e41aacfd27cfc6d26117","observation_id":"4d2ac67c-cca4-4fe7-b430-e8991765f54b","resolution":{"observed_at":"2026-05-15T08:59:53.225273Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"cited_work":{"arxiv_id":"2505.21036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21036","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rainfusion: Adaptive video generation acceleration via multi-dimensional visual redundancy","venue":null,"work_id":"a6bfc322-49cb-4f3c-bf04-19fcfb1e39b5","year":2025},"citing_paper":{"arxiv_id":"2605.14513","last_updated":"2026-05-14T07:57:55Z","snapshot_observed_at":"2026-08-02T01:59:59.234796Z","submitted_at":"2026-05-14T07:57:55Z","title":"HASTE: Training-Free Video Diffusion Acceleration via Head-Wise Adaptive Sparse Attention","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T05:17:48.403406Z"},"links":{"cited_paper":"/paper/2505.21036","citing_paper":"/paper/2605.14513"},"observation_digest":"sha256:78779878e61ca74d545f451947bf10e9fa75ab99f12fe197616c4eed089d2f1b","observation_id":"d75c50f4-ebb0-4ac4-a96a-4f25e1ea86b1","resolution":{"observed_at":"2026-05-15T05:19:46.033033Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21036/citation-record","integrity":"/paper/2505.21036/integrity","json":"/paper/2505.21036/citation-record.json","paper":"/paper/2505.21036"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:07.482788Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:07.482788Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:701eb282bb061094167793b3fc287c524a1ffe8601d09225916994b606eda7f7","observation_id":"8e826e5d-1fb4-4f55-9976-49de5a5ebfcb","resolution":{"observed_at":"2026-08-07T13:45:07.482788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T13:45:07.580972Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:07.580972Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:f04bb2649b891dab7116f2db995efbf4b2c1a5432d0b25c97436235a02cf463f","observation_id":"1ab7e092-0de3-4f98-a2b9-1c61bc9da826","resolution":{"observed_at":"2026-08-07T13:45:07.580972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:07.676013Z","title":"Token merging for fast sta- ble diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:07.676013Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:08af38d074aad73cfec73e1050ed45cbbb341f0ace5225029260e81a4c223f17","observation_id":"cb34eed6-21ba-42bc-9a8e-d269833307e2","resolution":{"observed_at":"2026-08-07T13:45:07.676013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:16.818058Z","title":"Pixart-σ: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":"ccdb2300-d872-4cf1-ad69-5ac108bb53d0","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:07.772022Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:890e7d659a52bb3618dc486dd54e65899f996ef3e2c8a792e9c5bee3b3a20110","observation_id":"31379dd5-0ac8-42ab-9be8-62a77e30396c","resolution":{"observed_at":"2026-08-07T13:45:17.417453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01125","last_updated":"2024-06-03T09:10:44Z","snapshot_observed_at":"2026-07-06T18:24:17.711867Z","submitted_at":"2024-06-03T09:10:44Z","title":"$\\Delta$-DiT: A Training-Free Acceleration Method Tailored for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01125","snapshot_observed_at":"2026-08-07T13:45:07.888936Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:07.888936Z"},"links":{"cited_paper":"/paper/2406.01125","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:55c411d6ec527bdd2beeeae6b40ed07733fbbe7ad114db15d884e31568648640","observation_id":"a21aa5d3-7985-4854-a5f7-c033b13ee342","resolution":{"observed_at":"2026-08-07T13:45:07.888936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:16.090872Z","title":null,"venue":null,"work_id":"1a22c3c2-dbad-48a6-8d91-63760ab25892","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:08.043441Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:838a25f19d2504b53c3b607f48f47003d55e245e56000f14ab7307ca317d7b8d","observation_id":"8fd28979-e471-4634-acd9-78171c899646","resolution":{"observed_at":"2026-08-07T13:45:16.323152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:15.874959Z","title":"Sparsevit: Revisiting activation spar- sity for efficient high-resolution vision transformer","venue":null,"work_id":"f0bc1e52-0acd-461c-a6d4-5d3c8a7db3ea","year":2023},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:08.148493Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:dad5750c4b0f27be7be8103e06e7d17166044f5fd289a033c7ac50cb029d0fd6","observation_id":"1fca4931-29d7-4fc7-b4ea-18a2cb4f4a27","resolution":{"observed_at":"2026-08-07T13:45:15.979685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:15.643723Z","title":"Guided diffusion models","venue":null,"work_id":"a68c7e0b-9d02-44c0-8b1f-81bc14d5a5d3","year":2022},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:08.214235Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:477fb83607e8ad9c57733f4383e805b125b3c928669812b39e0f9ae213be48c0","observation_id":"eaebfb49-9fbd-43fc-b10c-7d53a28dd30f","resolution":{"observed_at":"2026-08-07T13:45:15.733230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:15.409115Z","title":"Streamingt2v: Con- sistent, dynamic, and extendable long video generation from text, 2024","venue":null,"work_id":"20bd5ce9-0f43-4929-bd99-93eee6807ff4","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:08.396939Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:b693a80e8dd04c44f62ae5cc1258659b80cd9776821aa11393d88eec7f9b4ce4","observation_id":"531903ff-bc9a-430d-a6a3-138e0a67ab41","resolution":{"observed_at":"2026-08-07T13:45:15.530425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:08.489795Z","title":"Denoising dif- fusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:08.489795Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:cd2259d010d27306f6f99be273f8c64fd311cae982e115763352085ca15223a5","observation_id":"3e75432e-d60a-47fa-b596-33d4ca3a24a6","resolution":{"observed_at":"2026-08-07T13:45:08.489795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:08.580591Z","title":"Vbench: Com- prehensive benchmark suite for video generative models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:08.580591Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:a31eb19c10c559add32211664a83827c9a14397876c3c779f87229f27974d855","observation_id":"5e7cd8a0-70c2-4ad6-946d-55eeea6ea71b","resolution":{"observed_at":"2026-08-07T13:45:08.580591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:15.199309Z","title":"Abdi, Dongsheng Li, Chin-Yew Lin, Yuqing Yang, and Lili Qiu","venue":null,"work_id":"bff31a65-a1a0-4794-b3b6-5e371fbeb142","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:08.721917Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:b83e74a8bcdd77ff143e8b95475e9392194b75e0525b27837f6c5046fabafd8b","observation_id":"6bd41059-7b7f-4169-b019-e16a48cc4801","resolution":{"observed_at":"2026-08-07T13:45:15.288103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:15.022543Z","title":"Ryoo, and Tian Xie","venue":null,"work_id":"580bc29a-7404-4462-aa7e-5fbe369ce4da","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:08.824989Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:d0d95d8d7a4f820fbd2f46df8a44bb6f3b87ad96032b37efa66d937c4c1cd8c4","observation_id":"3867898e-c4a8-4056-af74-aeb2232f9bf4","resolution":{"observed_at":"2026-08-07T13:45:15.112273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:14.771419Z","title":"Hunyuanvideo: A systematic framework for large video generative models, 2025","venue":null,"work_id":"b40ad20f-37e1-482d-9c74-9f2fecb3e6ce","year":2025},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:08.921927Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:eb489b4d93b0f7c30de236336fab1eb676cecac439732590bd50aef30ce86c34","observation_id":"9bb9b5b1-e570-4715-8f55-616f122452be","resolution":{"observed_at":"2026-08-07T13:45:14.890322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:14.544343Z","title":"Autodiffusion: Training-free optimization of time steps and architectures for automated diffusion model accelera- tion, 2023","venue":null,"work_id":"6bdc64af-ff07-4a71-b423-44e1d58822d5","year":2023},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:08.988182Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:90e0a8f6c47ddf52deaba2e62c6b084a3f90cf5e9e0df04ce828c38391b4b0f7","observation_id":"c9a18f24-7db6-457c-b701-5511eda5e1bf","resolution":{"observed_at":"2026-08-07T13:45:14.637404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:14.384552Z","title":"Timestep embedding tells: It’s time to cache for video diffusion model, 2024","venue":null,"work_id":"7b149078-8dd3-426b-bcc9-96da972d2f3f","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:09.067914Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:74de52eb40f51c87849b3f820832e2957f8ac0a7b3acc2fafaf121b7f95fdf98","observation_id":"d61add74-36d4-4f4b-b6cd-d09746a70779","resolution":{"observed_at":"2026-08-07T13:45:14.488801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:14.158600Z","title":"Faster diffu- sion via temporal attention decomposition.arXiv e-prints, pages arXiv–2404, 2024","venue":null,"work_id":"c112acae-761a-4b7e-8fb1-c45599352348","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:09.214884Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:61f06d0d2266c6398d7c04c58771909e0a81f2da172d72f24634ab03b3057bfa","observation_id":"473762dc-7121-4785-8e69-98763ba75f80","resolution":{"observed_at":"2026-08-07T13:45:14.261625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09732","last_updated":"2025-01-16T18:30:37Z","snapshot_observed_at":"2026-07-06T20:22:04.328179Z","submitted_at":"2025-01-16T18:30:37Z","title":"Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09732","snapshot_observed_at":"2026-08-07T13:45:09.302188Z","title":"Inference-time scaling for diffu- sion models beyond scaling denoising steps.arXiv preprint arXiv:2501.09732, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:09.302188Z"},"links":{"cited_paper":"/paper/2501.09732","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:b9c872f1c42d3480f870ed08368c3100a9b21e2753947c75ffa5fcdd20e45a71","observation_id":"217115a7-43d7-4c3a-b3e9-819c3e50a512","resolution":{"observed_at":"2026-08-07T13:45:09.302188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01733","last_updated":"2024-11-16T07:43:28Z","snapshot_observed_at":"2026-07-06T18:24:43.282366Z","submitted_at":"2024-06-03T18:49:57Z","title":"Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01733","snapshot_observed_at":"2026-08-07T13:45:09.410733Z","title":"Learning-to-cache: Accelerating diffusion trans- former via layer caching.arXiv preprint arXiv:2406.01733,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:09.410733Z"},"links":{"cited_paper":"/paper/2406.01733","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:49c5fc3509343994c73bd61b093543a382df05aa376b8823c537c90865057541","observation_id":"d8c3a417-8360-489f-b328-292dce66eb14","resolution":{"observed_at":"2026-08-07T13:45:09.410733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:13.927444Z","title":"Deepcache: Accelerating diffusion models for free","venue":null,"work_id":"fdb07200-1099-4fa0-9d83-14539a73f76d","year":null},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:09.472325Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:1f805ef6b3559692b86c354036c4d76e0414c1769cabc0b5153dae81eb0e7dd3","observation_id":"ddd4a77e-0654-429e-89a1-adfba321a082","resolution":{"observed_at":"2026-08-07T13:45:14.042995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:13.754843Z","title":"Latte: La- tent diffusion transformer for video generation, 2024","venue":null,"work_id":"cbde83ef-c0e6-4e5c-976a-83a971e9840e","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:09.603176Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:aba806db62a08034abd5c590b29261be41e507283fab4291a4078d443a16b878","observation_id":"d90b3ad9-ee1e-4ef7-b1d2-92de1ae52aad","resolution":{"observed_at":"2026-08-07T13:45:13.867592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:09.701322Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:09.701322Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:30dcac82b03f73483dbaef7074fcece65de28925d397b80b749f20d4c0308e56","observation_id":"cd872d48-93b3-48b0-a87c-73d41cc94c2d","resolution":{"observed_at":"2026-08-07T13:45:09.701322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:13.603326Z","title":"Sora prompt, 2024","venue":null,"work_id":"27ceb55f-d759-4484-8c14-c454911ec1b3","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:09.809716Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:eb5105acaf413799e8e5c9daf29235b4042a9f184cb999c0ce8876666b780678","observation_id":"93fb295f-38d1-41be-b56b-cc29136bc3da","resolution":{"observed_at":"2026-08-07T13:45:13.676567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:13.340615Z","title":null,"venue":null,"work_id":"403bf150-bc14-48f5-96f5-e7571c36d816","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:09.886794Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:eaaf1781bb4a2ea7564186b950e2cce439348bf0dad53d7be7487d52a8ffd8b6","observation_id":"e024d2e6-6b3e-43eb-9ed2-5553a5d8a455","resolution":{"observed_at":"2026-08-07T13:45:13.444749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:09.975017Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:09.975017Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:dd5839a3f2d708242e92f84b1693ff6c9b23aa569da436fd0b4022fe4494e799","observation_id":"04c17016-bc8a-4555-875d-8be49d168dd8","resolution":{"observed_at":"2026-08-07T13:45:09.975017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:13.108578Z","title":"Open-sora plan, 2024","venue":null,"work_id":"5c47cb76-6eef-4bd1-a847-24c81aadf086","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:10.041635Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:770469f390ed754e05f67391f86bdd075bad2348f3323392a467261312443d48","observation_id":"9cb34d52-44c6-4cc3-8d1a-a93415680d73","resolution":{"observed_at":"2026-08-07T13:45:13.208777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T13:45:10.141616Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis.arXiv preprint arXiv:2307.01952, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:10.141616Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:f606a865ff01ad706cefcb13b7752cbb883e3200d6eb5d7f088dc638ef619663","observation_id":"8eba9ccf-3671-4694-8624-8e8757109417","resolution":{"observed_at":"2026-08-07T13:45:10.141616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:12.989753Z","title":"Sampson, Shikai Li, Simone Parmeggiani, Steve Fine, Tara Fowler, Vladan Petro- vic, and Yuming Du","venue":null,"work_id":"9935535a-6ef4-4b73-8302-c6df4e1d9b8b","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:10.214310Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:03ac6764051d7fcd7866ab29f79dd104cf8ffdb519e3ed39c12d7354f1dd0d46","observation_id":"11372372-ede3-44a7-b03f-493bcfa97701","resolution":{"observed_at":"2026-08-07T13:45:13.044913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:10.284805Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:10.284805Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:e818b0db90490f38c2049a20b504280ad1ddf6eacbaf3c1e8a93f7fb5e0935e6","observation_id":"41116385-9e10-4d9c-b4e9-e4737b966c68","resolution":{"observed_at":"2026-08-07T13:45:10.284805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:12.736057Z","title":"Align your steps: Optimizing sampling schedules in diffusion mod- els, 2024","venue":null,"work_id":"e650ba2b-112d-4ab0-ab5f-a757f42f23ff","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:10.381728Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:d7251f6b3faa7714e3a984f24be2ada1c59ffe04d77c1f3b57a6dabf51765f2d","observation_id":"a3ee62d5-62c7-46c1-aad7-95798887685e","resolution":{"observed_at":"2026-08-07T13:45:12.887592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13573","last_updated":"2024-05-08T05:09:48Z","snapshot_observed_at":"2026-07-06T17:33:17.224327Z","submitted_at":"2024-02-21T07:10:28Z","title":"ToDo: Token Downsampling for Efficient Generation of High-Resolution Images","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13573","snapshot_observed_at":"2026-08-07T13:45:10.504069Z","title":"Todo: Token downsampling for efficient generation of high-resolution im- ages.arXiv preprint arXiv:2402.13573, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:10.504069Z"},"links":{"cited_paper":"/paper/2402.13573","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:e4e417fa6534edc7def1f0fc3564b7d416e52ebefa42b923fa4b1819c09b0748","observation_id":"5228e9aa-bed7-478a-a789-29b66c54ffbb","resolution":{"observed_at":"2026-08-07T13:45:10.504069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15891","last_updated":"2024-07-22T01:12:23Z","snapshot_observed_at":"2026-07-06T18:50:13.559866Z","submitted_at":"2024-07-22T01:12:23Z","title":"RazorAttention: Efficient KV Cache Compression Through Retrieval Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15891","snapshot_observed_at":"2026-08-07T13:45:10.611325Z","title":"Razorattention: Ef- ficient kv cache compression through retrieval heads.arXiv preprint arXiv:2407.15891, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:10.611325Z"},"links":{"cited_paper":"/paper/2407.15891","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:8c842bbb3430efbd37bfcdd79faa4f8370843d6d52184613109d6684c0cfc98e","observation_id":"bb6e90a9-0ba2-4a1f-b48c-2bbf0d71dc5c","resolution":{"observed_at":"2026-08-07T13:45:10.611325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02730","last_updated":"2024-10-30T16:13:42Z","snapshot_observed_at":"2026-07-06T18:09:51.117905Z","submitted_at":"2024-05-04T18:27:29Z","title":"U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02730","snapshot_observed_at":"2026-08-07T13:45:10.697695Z","title":"U-dits: Downsample tokens in u-shaped diffusion transformers.arXiv preprint arXiv:2405.02730,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:10.697695Z"},"links":{"cited_paper":"/paper/2405.02730","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:c4bd8b53244eda7d4a2dd1e46ae56b9096b20b95d2a9bb10849661a01d5a4d51","observation_id":"bae6101f-c381-4ef6-be11-eb1c67b6e2fc","resolution":{"observed_at":"2026-08-07T13:45:10.697695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:10.828811Z","title":"Accelerating trans- formers with spectrum-preserving token merging.Advances in Neural Information Processing Systems, 37:30772–30810,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:10.828811Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:4adf1e6f1b4c22462484f2bda00c44a6ff292bb92fbd525b527e61df9c0ba15d","observation_id":"8fc248c8-b9e8-470d-9008-c68df22fef9c","resolution":{"observed_at":"2026-08-07T13:45:10.828811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:12.544603Z","title":"Attention-driven training-free efficiency enhancement of diffusion models","venue":null,"work_id":"07508cf0-284b-4e5d-823e-b5e49c41d04b","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:10.979239Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:9f986de192878c07b5940f77e6d3e7bb869dce1e030ede995a0f4a7884326b78","observation_id":"d4207060-fe0f-42a6-9a4c-34ac75fd5351","resolution":{"observed_at":"2026-08-07T13:45:12.640493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:12.307517Z","title":"Cache me if you can: Accel- erating diffusion models through block caching","venue":null,"work_id":"0a9fda80-052f-4b74-a58a-6b3ad16a73a9","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:11.100147Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:329134103cc69ffcbcfd50996925797fbd8a39b50c75f6d307808495a617d0a3","observation_id":"d21b4e0a-d722-4819-ae60-8211139ffdbd","resolution":{"observed_at":"2026-08-07T13:45:12.444608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16720","last_updated":"2025-04-24T21:37:00Z","snapshot_observed_at":"2026-08-03T21:05:27.147358Z","submitted_at":"2024-11-23T02:01:49Z","title":"Importance-Based Token Merging for Efficient Image and Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16720","snapshot_observed_at":"2026-08-07T13:45:11.197151Z","title":"Importance-based token merging for diffusion models.arXiv preprint arXiv:2411.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:11.197151Z"},"links":{"cited_paper":"/paper/2411.16720","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:62b1976220955a97482821e6e3ad1e4e9ef429afa22c88e3ca03fa01c15536d1","observation_id":"11c4e6df-aab0-4c74-b5df-e9e305935ad8","resolution":{"observed_at":"2026-08-07T13:45:11.197151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-07T13:45:11.296944Z","title":"Sparse videogen: Accelerating video diffusion transformers with spatial-temporal sparsity.arXiv preprint arXiv:2502.01776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:11.296944Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:64103dd72d89c9f4595274cc4bbfd7c361c799f095ed99c6a757c3f719d7c1dc","observation_id":"28a836d7-a604-44bd-b446-d255f7676526","resolution":{"observed_at":"2026-08-07T13:45:11.296944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:12.125641Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer, 2024","venue":null,"work_id":"2a1cacb0-38ee-4864-a685-19418edeafe2","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:11.419544Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:8424bc13aadb3b56a197060ac124dccdf40e255e1220dfbb57e523ee18cc098f","observation_id":"3c2a597b-b140-47a7-bb0c-05712ed7e110","resolution":{"observed_at":"2026-08-07T13:45:12.207778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:45:11.919361Z","title":"Ditfastattn: Attention compression for diffusion transformer models, 2024","venue":null,"work_id":"7e111c06-d6b7-4c3a-9d3c-71e214517796","year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:11.522068Z"},"links":{"citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:46faf38bd784fc43fae86422b989c902996e1498e666c1d0146f36a5d1b685cd","observation_id":"1d80df88-db1c-4fba-ae80-e5d34a590f87","resolution":{"observed_at":"2026-08-07T13:45:12.005328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13652","last_updated":"2025-05-20T13:06:00Z","snapshot_observed_at":"2026-07-31T17:31:30.624645Z","submitted_at":"2024-09-20T17:02:00Z","title":"OATS: Outlier-Aware Pruning Through Sparse and Low Rank Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13652","snapshot_observed_at":"2026-08-07T13:45:11.664328Z","title":"Oats: Outlier-aware pruning through sparse and low rank decomposition.arXiv preprint arXiv:2409.13652, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:11.664328Z"},"links":{"cited_paper":"/paper/2409.13652","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:e8f5f94a703afb9a8a526cbb3885dde1e197e0aacbf14b20391ad55d0d3329c4","observation_id":"5f47e94f-c121-4f8e-bca6-2792189ad26b","resolution":{"observed_at":"2026-08-07T13:45:11.664328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-07T13:45:11.721662Z","title":"Open-sora: Democratizing efficient video production for all.arXiv preprint arXiv:2412.20404, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:11.721662Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2505.21036"},"observation_digest":"sha256:459e8ca1f8f1cad837c6c36476bb68e39716723a7cd47e7041befa88a7ee5e28","observation_id":"a00149e4-fb4f-4ec2-8388-fd24fdd72370","resolution":{"observed_at":"2026-08-07T13:45:11.721662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.21036","last_updated":"2025-06-09T11:33:40Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T13:36:00.763303Z","submitted_at":"2025-05-27T11:15:02Z","title":"RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 4 inbound Pith citation observations for arXiv:2505.21036."}