Pith. sign in

Paper Citation Record · LEDGER

VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2303.08320.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2303.08320 v4

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 19 of 19 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 19 of 19 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-09T17:34:10.088933Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T22:49:00.811936Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 6d5d256a-5199-48db-903f-0e6f59148992 · inbound

Movie Gen: A Cast of Media Foundation Models cites this paper.

Movie Gen: A Cast of Media Foundation Models VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 45

Resolution
verified exact
arxiv_id, observed 2026-05-11T14:16:25.123993Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-11T14:16:18.521699Z digest=sha256:7c11ac8e7844f4cbb9024ed72945a0bfd1f92911f4eb13537f83994af9327d97

Observation 5cc5827b-6f53-4df8-b8bf-1e6039e9b06d · inbound

Self-Correcting Text-to-Video Generation with Misalignment Detection and Localized Refinement cites this paper.

Self-Correcting Text-to-Video Generation with Misalignment Detection and Localized Refinement VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 27

Resolution
verified exact
arxiv_id, observed 2026-05-23T08:25:29.337738Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-23T08:25:01.468957Z digest=sha256:9943360aad762f283b41843a3c9cdf8adb291e33201fb07b9cfe789d6c63a49f

Observation 1e82a8e0-03b7-480c-81fa-a0c3b06e56e2 · inbound

Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations cites this paper.

Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 111

Resolution
verified exact
arxiv_id, observed 2026-05-12T18:38:11.251784Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-05-12T18:38:11.110166Z digest=sha256:8c523e2204ff95a2acef6c41d2df1f04ef3edd1db12e54e87d148a7e677b1bb3

Observation 3f6a5461-697a-4484-a276-9d89b8e2ca84 · inbound

HuViDPO:Enhancing Video Generation through Direct Preference Optimization for Human-Centric Alignment cites this paper.

HuViDPO:Enhancing Video Generation through Direct Preference Optimization for Human-Centric Alignment VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-09T17:34:10.088933Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T17:34:10.088933Z digest=sha256:1e6ee28270c766354f08567ced794b6b94b45b7eababeaa3dd892c79e1783a7a

Observation b50c31fb-2946-4b91-bf0a-41b91b03745f · inbound

Next Block Prediction: Video Generation via Semi-Autoregressive Modeling cites this paper.

Next Block Prediction: Video Generation via Semi-Autoregressive Modeling VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-08T11:51:13.227463Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T11:51:13.227463Z digest=sha256:33df5abc6e684cf91e6c04644ddbb53041023f64fe52450a8c2b4d472311dc7e

Observation ae0d8297-91b7-4cc9-9557-3208a3e74c0d · inbound

Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models cites this paper.

Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-07T05:36:15.636162Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T05:36:15.636162Z digest=sha256:83eec72d403c1822e02e83a8948fbc9a0b92adb72cf2d61d020f95c9b9b47675

Observation c375f6ff-c488-4805-aba1-7e03228e56bf · inbound

VABench: A Comprehensive Benchmark for Audio-Video Generation cites this paper.

VABench: A Comprehensive Benchmark for Audio-Video Generation VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-05-17T00:08:43.918082Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-17T00:03:45.576961Z digest=sha256:09d7dcd754b555c8a839272b58e6dd46ecb2537b1b3879e90fa7a38dfae0873d

Observation df33fe41-8768-4538-b113-f7ca2720e351 · inbound

Evolution of Video Generative Foundations cites this paper.

Evolution of Video Generative Foundations VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 101

Resolution
verified exact
arxiv_id, observed 2026-05-11T00:05:51.385213Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-10T18:41:38.616611Z digest=sha256:645dcaac800c98fe08ed966e46173616156d494369180bc175c2c1c4b414b53c

Observation a2a1123d-922c-43f3-a1f0-c1291002f8b1 · inbound

VGA-Bench: A Unified Benchmark and Multi-Model Framework for Video Aesthetics and Generation Quality Evaluation cites this paper.

VGA-Bench: A Unified Benchmark and Multi-Model Framework for Video Aesthetics and Generation Quality Evaluation VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 23

Resolution
verified exact
arxiv_id, observed 2026-05-11T09:56:04.349804Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-10T15:44:02.709823Z digest=sha256:eb461518ac01503b3792d6ef92aba8d28a4db8d4ca9fe143b452f0faf2b80b1c

Observation 1bdb771e-87b3-471b-b29b-791ca44b61ee · inbound

Dynamic Video Generation: Shaping Video Generation Across Time and Space cites this paper.

Dynamic Video Generation: Shaping Video Generation Across Time and Space VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 26

Resolution
verified exact
arxiv_id, observed 2026-05-21T05:43:58.793582Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-21T05:42:41.925474Z digest=sha256:a4f1e0e19161042d88aacca943d7224d18c54cb4567eea5f0408f336e49cde8c

Observation ba90d827-b445-410e-bc6f-1a8a99027ebf · inbound

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments cites this paper.

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 46

Resolution
metadata mismatch
arxiv_id, observed 2026-07-01T18:25:57.827823Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-29T02:03:45.564122Z digest=sha256:4fd148053d69bf7d953c81b2ff6be55eefa97598c039046b0b40fc0c84a0cb8e

Observation d958836d-fa44-4659-83ae-42d9b6774d94 · inbound

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments cites this paper.

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 46

Resolution
metadata mismatch
arxiv_id, observed 2026-07-01T09:35:40.647952Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-07-01T06:25:58.872140Z digest=sha256:b6882f2994aabc1e97c5950e441e91bb30c29560fa79b9733382c6e2c34fc976

Observation 827b35af-659f-4f91-88b7-aad354eb5087 · inbound

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments cites this paper.

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 46

Resolution
metadata mismatch
arxiv_id, observed 2026-07-02T20:57:22.754580Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-07-02T20:52:28.444524Z digest=sha256:4ee86f605a803e191ff69eca4c1e3bfe5536735d9599811ff832a7b5f742629b

Observation b3479984-be52-4d69-ba43-9e245cd6e527 · inbound

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments cites this paper.

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 46

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T22:49:00.814404Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-07-03T22:44:16.272541Z digest=sha256:591bcceef8ca9a09006739d25a68a6dbac8fe3fdb2e68e983d25c2a6d96da26b

Observation 3c98606b-c722-46e4-a839-cd3ec72c6789 · inbound

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments cites this paper.

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 46

Resolution
unresolved
no resolver link, observed 2026-07-14T17:14:19.770867Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T17:14:19.770867Z digest=sha256:088ccd078400b3f52bf27a74d905592010d247cc61568568ec54d713c9ccc77e

Observation c9685d15-0f55-4f0f-955c-1b5b368ba7f6 · inbound

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments cites this paper.

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-02T10:00:12.931363Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T10:00:12.931363Z digest=sha256:e3a7575d2adb499ab9f56328da36060d10e1c26ee6a4b7fa3c9ba8ab7bb8add3

Observation a493f91e-91fb-43c9-9c1f-76d66a316974 · inbound

Flex-Forcing: Towards a Unified Autoregressive and Bidirectional Video Diffusion Model cites this paper.

Flex-Forcing: Towards a Unified Autoregressive and Bidirectional Video Diffusion Model VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 14

Resolution
unresolved
no resolver link, observed 2026-07-12T01:59:48.820112Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T01:59:48.820112Z digest=sha256:d2452aca70f0dea5738f0e2fd8b57b6f7ab1762a8ba8e0a385098bd7ea5c94ad

Observation ebb93047-d7ca-4954-8a82-418d60547826 · inbound

From World Action Models to Embodied Brains: A Roadmap for Open-World Physical Intelligence cites this paper.

From World Action Models to Embodied Brains: A Roadmap for Open-World Physical Intelligence VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 148

Resolution
unresolved
no resolver link, observed 2026-07-14T03:51:24.547781Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-14T03:51:24.547781Z digest=sha256:759b062c306ee0ff678ae6fdf961035f97eea042db3799ff9f2e8f90570d8423

Observation 74ce9a22-650f-4924-bd2a-128d9ad5ba63 · inbound

4DHumanDiff: Direct Text-to-4DGS Generation for Consistent 360-Degree Dynamic Humans cites this paper.

4DHumanDiff: Direct Text-to-4DGS Generation for Consistent 360-Degree Dynamic Humans VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Reference 118

Resolution
unresolved
no resolver link, observed 2026-08-01T04:24:27.251462Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T04:24:27.251462Z digest=sha256:55942463e6f655fe97a10af480d7d73bda29118f633321dd15674ae0c0c46a73