Pith. sign in

Paper Citation Record · LEDGER

VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2401.09047.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2401.09047 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 20 of 20 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 20 of 20 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T04:17:41.966289Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-28T20:42:37.758214Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 61943750-4d7f-4672-8ecd-a3f379070f94 · inbound

VideoPhy: Evaluating Physical Commonsense for Video Generation cites this paper.

VideoPhy: Evaluating Physical Commonsense for Video Generation VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 21

Resolution
verified exact
arxiv_id, observed 2026-05-20T11:34:37.674070Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-20T11:34:37.599691Z digest=sha256:aaeb0a85dc418bc304aa63244f132babe70cf5302714293c8949f84d9c30f413

Observation dd7cb2c8-e7b9-431a-9de9-bea657ea087a · inbound

Self-Correcting Text-to-Video Generation with Misalignment Detection and Localized Refinement cites this paper.

Self-Correcting Text-to-Video Generation with Misalignment Detection and Localized Refinement VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-05-23T08:25:29.399875Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-23T08:25:01.468957Z digest=sha256:425e8bf083cc44417a07cd9f607003fd1dc25a7f0d335664c46389e9ac8a617d

Observation 5097c0bc-7d99-47ec-9c4f-7c63f369dd8f · inbound

GenWorld: Towards Detecting AI-generated Real-world Simulation Videos cites this paper.

GenWorld: Towards Detecting AI-generated Real-world Simulation Videos VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T04:17:41.966289Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:17:41.966289Z digest=sha256:56d9fa34d88a910983db246b02622b9095a7791ab35d235ac31b189857722991

Observation 3a6eb67c-b15f-4451-9c3a-28473985f7ab · inbound

BrokenVideos: A Benchmark Dataset for Fine-Grained Artifact Localization in AI-Generated Videos cites this paper.

BrokenVideos: A Benchmark Dataset for Fine-Grained Artifact Localization in AI-Generated Videos VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-06T23:00:27.146720Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:00:27.146720Z digest=sha256:acef0bcbfabef220ab62f745c2abea1112cf1ba5527207f3634cc155fc64251d

Observation 46fbe378-bbea-4889-a070-d4940cd91b6b · inbound

VMoBA: Mixture-of-Block Attention for Video Diffusion Models cites this paper.

VMoBA: Mixture-of-Block Attention for Video Diffusion Models VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-06T21:34:02.735411Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:34:02.735411Z digest=sha256:15d19f252ad6bddee97df5e83003684b26031ff66524f23c474aa62949c8c1af

Observation d6e9ba4c-cd3e-4dda-b3c1-fca0e1b8492f · inbound

MedGen: Unlocking Medical Video Generation by Scaling Granularly-annotated Medical Videos cites this paper.

MedGen: Unlocking Medical Video Generation by Scaling Granularly-annotated Medical Videos VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T19:25:08.486175Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T19:25:08.486175Z digest=sha256:46d4cefb16c68ad31fda30e4321e62153d55e03bc4034e3595f44cb0cf918036

Observation f4f2ae74-7812-47bc-a722-ce191102550d · inbound

Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling cites this paper.

Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-05-19T05:17:06.589884Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-05-19T05:13:28.767788Z digest=sha256:dab03ee393cbe2641833c1c25ea62679986734aaaf2b2748e733fab369ae82b1

Observation 8810f6f2-aaaf-4388-928d-e5c72e04051e · inbound

Look Beyond: Two-Stage Scene View Generation via Panorama and Video Diffusion cites this paper.

Look Beyond: Two-Stage Scene View Generation via Panorama and Video Diffusion VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-05T13:15:10.831723Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:15:10.831723Z digest=sha256:f2c029d237fff39e1eda9cd47144319f848a829962ebf14e51a632a57c090b6d

Observation a1bacb86-aa2e-41d6-aca7-f49386097804 · inbound

Enhancing Physical Plausibility in Video Generation by Reasoning the Implausibility cites this paper.

Enhancing Physical Plausibility in Video Generation by Reasoning the Implausibility VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 6

Resolution
verified exact
arxiv_id, observed 2026-05-18T12:56:24.379659Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-18T12:55:42.679016Z digest=sha256:099f9b6b32466a325ccb9b7764fb3316d1457d52eddab7e599d1f9d8fa31b413

Observation ac82ad09-cc7d-4dd3-baa3-98f9088a33c8 · inbound

GT-SVJ: Generative-Transformer-Based Self-Supervised Video Judge For Efficient Video Reward Modeling cites this paper.

GT-SVJ: Generative-Transformer-Based Self-Supervised Video Judge For Efficient Video Reward Modeling VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-05-25T07:16:41.958687Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-25T07:15:42.680351Z digest=sha256:d14b7db05d4430d4484f0707434caafd13ea6d5d3cc0168816b70a0dc66852db

Observation fbc1b97f-5ed5-4c15-b885-f37a6d80aceb · inbound

MoRight: Motion Control Done Right cites this paper.

MoRight: Motion Control Done Right VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-11T06:26:01.094129Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-10T17:38:03.776766Z digest=sha256:550bfcc68a9626ce8d13e46b277cf6ed175f7f198f410d0b6187da5a8093f496

Observation 003847c4-5857-45ac-8687-d5072e528f9c · inbound

DVAR: Adversarial Multi-Agent Debate for Video Authenticity Detection cites this paper.

DVAR: Adversarial Multi-Agent Debate for Video Authenticity Detection VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 8

Resolution
verified exact
arxiv_id, observed 2026-05-10T07:52:13.606676Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-10T07:51:04.580617Z digest=sha256:8f75f27e12ccc70a060323d11ec38b4c8d8c85eb492ab7109221b6c7ef62ebff

Observation 41c64761-3b6b-4330-9bf9-988ed60ec2d6 · inbound

TS-Attn: Temporal-wise Separable Attention for Multi-Event Video Generation cites this paper.

TS-Attn: Temporal-wise Separable Attention for Multi-Event Video Generation VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-05-10T02:53:29.915192Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-10T02:45:10.577070Z digest=sha256:24874b57cd628bc72773c7c04f492c46cf317e8309433de9ea80bcda6a9d7f3f

Observation f47ea10a-e547-4bec-9c29-f0a84e4105df · inbound

3D Reconstruction Techniques in the Manufacturing Domain: Applications, Research Opportunities and Use Cases cites this paper.

3D Reconstruction Techniques in the Manufacturing Domain: Applications, Research Opportunities and Use Cases VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 194

Resolution
metadata mismatch
arxiv_id, observed 2026-05-12T10:26:30.499865Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-07T06:03:08.874758Z digest=sha256:9e45b9a22c9dc56dbf9c1c0a6dfc140b15d92eaf8b9d4ca50d45640197e00c3f

Observation 631bb4b8-b465-4382-96a1-593c2ff13f5e · inbound

Substantial, Decomposable, and Invisible: Visual Context Misalignment in Instructional Videos for Physical Tasks cites this paper.

Substantial, Decomposable, and Invisible: Visual Context Misalignment in Instructional Videos for Physical Tasks VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-05-20T14:13:21.277981Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-20T14:10:09.223869Z digest=sha256:b1bc14d27b71eb6578a42403520b4cd82c821859c772944f7adcbe9a210fcef9

Observation aa4dba0c-0520-4ab7-9817-6dea9b083c72 · inbound

Activation Concentration: Characterizing Column-Level Output Sparsity Across Diffusion Model Architectures cites this paper.

Activation Concentration: Characterizing Column-Level Output Sparsity Across Diffusion Model Architectures VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-06-28T20:42:37.759728Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-06-28T18:23:25.570021Z digest=sha256:d26b7fb10bdb04d5d7495e7635fb098831ca13ec34ec53b5535dbb598185c6d0

Observation 693973c7-37fe-447c-abe1-2a7cd9eabb6e · inbound

Moving Alphabet: A Controlled Study of Training Data for Text-to-Video Generation cites this paper.

Moving Alphabet: A Controlled Study of Training Data for Text-to-Video Generation VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-01T14:24:46.067822Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T14:24:46.067822Z digest=sha256:1e6f3862fc3fea7e6317393121c1580e9a26d9935de0bb7ffbdeea9bf4d50cfd

Observation 3b135105-3c35-475d-8696-05d0f6bf9543 · inbound

VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation cites this paper.

VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-07-30T21:29:21.953818Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T21:29:21.953818Z digest=sha256:600b6bdd0a659a0c91f90c241c6c4619da5b41a0b45943dca6b2d02283b83385

Observation 91d7b5e8-339c-4c31-8f7d-b0d819ead46b · inbound

Retrieval-Driven Training-Free AI-Generated Video Attribution cites this paper.

Retrieval-Driven Training-Free AI-Generated Video Attribution VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-03T16:36:46.182549Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T16:36:46.182549Z digest=sha256:1bf0c87089edf24b6555a131ce2c23260349c6228cdff6e32e1b426e92c8ea04

Observation b4bc5000-6fc6-444d-b6d5-7d02b8d7ed83 · inbound

RAID: Towards Robust AI-Generated Image Detection with Bit-Reversed Images cites this paper.

RAID: Towards Robust AI-Generated Image Detection with Bit-Reversed Images VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-03T16:19:59.276986Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T16:19:59.276986Z digest=sha256:838ea79b7fc7997d2f4d83e2ad61f51e4cf5e4d99d4fb5f73b33ce8aa4bfb6f1