Pith. sign in

Paper Citation Record · LEDGER

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

As of 19 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 6 inbound Pith citation observations for arXiv:2506.18851.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.18851 v1

Coverage vector

measured 49 of 49 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T23:20:12.568377Z

measured 55 of 55 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-19T06:32:44.657259+00:00

measured 6 of 6 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-05T05:01:36.599895Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-01T22:26:17.493582Z

Reference resolution

49 of 49 outbound references displayed

  • verified exact0
  • verified fuzzy13
  • unresolved36
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e054ca19-271c-42b6-8a20-7e96b239d4f7 · outbound

This paper cites https://app.klingai.com/cn/image-to-video/frame-mode/new.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset https://app.klingai.com/cn/image-to-video/frame-mode/new

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:14.987254Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:07.281280Z digest=sha256:3ab2ee5148cb5274c54ede9dcfe0add860220eb3d30622906ee48892890cb075

Observation 936aa0b0-b79c-4a16-a8e4-7ed62334a08a · outbound

This paper cites Qwen2.5-VL Technical Report.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Qwen2.5-VL Technical Report

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:07.412919Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:07.412919Z digest=sha256:f49fb50d7ae2326595f00c07e4bb38df890d20d3ab7545e22f39818ea8519562

Observation c5d73f85-b81a-4a94-99d3-fcf0bf3a9c45 · outbound

This paper cites Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:07.559950Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:07.559950Z digest=sha256:ccdb5cfd6eb6cc5a7fb4fa95c1528c4c43718c3ec3725168e2eae42e663a36f3

Observation 242bf04c-e758-4187-b6d1-cf2130d6b3c4 · outbound

This paper cites Video generation models as world simulators, 2024.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Video generation models as world simulators, 2024

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:14.818122Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:07.661980Z digest=sha256:378ff31cd3001a020b81b9332b58797ebc6c14a826e709f0542097744e65abf8

Observation 548c22ba-b600-4b5a-bf1d-30c42a03901e · outbound

This paper cites Goku: Flow Based Video Generative Foundation Models.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Goku: Flow Based Video Generative Foundation Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:07.782664Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:07.782664Z digest=sha256:15b9c93705c14d54eb7397da5f250a5962c91788b4cc06e293c06acfd6480b81

Observation ccb1ac78-a014-4123-8381-65deac622c07 · outbound

This paper cites Multi-subject Open-set Personalization in Video Generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Multi-subject Open-set Personalization in Video Generation

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:07.898058Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:07.898058Z digest=sha256:d4c6ffea245413a227fcd796ef1a777f65d142a6ce91d9635d69f90c118b6614

Observation d8217f7b-09bc-4179-971b-4fc5e54330c7 · outbound

This paper cites Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.003946Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.003946Z digest=sha256:abdc51aa0a45acec83a2864dd41aac23964fa6fc21a70f1ec421e7229ee25d3e

Observation 971e06cd-2ee5-4ab8-a7fa-a831ca7511a0 · outbound

This paper cites Arcface: Additive angular margin loss for deep face recognition.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Arcface: Additive angular margin loss for deep face recognition

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.123630Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.123630Z digest=sha256:579f694649462e9e07b27a0644116196e2c3b099329b86adedef099664f69cd4

Observation 3e6fad62-7218-485c-ae16-187812f6a501 · outbound

This paper cites CINEMA: Coherent Multi-Subject Video Generation via MLLM-Based Guidance.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset CINEMA: Coherent Multi-Subject Video Generation via MLLM-Based Guidance

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.256451Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.256451Z digest=sha256:cefb818fbfdac994467155840ec0de0c3665d930c7623edd543f0d71a0aa7159

Observation 3578d72a-dae4-4e0f-9541-0faced2c218e · outbound

This paper cites SkyReels-A2: Compose Anything in Video Diffusion Transformers.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset SkyReels-A2: Compose Anything in Video Diffusion Transformers

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.358935Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.358935Z digest=sha256:7906203eb59f4d9e9b363bca94f9a1929f7e1d50893a2e58c3a1fc1656eb64df

Observation 57719d53-065c-4e7b-b3a9-0bc249ad4b04 · outbound

This paper cites I2vcontrol-camera: Precise video camera control with adjustable motion strength.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset I2vcontrol-camera: Precise video camera control with adjustable motion strength

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:14.649542Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:08.485574Z digest=sha256:4de544def8a30cefbb146a09e1d53c478965f73d608a83b3a2a01c6c04930159

Observation 227326dc-bb45-4984-981c-ad6bb01eef67 · outbound

This paper cites Animatediff: Animate your personalized text-to-image diffusion models without specific tuning.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Animatediff: Animate your personalized text-to-image diffusion models without specific tuning

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:14.474650Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:08.625636Z digest=sha256:7d9a3b2961b98ea92035d1ec8c72c680a2742b355391ad4c59beb51811a56c55

Observation ade09c8e-7940-458e-a4f2-31fbdbd37459 · outbound

This paper cites PuLID: Pure and Lightning ID Customization via Contrastive Alignment.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset PuLID: Pure and Lightning ID Customization via Contrastive Alignment

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.734489Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.734489Z digest=sha256:28919bde544de1ecebd24223046d54198600af04c49863834666a4fbcbe93655

Observation 11c68245-bd68-4e00-8edf-4e413d3f47ed · outbound

This paper cites Classifier-Free Diffusion Guidance.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Classifier-Free Diffusion Guidance

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.795807Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.795807Z digest=sha256:39a2342a61cdd969b821c3ef2176ed0d7f9ba111813ca211395fffb6bafa14ca

Observation e5b62196-1ce5-4a5b-a4a0-0392792676e0 · outbound

This paper cites Denoising diffusion probabilistic models.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Denoising diffusion probabilistic models

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.907570Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.907570Z digest=sha256:dd677b94672966240402252ed49251e09f1a4f98754baf73bc7c5451e21dc1b0

Observation 58f7b177-7e25-4ffd-9e74-4d96c07dd3e0 · outbound

This paper cites Animate anyone: Consistent and controllable image-to-video synthesis for character animation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Animate anyone: Consistent and controllable image-to-video synthesis for character animation

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.983118Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.983118Z digest=sha256:9627473e5b2e52be92c14b78984addc5b5733a29d90c9b3e7044352568b98613

Observation 4fe3aad9-1022-4d98-a760-24ab29b51e31 · outbound

This paper cites HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.055319Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.055319Z digest=sha256:c3ed379c89f39f9f54e21f5f21a83f946ccbdc7661e52891b63dd8982972e3e0

Observation 2f7e3dc0-1256-49f6-a739-3e6d4563e608 · outbound

This paper cites ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.114978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.114978Z digest=sha256:1eb1ada28d0d441146abff385c6716442516f5788d66a46617361e27765dd77c

Observation 769b552b-9c95-4183-b04a-ada93d330dec · outbound

This paper cites Vbench: Comprehensive benchmark suite for video generative models.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Vbench: Comprehensive benchmark suite for video generative models

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:14.336502Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:09.162659Z digest=sha256:181f62c10064b59ced487c76af1c0c6db4a9524d9c9fa792a40ec62a0bb0428a

Observation 5f8fba00-c4c0-4fd9-98ff-0d666e4b8f59 · outbound

This paper cites VACE: All-in-One Video Creation and Editing.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset VACE: All-in-One Video Creation and Editing

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.206886Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.206886Z digest=sha256:16ec9d32325afa970cf7df79c3dd68361a18b21d4798808c9cb4e4524fc2fffe

Observation 6d30fc64-2077-4d5d-b3d9-fb1fae6e4570 · outbound

This paper cites FullDiT: Multi-Task Video Generative Foundation Model with Full Attention.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset FullDiT: Multi-Task Video Generative Foundation Model with Full Attention

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.305048Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.305048Z digest=sha256:a6c3c31aa4fb58e4edd29529ee81bfc1f7c9d0b06d39fe1de6c1db3de3d4c560

Observation ec7b89bf-d2d0-48a1-a74b-f7d73eb4e67c · outbound

This paper cites Videopoet: a large language model for zero-shot video generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Videopoet: a large language model for zero-shot video generation

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:14.163161Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:09.407365Z digest=sha256:359921fc663421c8fc59837012cb7bf0d502d0d037bf8e2872f08e745eaf3a9e

Observation c129c7a5-e80e-46b0-b21e-6dd4e20cd887 · outbound

This paper cites HunyuanVideo: A Systematic Framework For Large Video Generative Models.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset HunyuanVideo: A Systematic Framework For Large Video Generative Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.515493Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.515493Z digest=sha256:ec111edbdbedf49b73c3c6f69b01ee97f553e9583499714b59b4f71ae795de07

Observation 8f8ddeed-db8f-4a40-9ddb-f0c2b1ebc380 · outbound

This paper cites Movie Weaver: Tuning-Free Multi-Concept Video Personalization with Anchored Prompts.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Movie Weaver: Tuning-Free Multi-Concept Video Personalization with Anchored Prompts

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.663233Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.663233Z digest=sha256:4c86c5cde47dcd8e1ce9f20b7c0090afb6a50d0271f76c72cb0f071f964b1ddb

Observation 87b65c95-68b9-4163-86f1-1f87160406fe · outbound

This paper cites Flow Matching for Generative Modeling.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Flow Matching for Generative Modeling

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.789388Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.789388Z digest=sha256:b5ad1c32571e66b19877faa251572308904d8c3dc4147e86bcb81c41b1a70b4e

Observation c8e34aed-e30e-4720-8208-b41d58262609 · outbound

This paper cites Improving Video Generation with Human Feedback.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Improving Video Generation with Human Feedback

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.835019Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.835019Z digest=sha256:446f7031f0cbe9c2fd31f206554c99d7039029f5f10ac91d3b2af9751e484d7f

Observation cde2f2fb-60aa-483a-8704-ee42bd252af6 · outbound

This paper cites Phantom: Subject-consistent video generation via cross-modal alignment.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Phantom: Subject-consistent video generation via cross-modal alignment

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.885970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.885970Z digest=sha256:ddc7bc7abdaa7d06ea9fc893bfad5c55bf6217c9ddf82fa48b8eeda59125d674

Observation e32443b8-c6cc-45a4-b9b2-e08c609cd345 · outbound

This paper cites Flow straight and fast: Learning to generate and transfer data with rectified flow.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Flow straight and fast: Learning to generate and transfer data with rectified flow

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.994524Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:09.945008Z digest=sha256:7c3328f741ae0c97b1d2264e66c598a55feb8ab9d9d268434055931f10d112c4

Observation 6fc12ddd-5bd7-47c0-9aa3-6803ee8a27d2 · outbound

This paper cites Dreamo: A unified framework for image customization.arXiv preprint arXiv:2504.16915, 2025.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Dreamo: A unified framework for image customization.arXiv preprint arXiv:2504.16915, 2025

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:10.014742Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:10.014742Z digest=sha256:64f15808c425aaff23524e072e5f3c87d6251f33de89623ded1b813182238cd1

Observation bb18a231-7d10-40bf-9495-4b25aa743b7b · outbound

This paper cites DINOv2: Learning Robust Visual Features without Supervision.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset DINOv2: Learning Robust Visual Features without Supervision

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:10.131887Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:10.131887Z digest=sha256:1029120e13b90eb297c41b5c79b7b47cba576f944ce01e721978eef9417a1e41

Observation 4d755b7a-55be-4e1e-b26e-43458ca8b5fa · outbound

This paper cites Dinov2: Learning robust visual features without supervision.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Dinov2: Learning robust visual features without supervision

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.800703Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:10.226623Z digest=sha256:ad36d6f443ac0235952a66aaba043a21ab82b6c18bf09dc7dbf1db794a3376b4

Observation c8554331-8089-4797-8ee1-b3731b9d9c15 · outbound

This paper cites DreamBench++: A Human-Aligned Benchmark for Personalized Image Generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset DreamBench++: A Human-Aligned Benchmark for Personalized Image Generation

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:10.324650Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:10.324650Z digest=sha256:957d353f8a53ec024149fdd8eb1b6c0ccc22f73cc76ff0be1038b43612fceeb1

Observation 15c9c35d-d7e8-45c9-918e-6c3ee2b72c86 · outbound

This paper cites Movie Gen: A Cast of Media Foundation Models.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Movie Gen: A Cast of Media Foundation Models

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:10.412598Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:10.412598Z digest=sha256:cd908a87dcdb31a3fc2102c6d98983601d555b0c31ae896e968532aa48956e8d

Observation 34b8a0e4-285d-4c45-8c7c-6881a8c5a151 · outbound

This paper cites Learning transferable visual models from natural language supervision.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Learning transferable visual models from natural language supervision

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:10.519908Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:10.519908Z digest=sha256:9fa9c6e9d88f2b3bdef3f4b5bc5b4c69d6ec683242766b526fdd26b73e2089eb

Observation b461a489-b1b1-4cb4-b54f-bd9d57b55bff · outbound

This paper cites Magi-1: Autoregressive video generation at scale, 2025.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Magi-1: Autoregressive video generation at scale, 2025

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.626322Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:10.671514Z digest=sha256:ef08f4db32c12ae52f8c2532b451f838b97f2224bf5d907e0e6fedeb228adef6

Observation 2acd82f9-768b-417d-9c3a-133d924b6aef · outbound

This paper cites Laion-5b: An open large-scale dataset for training next generation image-text models.Advances in neural information processing systems, 35:25278–25294, 2022.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Laion-5b: An open large-scale dataset for training next generation image-text models.Advances in neural information processing systems, 35:25278–25294, 2022

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.475758Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:10.817178Z digest=sha256:2ef0e306cab2462d70d1ecda39f6a389ccb32a004b5ba340296af094aa394d6b

Observation 4ec1201b-19ef-4f14-b7b5-35fd9534eabf · outbound

This paper cites Seaweed-7B: Cost-Effective Training of Video Generation Foundation Model.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Seaweed-7B: Cost-Effective Training of Video Generation Foundation Model

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:10.982218Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:10.982218Z digest=sha256:9c3f1ae1b168750e510ad7832aed4c5fbe25856c03b23035c52857a1893a637a

Observation 27480fe9-8169-42c9-91bd-d49daaab8682 · outbound

This paper cites 1st solution in google universal image embedding.https://www.kaggle.com/ datasets/louieshao/guieweights0732, april 2023.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset 1st solution in google universal image embedding.https://www.kaggle.com/ datasets/louieshao/guieweights0732, april 2023

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.342298Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:11.107832Z digest=sha256:d9f59331e2c4c25860a72f75903d61361529e7c51b5e0ccbd1fefe1d6960213e

Observation e02e20b3-e3c6-4622-a35b-ca2169098098 · outbound

This paper cites Wan: Open and Advanced Large-Scale Video Generative Models.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Wan: Open and Advanced Large-Scale Video Generative Models

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:11.402590Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:11.402590Z digest=sha256:d7845dd6f10dc16f35e59d7fb5201078839c874ae0e4b9af3947dd3111b6cde3

Observation 295f7e3f-39f7-4945-aefd-4fdb20e9e6b0 · outbound

This paper cites Koala-36M: A Large-scale Video Dataset Improving Consistency between Fine-grained Conditions and Video Content.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Koala-36M: A Large-scale Video Dataset Improving Consistency between Fine-grained Conditions and Video Content

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:11.524559Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:11.524559Z digest=sha256:f329a6c687286747c5ab8050ad5f580d1e1c36c8a2bd28a26428f74b86e9b37e

Observation 93a72d36-888b-4810-a952-d98bbb964178 · outbound

This paper cites MagicVideo-V2: Multi-Stage High-Aesthetic Video Generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset MagicVideo-V2: Multi-Stage High-Aesthetic Video Generation

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:11.666371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:11.666371Z digest=sha256:ddf940fdb2afd88ff3dfa7a4a198fc3028f3562a26fc671e3b6b4f80e7e14f05

Observation 24ed82c9-4a1f-4a8c-8bf0-0df209fdbbdd · outbound

This paper cites ObjectMate: A Recurrence Prior for Object Insertion and Subject-Driven Generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset ObjectMate: A Recurrence Prior for Object Insertion and Subject-Driven Generation

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:11.805625Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:11.805625Z digest=sha256:74fc59d4b4befcdc6a2687cf94ea51865922ccbe2d18f976acec0a5be282a763

Observation fee5c2ec-4bfc-471b-9a24-5c858f01a338 · outbound

This paper cites Automated Movie Generation via Multi-Agent CoT Planning.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Automated Movie Generation via Multi-Agent CoT Planning

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:11.903050Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:11.903050Z digest=sha256:e4695dece906a02b8981cd3541fa370127b573e40dd98202d7bcd772d5617e84

Observation a5f0b523-a422-4d12-956f-003f6cb3b5d5 · outbound

This paper cites Demystifying clip data.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Demystifying clip data

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.201869Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:12.011700Z digest=sha256:aa841a3aed0401fbec79d776fbcfa7383c28a5b6a426a82626f35d070ed22bcb

Observation 7a66a847-caf4-4edb-8a1f-4a23c9279113 · outbound

This paper cites Magicanimate: Temporally consistent human image animation using diffusion model.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Magicanimate: Temporally consistent human image animation using diffusion model

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:12.136554Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:12.136554Z digest=sha256:f7012715d48ab78fd1610f54abb1fe75084cbfbe902c6f830b5ced4f2dbc14a9

Observation 13d8e36f-b585-41e5-b67b-88d083295212 · outbound

This paper cites Qwen2.5 Technical Report.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Qwen2.5 Technical Report

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:12.221510Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:12.221510Z digest=sha256:805ac91e3cdd271f688bd6cc85f3d9cfe10362693c4fec8497264be5d4c2a1bf

Observation a0d0ab4a-a491-4c73-8109-3edb5a25304c · outbound

This paper cites CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:12.336672Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:12.336672Z digest=sha256:8bc075417206793e4980266f74f845a1a84ec43cbf842b58c89e8dad8f43b560

Observation e8f64890-f3de-4bc5-99b4-93aeaf419afe · outbound

This paper cites Make pixels dance: High-dynamic video generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Make pixels dance: High-dynamic video generation

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.067847Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T23:20:12.457366Z digest=sha256:57e06c798b59863bca58581674368e43ab55ca60b2eaf2e8a59dc31f12f54336

Observation 76c4d674-998f-407b-bbb5-a3ba01a77a12 · outbound

This paper cites Concat-ID: Towards Universal Identity-Preserving Video Synthesis.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Concat-ID: Towards Universal Identity-Preserving Video Synthesis

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:12.568377Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:12.568377Z digest=sha256:96b707f98c6b86248142bf50937b3f0569099b0e73b8c8c4e9d77ebd48ab5b91

Pith citing papers

Observation d7942705-b27f-4f09-890e-891109501909 · inbound

Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute cites this paper.

Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-22T17:51:54.300099Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-22T17:51:41.947939Z digest=sha256:e168f3a4489fe58510537d8db7d6a87048e36da130d40f49af24caa074346c20

Observation a1f20d76-310a-4586-a321-85045de90fa4 · inbound

Effectively obtaining acoustic, visual and textual data from videos cites this paper.

Effectively obtaining acoustic, visual and textual data from videos Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-05T05:01:36.599895Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T05:01:36.599895Z digest=sha256:5fb5fe9f33c0ac6a2ad8a132272b61db899fecc8b30df6fb31b08bb5d797aa1d

Observation f8a3e20d-7692-4182-9507-4d1993b7f947 · inbound

Rethinking Position Embedding as a Context Controller for Multi-Reference and Multi-Shot Video Generation cites this paper.

Rethinking Position Embedding as a Context Controller for Multi-Reference and Multi-Shot Video Generation Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

Reference 5

Resolution
unresolved
no resolver link, observed 2026-07-13T12:23:05.876881Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T12:23:05.876881Z digest=sha256:1523f32c34554b7be65404b845b6965ceff36231d89532c844713db599ca0061

Observation 8fe950cd-cffc-4b16-a4ea-2cea998ba90f · inbound

Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation cites this paper.

Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

Reference 6

Resolution
verified exact
arxiv_id, observed 2026-05-20T14:13:21.413127Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-20T14:08:30.802619Z digest=sha256:c73ae0dd584e768b53bac26b790d93473e361ec2764d21de7836d62a0e34d886

Observation 6f242034-23f8-49cc-aae1-3121792460bf · inbound

Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation cites this paper.

Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-07-01T22:26:17.495216Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-06-28T15:25:22.778550Z digest=sha256:71b59b03cc6937b44edc4bc3adc87ce85adf1edac46acd7fe01bbf87dedab620

Observation d0b5bbb2-e48a-4852-b2d2-ab7b4d43a9b4 · inbound

FlowMimic: Mask-free Visual Editing and Generation with Pixel-pair Warped Flow Field for Online Video Editing Data Generation and Modality Mimicry cites this paper.

FlowMimic: Mask-free Visual Editing and Generation with Pixel-pair Warped Flow Field for Online Video Editing Data Generation and Modality Mimicry Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-01T15:42:03.214892Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:42:03.214892Z digest=sha256:cb7d2025976bc89c8819547bc2982df541f13e44ff1c78454c5c1d24f53c23b8