Pith. sign in

Paper Citation Record · LEDGER

ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 25 inbound Pith citation observations for arXiv:2501.04698.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2501.04698 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 25 of 25 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 25 of 25 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T11:12:09.347154Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T21:10:09.709506Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 9bce90ec-478b-47cb-b44c-164db67157ec · inbound

Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute cites this paper.

Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 24

Resolution
verified exact
arxiv_id, observed 2026-05-22T17:51:54.407679Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-22T17:51:41.947939Z digest=sha256:1aee93f7b48094ea44b29f010c5d7540f533bc45c29afc5db0ed44c3f99eb402

Observation bc92ba84-61f2-483c-bbe5-3ecf2d2c648f · inbound

AnimeShooter: A Multi-Shot Animation Dataset for Reference-Guided Video Generation cites this paper.

AnimeShooter: A Multi-Shot Animation Dataset for Reference-Guided Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T11:12:09.347154Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:12:09.347154Z digest=sha256:73ef64f2055d6189b6f25762002b984a9b0c06774414477e39473710d25773b7

Observation d83768e2-1f8f-49fa-8f50-efcbe685ae2e · inbound

UNIC: Unified In-Context Video Editing cites this paper.

UNIC: Unified In-Context Video Editing ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T10:51:43.034695Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:51:43.034695Z digest=sha256:82a2d9cdd9feff2a28dad6d35f41965181b4a0d2ea126e86edcc19bd244f8454

Observation a2ebc5f8-5042-4246-882d-8f37098a098e · inbound

PolyVivid: Vivid Multi-Subject Video Generation with Cross-Modal Interaction and Enhancement cites this paper.

PolyVivid: Vivid Multi-Subject Video Generation with Cross-Modal Interaction and Enhancement ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T05:30:32.938000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T05:30:32.938000Z digest=sha256:99a1679918d0d6402fd7a286a8deb313414881748ef40fe98b65203cdac813dc

Observation b6a00451-3efa-4c79-b637-4fe082db90d5 · inbound

DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers cites this paper.

DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T04:27:37.785167Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:27:37.785167Z digest=sha256:d32a485fe6070358191b862a06f54444db83797a8281071d2e6e1e6d1d49429c

Observation 2f7e3dc0-1256-49f6-a739-3e6d4563e608 · inbound

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset cites this paper.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.114978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.114978Z digest=sha256:8868c332f36535e1bfebc7dde39f1251b05867f272f217ea972410095d366a86

Observation e6a7988e-ba77-4313-8e12-a66031786887 · inbound

Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation cites this paper.

Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T19:19:32.718300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:19:32.718300Z digest=sha256:9bd2b546652a5e659f4dcb95347ea8048300aa203fcc035f7bbfc0d8f74c8227

Observation 5b2e4943-7699-4f24-afe0-f875b9a9d6f2 · inbound

A Survey on Long-Video Storytelling Generation: Architectures, Consistency, and Cinematic Quality cites this paper.

A Survey on Long-Video Storytelling Generation: Architectures, Consistency, and Cinematic Quality ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T18:51:26.486990Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:51:26.486990Z digest=sha256:e60aeebb8538396efe7f3a48604ba548faa9fbde05465a1d4de376d2180ada9e

Observation 01466845-10fd-4bbc-add5-daa1763e6c93 · inbound

Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation cites this paper.

Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-05T20:20:21.541805Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T20:20:21.541805Z digest=sha256:2a47dbf97b31c51e06668931cf65447475b02dcc7c668c8f93b84fb788fe030e

Observation 7633f67c-7c56-4891-9b9f-5ee546cad326 · inbound

From Black Box to Transparency: Enhancing Automated Interpreting Assessment with Explainable AI in College Classrooms cites this paper.

From Black Box to Transparency: Enhancing Automated Interpreting Assessment with Explainable AI in College Classrooms ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-05T20:17:46.362851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T20:17:46.362851Z digest=sha256:c08b14c6415d7cbe8ef8dbe785043c2f3697f6fba177629667045f5fc0add43e

Observation 72a86b75-9ad0-468f-9b00-5473d56c1d02 · inbound

UniVideo: Unified Understanding, Generation, and Editing for Videos cites this paper.

UniVideo: Unified Understanding, Generation, and Editing for Videos ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-04T10:49:47.891881Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T10:49:47.891881Z digest=sha256:4960c4d390b4e604d527ccfa8570efbdb8658f4ee26b05c1c92e0df6c4c066e0

Observation c0dd0f0e-00ef-4909-8186-4fc85c7d673c · inbound

TinyHistory: Lightweight Video History Embeddings via Two-Stage Context Learning cites this paper.

TinyHistory: Lightweight Video History Embeddings via Two-Stage Context Learning ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-03T13:35:49.924520Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:35:49.924520Z digest=sha256:dc131e8205c6a302865dc63ab1fcabd87646ee83ea99e37ee8a7b5f5124ac748

Observation b4008e0f-c0e0-471b-8358-1cc55af29945 · inbound

OmniCustom: Sync Audio-Video Customization Via Joint Audio-Video Generation Model cites this paper.

OmniCustom: Sync Audio-Video Customization Via Joint Audio-Video Generation Model ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-03T00:11:12.760454Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T00:11:12.760454Z digest=sha256:2a84031ad9a8b5894db5e3081c0121ad30fd3209342fb0db6c0fc2b44196678e

Observation 4662f14c-70fb-4f48-b7ad-121f5df50210 · inbound

RefAlign: Representation Alignment for Reference-to-Video Generation cites this paper.

RefAlign: Representation Alignment for Reference-to-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-07-13T18:01:19.034578Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T18:01:19.034578Z digest=sha256:06a1f16d8d6b292322bc7376f708c1da39eebc8445b20d705dfe7a9dfe3ed595

Observation b30b31c6-a1d1-4735-bb03-49e2646c36d0 · inbound

Evolution of Video Generative Foundations cites this paper.

Evolution of Video Generative Foundations ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 200

Resolution
verified exact
arxiv_id, observed 2026-05-11T00:05:51.145730Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-10T18:41:38.616611Z digest=sha256:139fa075add142d2f11d37d1bd8836d3a093ca0fa602b7db7f1166a3d5814401

Observation 1282d86b-ae12-45e8-b754-f981c3fd0c4c · inbound

MMControl: Unified Multi-Modal Control for Joint Audio-Video Generation cites this paper.

MMControl: Unified Multi-Modal Control for Joint Audio-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-11T12:46:27.934831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-10T02:55:09.008954Z digest=sha256:07c45f15a32b9739a25d8d2f84cf731da0a69d515644c47db4dd09f7b5984839

Observation 4cefa5a1-8fef-4ea5-ac43-94455231321f · inbound

Generate Your Talking Avatar from Video Reference cites this paper.

Generate Your Talking Avatar from Video Reference ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 22

Resolution
verified exact
arxiv_id, observed 2026-05-12T10:36:29.843825Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-07T05:32:04.519820Z digest=sha256:a77efabc2296330d66656d01d039797288b4f91936b87ae7fc91dac1d3899937

Observation 11517605-6d84-44ab-a550-3c9313f52c6e · inbound

Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation cites this paper.

Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-20T14:13:21.384877Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-20T14:08:30.802619Z digest=sha256:ecd1626f54a454b60bd3bae5f9c150aa0e0e17613eb0fcf3778fb700015b8f8c

Observation a07afe0d-0600-4324-a49b-b8427c7bedf8 · inbound

Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation cites this paper.

Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 25

Resolution
verified exact
arxiv_id, observed 2026-07-01T22:26:17.512073Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-06-28T15:25:22.778550Z digest=sha256:8b76706f8fca936c44a2b63ff16a3d1edcd40e62a09dc940dfd762299cd21c44

Observation dbcb1a7e-0dca-4051-bdbc-f1294d9c43a6 · inbound

CineOrchestra: Unified Entity-Centric Conditioning for Cinematic Video Generation cites this paper.

CineOrchestra: Unified Entity-Centric Conditioning for Cinematic Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-07-03T14:58:32.691488Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-06-27T06:51:31.625416Z digest=sha256:c8ab59c70ec2528120b29720bf0986df4a2ef016133a7c21af0bd0c1a4611e37

Observation e3362c3a-3a0e-47f3-b016-494ea6adaf48 · inbound

DomainShuttle: Freeform Open Domain Subject-driven Text-to-video Generation cites this paper.

DomainShuttle: Freeform Open Domain Subject-driven Text-to-video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-07-04T21:10:09.711131Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-06-25T19:00:23.260939Z digest=sha256:e29880dba1cb481724e25c32faec05fe4e598dce893eee041a4758d95981a66e

Observation 7fe408cd-237d-4aee-8bf7-25b166a643ed · inbound

Aura: Consistent Multi-Subject Video Generation via VLM-Grounded Semantic Alignment cites this paper.

Aura: Consistent Multi-Subject Video Generation via VLM-Grounded Semantic Alignment ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-07-11T20:11:31.576642Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-11T20:11:31.576642Z digest=sha256:4fc49ab0a5ef29eb98cbb0724bbeb36151fcfe43e86087bcd0f6eb440832b6bf

Observation 8bb3d810-d29e-4267-8a07-2b790f672b0d · inbound

HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enhancement cites this paper.

HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enhancement ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-01T15:42:21.185336Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:42:21.185336Z digest=sha256:3724faaf5458e2414d47742aff178aa3e4efcb64096a3c1c528e35017a4bdeac

Observation bdb58df2-513b-4a68-b6e3-380c51764cea · inbound

Vera: Identity-Faithful Human Subject-to-Video Generation cites this paper.

Vera: Identity-Faithful Human Subject-to-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-01T10:24:51.877301Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T10:24:51.877301Z digest=sha256:4fc1152c12c0cd5c6eae338dbb5cc37965b7d9c32bdaaecd2406c38c29437681

Observation 894eccdd-71ec-43ce-8c0a-1cf6048bdf0a · inbound

ID-V2V: Identity-Preserving Video Restylization cites this paper.

ID-V2V: Identity-Preserving Video Restylization ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 193

Resolution
unresolved
no resolver link, observed 2026-08-01T04:27:31.572932Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T04:27:31.572932Z digest=sha256:f3cab7b2029b5ade8acb50dc5bb5196f2693a5626b3fc961d3c092eb511798a4