Pith. sign in

Paper Citation Record · LEDGER

ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2501.04698.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2501.04698 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 26 of 26 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 26 of 26 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:59:30.608834Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T21:10:09.709506Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 9bce90ec-478b-47cb-b44c-164db67157ec · inbound

Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute cites this paper.

Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 24

Resolution
verified exact
arxiv_id, observed 2026-05-22T17:51:54.407679Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-22T17:51:41.947939Z digest=sha256:ca005dfae3b4520ab93a2940af9c1da150ac7cbb37a27caebe31d2afd5b068fa

Observation ed245bbb-b229-4733-8b8c-c399a21ac318 · inbound

OpenS2V-Nexus: A Detailed Benchmark and Million-Scale Dataset for Subject-to-Video Generation cites this paper.

OpenS2V-Nexus: A Detailed Benchmark and Million-Scale Dataset for Subject-to-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T13:59:30.608834Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:59:30.608834Z digest=sha256:9faf55d685d1a1d4e247419e399713f5e36961c11eeeab8bd5601550bc07a661

Observation bc92ba84-61f2-483c-bbe5-3ecf2d2c648f · inbound

AnimeShooter: A Multi-Shot Animation Dataset for Reference-Guided Video Generation cites this paper.

AnimeShooter: A Multi-Shot Animation Dataset for Reference-Guided Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T11:12:09.347154Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:12:09.347154Z digest=sha256:a2e2eec822eb792c2066dc799e2f72cbce13e1ec43d94fa994dd3fa87706c8a5

Observation d83768e2-1f8f-49fa-8f50-efcbe685ae2e · inbound

UNIC: Unified In-Context Video Editing cites this paper.

UNIC: Unified In-Context Video Editing ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T10:51:43.034695Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:51:43.034695Z digest=sha256:f45be2823933001dbaeae5d75cd1092f07358f2b55f3b1bdf1126ec55d7b9642

Observation a2ebc5f8-5042-4246-882d-8f37098a098e · inbound

PolyVivid: Vivid Multi-Subject Video Generation with Cross-Modal Interaction and Enhancement cites this paper.

PolyVivid: Vivid Multi-Subject Video Generation with Cross-Modal Interaction and Enhancement ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T05:30:32.938000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T05:30:32.938000Z digest=sha256:28335d099dd8f55d0d00d9eb12b2ce2a71e3433b391185a3c58fa41a2ccbb8b7

Observation b6a00451-3efa-4c79-b637-4fe082db90d5 · inbound

DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers cites this paper.

DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T04:27:37.785167Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:27:37.785167Z digest=sha256:5cf37c6085ee0a1fd08baf6f16a6994ca12d123c8b513858f8dcd6829defbd25

Observation 2f7e3dc0-1256-49f6-a739-3e6d4563e608 · inbound

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset cites this paper.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.114978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.114978Z digest=sha256:f6e12c6128b46cd6ee0973adeb7546f79b6eb9ad63c7a3988a9e27bd18747b6c

Observation e6a7988e-ba77-4313-8e12-a66031786887 · inbound

Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation cites this paper.

Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T19:19:32.718300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:19:32.718300Z digest=sha256:83e8af83d800ccd0b3f4be6fe4978227a7ba17135273080a5a6d1a83162d8aaa

Observation 5b2e4943-7699-4f24-afe0-f875b9a9d6f2 · inbound

A Survey on Long-Video Storytelling Generation: Architectures, Consistency, and Cinematic Quality cites this paper.

A Survey on Long-Video Storytelling Generation: Architectures, Consistency, and Cinematic Quality ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T18:51:26.486990Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:51:26.486990Z digest=sha256:8f35af6c8db07d038a4c72319ddf8a56e6a2b083d4aa3ce6e0cbaa910e863019

Observation 01466845-10fd-4bbc-add5-daa1763e6c93 · inbound

Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation cites this paper.

Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-05T20:20:21.541805Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T20:20:21.541805Z digest=sha256:cd09d5416c1ea185b0dae851c6ab9b6ef2de90d8a23049538568c0cf8180f79f

Observation 7633f67c-7c56-4891-9b9f-5ee546cad326 · inbound

From Black Box to Transparency: Enhancing Automated Interpreting Assessment with Explainable AI in College Classrooms cites this paper.

From Black Box to Transparency: Enhancing Automated Interpreting Assessment with Explainable AI in College Classrooms ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-05T20:17:46.362851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T20:17:46.362851Z digest=sha256:19ace04ef480f1dad06b2dfbcb72af52368376c19e4a1597c009c36e3e93f0db

Observation 72a86b75-9ad0-468f-9b00-5473d56c1d02 · inbound

UniVideo: Unified Understanding, Generation, and Editing for Videos cites this paper.

UniVideo: Unified Understanding, Generation, and Editing for Videos ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-04T10:49:47.891881Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T10:49:47.891881Z digest=sha256:c5668493e79668d0f244c87b142424eabeb89acd5b4fa4a1a3bdb32fd46b7321

Observation c0dd0f0e-00ef-4909-8186-4fc85c7d673c · inbound

TinyHistory: Lightweight Video History Embeddings via Two-Stage Context Learning cites this paper.

TinyHistory: Lightweight Video History Embeddings via Two-Stage Context Learning ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-03T13:35:49.924520Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:35:49.924520Z digest=sha256:38b9fa261622b0cbf7a12c53829cbdd26fbe74db49c4627f76b788780d73cda1

Observation b4008e0f-c0e0-471b-8358-1cc55af29945 · inbound

OmniCustom: Sync Audio-Video Customization Via Joint Audio-Video Generation Model cites this paper.

OmniCustom: Sync Audio-Video Customization Via Joint Audio-Video Generation Model ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-03T00:11:12.760454Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T00:11:12.760454Z digest=sha256:4b16e85c712524a9ef5d36202449db6804827c2d055a1978dfaa409b333ca668

Observation 4662f14c-70fb-4f48-b7ad-121f5df50210 · inbound

RefAlign: Representation Alignment for Reference-to-Video Generation cites this paper.

RefAlign: Representation Alignment for Reference-to-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-07-13T18:01:19.034578Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T18:01:19.034578Z digest=sha256:0949fdc06d9cbecfe02b8747443f8d27decbac1b3247ced981ef06539df96f9c

Observation b30b31c6-a1d1-4735-bb03-49e2646c36d0 · inbound

Evolution of Video Generative Foundations cites this paper.

Evolution of Video Generative Foundations ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 200

Resolution
verified exact
arxiv_id, observed 2026-05-11T00:05:51.145730Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-10T18:41:38.616611Z digest=sha256:aa7859f6019bc2e39be15f26c3b5c6b31529286c417f66629feac24f82d8d090

Observation 1282d86b-ae12-45e8-b754-f981c3fd0c4c · inbound

MMControl: Unified Multi-Modal Control for Joint Audio-Video Generation cites this paper.

MMControl: Unified Multi-Modal Control for Joint Audio-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-11T12:46:27.934831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-10T02:55:09.008954Z digest=sha256:ab10b1e02fad3372c6d01ecb42d5f61d08330424609b8654e5d36f9538aedfb3

Observation 4cefa5a1-8fef-4ea5-ac43-94455231321f · inbound

Generate Your Talking Avatar from Video Reference cites this paper.

Generate Your Talking Avatar from Video Reference ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 22

Resolution
verified exact
arxiv_id, observed 2026-05-12T10:36:29.843825Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-07T05:32:04.519820Z digest=sha256:de980937aa5a336392bf4e819daeeac6a84cc2a777f7688326a32434bd140195

Observation 11517605-6d84-44ab-a550-3c9313f52c6e · inbound

Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation cites this paper.

Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-20T14:13:21.384877Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-20T14:08:30.802619Z digest=sha256:c9948db2c3aadec25c6f02a9804cf2ce5d537634a6f63254e62837bb3477ea04

Observation a07afe0d-0600-4324-a49b-b8427c7bedf8 · inbound

Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation cites this paper.

Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 25

Resolution
verified exact
arxiv_id, observed 2026-07-01T22:26:17.512073Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-06-28T15:25:22.778550Z digest=sha256:3089d670c85f2ee183a8ef5242b48868b4956fdcdde7f9a9fb14a7eaa80dce51

Observation dbcb1a7e-0dca-4051-bdbc-f1294d9c43a6 · inbound

CineOrchestra: Unified Entity-Centric Conditioning for Cinematic Video Generation cites this paper.

CineOrchestra: Unified Entity-Centric Conditioning for Cinematic Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-07-03T14:58:32.691488Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-06-27T06:51:31.625416Z digest=sha256:7184e33cda74370c237f41a6e7722daf8d3e71defa92d2ec45e83ece85a0b8ae

Observation e3362c3a-3a0e-47f3-b016-494ea6adaf48 · inbound

DomainShuttle: Freeform Open Domain Subject-driven Text-to-video Generation cites this paper.

DomainShuttle: Freeform Open Domain Subject-driven Text-to-video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-07-04T21:10:09.711131Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-06-25T19:00:23.260939Z digest=sha256:1023f7dafa861b3fbd5fc01b2cf716de0b1bf5511ea646fe23b68f5b943ad521

Observation 7fe408cd-237d-4aee-8bf7-25b166a643ed · inbound

Aura: Consistent Multi-Subject Video Generation via VLM-Grounded Semantic Alignment cites this paper.

Aura: Consistent Multi-Subject Video Generation via VLM-Grounded Semantic Alignment ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-07-11T20:11:31.576642Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-11T20:11:31.576642Z digest=sha256:3b0052685429c2e98c5f2fb51c0639a800c286c07d07de8d6a5dfac72f01dcf3

Observation 8bb3d810-d29e-4267-8a07-2b790f672b0d · inbound

HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enhancement cites this paper.

HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enhancement ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-01T15:42:21.185336Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:42:21.185336Z digest=sha256:91225d173af82611628bf6c9b5a2d87a62785a34253c69712658ccce72ab6342

Observation bdb58df2-513b-4a68-b6e3-380c51764cea · inbound

Vera: Identity-Faithful Human Subject-to-Video Generation cites this paper.

Vera: Identity-Faithful Human Subject-to-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-01T10:24:51.877301Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T10:24:51.877301Z digest=sha256:cd30ce4a2e4833cc3d8dd3a462fa2af2d3b6e3d3ec315ad6b54cbadc9f1eb25e

Observation 894eccdd-71ec-43ce-8c0a-1cf6048bdf0a · inbound

ID-V2V: Identity-Preserving Video Restylization cites this paper.

ID-V2V: Identity-Preserving Video Restylization ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 193

Resolution
unresolved
no resolver link, observed 2026-08-01T04:27:31.572932Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T04:27:31.572932Z digest=sha256:07a83822ada3096e9571fc05c3cd78a135412a95e57687c18b97b48255d955f9