A unified model synthesizes binaural singing from scene images using a consistency Schrödinger bridge, enabling one-step generation.
Diffsinger: Singing voice synthesis via shallow diffusion mechanism,
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
background 1
citation-polarity summary
fields
cs.SD 1years
2025 1verdicts
CONDITIONAL 1roles
background 1polarities
background 1representative citing papers
citing papers explorer
-
VS-Singer: Vision-Guided Stereo Singing Voice Synthesis with Consistency Schr\"odinger Bridge
A unified model synthesizes binaural singing from scene images using a consistency Schrödinger bridge, enabling one-step generation.