A new captured music-dance dataset with facial expressions and a hierarchical residual VQ plus masked-transformer model that generates expressive 3D dance from music.
Audiolm: a language modeling approach to audio genera- tion
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.MM 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Music-Aligned Holistic 3D Dance Generation via Hierarchical Motion Modeling
A new captured music-dance dataset with facial expressions and a hierarchical residual VQ plus masked-transformer model that generates expressive 3D dance from music.