A training-free editing framework that routes attention heads by semantic sensitivity and refines text/image tokens, improving text-guided editing for MM-DiTs.
An image is worth 16x16 words: Transformers for image recognition at scale
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CV 1years
2024 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
HeadRouter: A Training-free Image Editing Framework for MM-DiTs by Adaptively Routing Attention Heads
A training-free editing framework that routes attention heads by semantic sensitivity and refines text/image tokens, improving text-guided editing for MM-DiTs.