A frozen-CLIP plugin with bidirectional visual-text fusion reaches 90.07% average AUC on seven unseen deepfake benchmarks, up 6.68 points over prior work.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CV 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
HAMLET-FFD: Hierarchical Adaptive Multi-modal Learning Embeddings Transformation for Face Forgery Detection
A frozen-CLIP plugin with bidirectional visual-text fusion reaches 90.07% average AUC on seven unseen deepfake benchmarks, up 6.68 points over prior work.