On abdominal CT, a vision-language pre-training method using organ-level normal/abnormal contrastive learning and a VQ-VAE normality model achieves 84.9% average zero-shot AUC, beating prior methods by 3.6%.
A simple framework for contrastive learning of visual representations
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
contradiction 1
citation-polarity summary
fields
eess.IV 1years
2025 1verdicts
CONDITIONAL 1roles
contradiction 1polarities
contest 1representative citing papers
citing papers explorer
-
Boosting Vision Semantic Density with Anatomy Normality Modeling for Medical Vision-language Pre-training
On abdominal CT, a vision-language pre-training method using organ-level normal/abnormal contrastive learning and a VQ-VAE normality model achieves 84.9% average zero-shot AUC, beating prior methods by 3.6%.