SC-Diff uses SAM3 category masks to bias self-attention inside a latent diffusion model, improving visible-to-infrared translation quality and downstream infrared detection on M3FD, FLIR, and KAIST.
Multiscale cross-modal homogeneity enhancement and confidence-aware fusion for multispectral pedestrian detection,
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
background 1
citation-polarity summary
fields
cs.CV 1years
2026 1verdicts
CONDITIONAL 1roles
background 1polarities
unclear 1representative citing papers
citing papers explorer
-
SC-Diff: Semantically Calibrated Diffusion for Visible-to-Infrared Image Translation
SC-Diff uses SAM3 category masks to bias self-attention inside a latent diffusion model, improving visible-to-infrared translation quality and downstream infrared detection on M3FD, FLIR, and KAIST.