XMask3D improves open-vocabulary 3D segmentation by conditioning a diffusion mask generator on 3D features and applying mask-level contrastive regularization.
4d spatio-temporal convnets: Minkowski convolutional neural networks
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CV 1years
2024 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
XMask3D: Cross-modal Mask Reasoning for Open Vocabulary 3D Semantic Segmentation
XMask3D improves open-vocabulary 3D segmentation by conditioning a diffusion mask generator on 3D features and applying mask-level contrastive regularization.