A CLIP plus MLLM pipeline with additive-bias Low-Rank adaptation retrieves 3D objects of unseen categories from multi-view images, outperforming prior art by about 10% mAP on average.
Shape matching and object recognition using shape contexts.IEEE TPAMI, 24(4):509–522, 2002
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
background 1
citation-polarity summary
fields
cs.CV 1years
2025 1verdicts
CONDITIONAL 1roles
background 1polarities
unclear 1representative citing papers
citing papers explorer
-
Describe, Adapt and Combine: Empowering CLIP Encoders for Open-set 3D Object Retrieval
A CLIP plus MLLM pipeline with additive-bias Low-Rank adaptation retrieves 3D objects of unseen categories from multi-view images, outperforming prior art by about 10% mAP on average.