ViPOcc combines Depth Anything V2 metric depth priors and Grounded-SAM instance masks with a NeRF-based occupancy network to improve single-view 3D occupancy and depth prediction.
The Cityscapes Dataset for Semantic Ur- ban Scene Understanding
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
dataset 1
citation-polarity summary
fields
cs.CV 1years
2024 1verdicts
CONDITIONAL 1roles
dataset 1polarities
use dataset 1representative citing papers
citing papers explorer
-
ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction
ViPOcc combines Depth Anything V2 metric depth priors and Grounded-SAM instance masks with a NeRF-based occupancy network to improve single-view 3D occupancy and depth prediction.