By measuring text ambiguity, mapping uncertainty, and frame quality, UMIVR asks targeted clarifying questions and raises Recall@1 on MSR-VTT-1k to 69.2% after 10 interaction rounds.
Ask&confirm: Active detail enriching for cross-modal retrieval with partial query.2021 IEEE/CVF International Conference on Computer Vision (ICCV), pages 1815–1824, 2021
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
background 1
citation-polarity summary
fields
cs.CV 1years
2025 1verdicts
CONDITIONAL 1roles
background 1polarities
unclear 1representative citing papers
citing papers explorer
-
Quantifying and Narrowing the Unknown: Interactive Text-to-Video Retrieval via Uncertainty Minimization
By measuring text ambiguity, mapping uncertainty, and frame quality, UMIVR asks targeted clarifying questions and raises Recall@1 on MSR-VTT-1k to 69.2% after 10 interaction rounds.