On a new degraded-document dataset (DocDeg), OCR-based RAG with Llama 3.2 90B outperforms vision-based ColQwen2 retrieval on all quality levels, while the vision pipeline remains more memory-efficient.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CV 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Lost in OCR Translation? Vision-Based Approaches to Robust Document Retrieval
On a new degraded-document dataset (DocDeg), OCR-based RAG with Llama 3.2 90B outperforms vision-based ColQwen2 retrieval on all quality levels, while the vision pipeline remains more memory-efficient.