Open vision-language models fail to select spatial demonstratives based on object distance in a human-like manner across four languages.
Title resolution pending
2 Pith papers cite this work. Polarity classification is still indexing.
2
Pith papers citing it
years
2026 2representative citing papers
Introduces a modality-switching mechanism for LLMs on spatial reasoning tasks using a trustworthiness and complexity based metric, showing up to 42% performance improvement.
citing papers explorer
-
Evaluation of Multilingual Ability to Use Spatial Deictic Expressions in Vision-Language Models
Open vision-language models fail to select spatial demonstratives based on object distance in a human-like manner across four languages.
-
Spatial Reasoning via Modality Switching Between Language and Symbolic Representation
Introduces a modality-switching mechanism for LLMs on spatial reasoning tasks using a trustworthiness and complexity based metric, showing up to 42% performance improvement.