The paper reports a vision-language-action model fine-tuned for a drone with mid-air haptic actuators, achieving 56.7% target acquisition success and 35-70% generalization across four task axes.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.RO 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
VLH: Vision-Language-Haptics Foundation Model
The paper reports a vision-language-action model fine-tuned for a drone with mid-air haptic actuators, achieving 56.7% target acquisition success and 35-70% generalization across four task axes.