An on-board fine-tuned vision-language model with a retrieval-augmented memory converts natural-language driving commands and camera views into MPC and PID controller parameters, reducing takeover rates by up to 76.9 percent in real vehicle tests.
Qwen-vl: A versatile vision-language model for un- derstanding, localization, text reading, and beyond, 2023
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.AI 1years
2024 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
On-Board Vision-Language Models for Personalized Autonomous Vehicle Motion Control: System Design and Real-World Validation
An on-board fine-tuned vision-language model with a retrieval-augmented memory converts natural-language driving commands and camera views into MPC and PID controller parameters, reducing takeover rates by up to 76.9 percent in real vehicle tests.