An empirical evaluation of six LLMs on path-planning code generation finds frequent semantic errors, universal failure on Voronoi-based planning, and concludes the code is unsafe for safety-critical use without rigorous testing.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.SE 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Assessing LLM code generation quality through path planning tasks
An empirical evaluation of six LLMs on path-planning code generation finds frequent semantic errors, universal failure on Voronoi-based planning, and concludes the code is unsafe for safety-critical use without rigorous testing.