An iterative code-generation framework (IPP) improves LLM performance on GRASP and MiniGrid grid-planning tasks by refining generated policy programs based on execution feedback.
Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning, 2025
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.AI 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Code-Driven Planning in Grid Worlds with Large Language Models
An iterative code-generation framework (IPP) improves LLM performance on GRASP and MiniGrid grid-planning tasks by refining generated policy programs based on execution feedback.