Increasing LLM coding agents' reasoning effort raises cost and process complexity but does not reliably improve model quality across 140 controlled runs on networked anagram game data.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
stat.ME 1years
2026 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
An Experimental Design Approach to Evaluating Agentic AI's Autonomous Model Discovery
Increasing LLM coding agents' reasoning effort raises cost and process complexity but does not reliably improve model quality across 140 controlled runs on networked anagram game data.