On Rosetta Stone linguistic puzzles, GPT-4 performs best with plain input-output prompting, outperforming chain-of-thought and multi-persona prompting on all tested metrics.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CL 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Probing Large Language Models in Reasoning and Translating Complex Linguistic Puzzles
On Rosetta Stone linguistic puzzles, GPT-4 performs best with plain input-output prompting, outperforming chain-of-thought and multi-persona prompting on all tested metrics.