For improving multi-armed bandits, randomized algorithms achieve a near-tight Θ~(√k) worst-case competitive ratio, and polynomially many historical instances suffice to tune a curvature parameter; pessimism traps and grit are modeled as sequential decision problems.
Search Games , rights =
1 Pith paper cite this work, alongside 17 external citations. Polarity classification is still indexing.
1
Pith paper citing it
17
external citations · OpenAlex
fields
cs.DS 1years
2026 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Algorithmic Approaches to Sequential Decision-Making and Social Epistemology
For improving multi-armed bandits, randomized algorithms achieve a near-tight Θ~(√k) worst-case competitive ratio, and polynomially many historical instances suffice to tune a curvature parameter; pessimism traps and grit are modeled as sequential decision problems.