UPER uses ensemble-based epistemic and aleatoric uncertainty to compute an information gain priority for experience replay, outperforming TD-error prioritization on Atari-57.
Optimism and pessimism in optimised replay
1 Pith paper cite this work, alongside 20 external citations. Polarity classification is still indexing.
1
Pith paper citing it
20
external citations · OpenAlex
citation-role summary
background 1
citation-polarity summary
fields
cs.LG 1years
2025 1verdicts
CONDITIONAL 1roles
background 1polarities
background 1representative citing papers
citing papers explorer
-
Uncertainty Prioritized Experience Replay
UPER uses ensemble-based epistemic and aleatoric uncertainty to compute an information gain priority for experience replay, outperforming TD-error prioritization on Atari-57.