A two-level entropy-regularized hierarchical SAC agent beats flat SAC on a SAR-2-inspired sparse-reward continuous search task in reported success rate and coverage.
Richard S Sutton, Doina Precup, and Satinder Singh
1 Pith paper cite this work, alongside 179 external citations. Polarity classification is still indexing.
1
Pith paper citing it
179
external citations · OpenAlex
fields
cs.RO 1years
2026 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning
A two-level entropy-regularized hierarchical SAC agent beats flat SAC on a SAR-2-inspired sparse-reward continuous search task in reported success rate and coverage.