Average reward RL, implemented as ARO-SAC, is reported to outperform discounted SAC by 15% in a RAN slicing radio resource management task.
Methods and apparatus for power management in a wireless communication system,
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
background 1
citation-polarity summary
fields
cs.IT 1years
2025 1verdicts
REJECT 1roles
background 1polarities
unclear 1representative citing papers
citing papers explorer
-
Average Reward Reinforcement Learning for Wireless Radio Resource Management
Average reward RL, implemented as ARO-SAC, is reported to outperform discounted SAC by 15% in a RAN slicing radio resource management task.