A bilevel reinforcement learning method with data transformations and minimum-of-ensemble TD targets improves offline-to-online stock trading performance on CSI-300 and NASDAQ-100.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.LG 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Your Offline Policy is Not Trustworthy: Bilevel Reinforcement Learning for Sequential Portfolio Optimization
A bilevel reinforcement learning method with data transformations and minimum-of-ensemble TD targets improves offline-to-online stock trading performance on CSI-300 and NASDAQ-100.