A deployment-time correction layer using input convex neural networks improves offline RL policies on simulated polymerisation reactor grade transitions.
Integrated scheduling and dynamic optimization of grade transitions for a continuous polymerization reactor,
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
background 1
citation-polarity summary
fields
eess.SY 1years
2025 1verdicts
CONDITIONAL 1roles
background 1polarities
background 1representative citing papers
citing papers explorer
-
Safe Deployment of Offline Reinforcement Learning via Input Convex Action Correction
A deployment-time correction layer using input convex neural networks improves offline RL policies on simulated polymerisation reactor grade transitions.