Filtered behavior cloning, an MLP baseline trained only on high-return trajectories, matches or outperforms Decision Transformer on the sparse-reward Robomimic and sparsified D4RL benchmarks tested.
RvS : What is essential for offline rl via supervised learning? In NeurIPS Offline Reinforcement Learning Workshop, 2021
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.AI 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Should We Ever Prefer Decision Transformer for Offline Reinforcement Learning?
Filtered behavior cloning, an MLP baseline trained only on high-return trajectories, matches or outperforms Decision Transformer on the sparse-reward Robomimic and sparsified D4RL benchmarks tested.