A decentralized MARL method that communicates observation-prediction error as an auxiliary message improves performance on out-of-distribution warehouse tasks.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.MA 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning
A decentralized MARL method that communicates observation-prediction error as an auxiliary message improves performance on out-of-distribution warehouse tasks.