Recurrent PPO with LSTM lets one or two simulated drones find a signal-emitting target in GPS-denied indoor maps, with 93% and 86% success rates in the authors' simulator.
Taking drones to the next level: Cooperative distributed unmanned- aerial-vehicular networks for small and mini drones,
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
background 1
citation-polarity summary
fields
cs.RO 1years
2024 1verdicts
CONDITIONAL 1roles
background 1polarities
unclear 1representative citing papers
citing papers explorer
-
A Scalable Decentralized Reinforcement Learning Framework for UAV Target Localization Using Recurrent PPO
Recurrent PPO with LSTM lets one or two simulated drones find a signal-emitting target in GPS-denied indoor maps, with 93% and 86% success rates in the authors' simulator.