多AUV协同追踪策略

即时决策追捕

一种基于分布式强化学习的在线决策算法,能让多个AUV在未知水下环境中协同追踪入侵UUV。

Hou, Yun · 韩光洁 · Zhang, Fan · Lin, Chuan · Peng, Jinlin · 刘立

IEEE Transactions on Intelligent Transportation Systems 2023

技术优势

无需动力学模型

MADA直接从AUV观测映射到追踪动作,避免了传统方法对精确环境动力学模型的依赖,更适合未知水下环境。

追捕成功率更高

通过结合分布式软演员-评论家与课程学习,MADA能够获得更优的协同追捕策略,提升多AUV追捕UUV的成功率。

应用场景