即时决策追捕
一种基于分布式强化学习的在线决策算法,能让多个AUV在未知水下环境中协同追踪入侵UUV。
Hou, Yun · 韩光洁 · Zhang, Fan · Lin, Chuan · Peng, Jinlin · 刘立
IEEE Transactions on Intelligent Transportation Systems 2023
MADA直接从AUV观测映射到追踪动作,避免了传统方法对精确环境动力学模型的依赖,更适合未知水下环境。
通过结合分布式软演员-评论家与课程学习,MADA能够获得更优的协同追捕策略,提升多AUV追捕UUV的成功率。