MAPPO多无人机任务分配算法

3对3空战胜率98.5%

通过分离式状态滑动归一化、动作掩码与注意力机制,确保任务分配严格满足约束并精准选择攻击战术,实现多无人机分布式动态协同。

Hai-Feng, Li · 杨宏安 · Zimao, Sheng · Liu, Chao · Chen, Yixin

Kongzhi yu Juece/Control and Decision 2025

参数信息

空战胜率
98.5 %

技术优势

胜率大幅提升

在3对3空战场景中,我方胜率达到98.5%,远超配备专家系统的敌机,证明算法有效性。

严格满足任务约束

通过动作掩码机制确保任务分配过程严格遵循任务可执行约束和无人机载荷约束,避免无效分配。

解决信息失真

采用分离式状态滑动归一化机制,有效解决MAPPO算法中状态归一化导致的信息失真问题,提升学习稳定性。

精准战术选择

引入注意力机制,根据攻击目标聚焦于选择最佳攻击战术,提升决策质量。

应用场景