决策速度升57%
通过改进的双周期深度Q网络,实现固定翼无人机集群在目标分配与姿态控制上的一体化决策,提升在复杂动态环境中的自主调整能力。
Xue, Yuyang · Yu, Qidong · 汪涛 · Yanru, Huang · Bingsan, Yang · Hongrun, Wang
Aerospace Science and Technology 2026
通过改进的双周期策略深度Q网络,将多成员目标分配与姿态控制统一为一个学习任务,避免了传统分步求解带来的协调误差。
DPS-DQN算法收敛速度比传统DQN提高57.1%,在相同训练预算下能更快达到可用性能。
在相同仿真场景下,DPS-DQN的任务效能约为DQN的两倍,且相比PSO提高65.42%,检测有效性显著增强。
DPS-DQN的标准差相比DQN下降约五倍,表明算法在不同运行中的性能更加稳定,便于实际部署。