一种在未知障碍环境中实现多无人机自适应协同编队轨迹规划的方法,通过引入LSTM环境感知和改进势场密集奖励,提升策略学习效率与编队适应性。
邢小军 · Zhiwei, Zhou · 李俨 · Bing, Xiao · Yilin, Xun
IEEE Transactions on Vehicular Technology 2024
采用改进势场密集奖励函数,强化策略学习效率并加速收敛。
引入自适应编队保持与变换策略,使无人机集群适应狭窄通道环境。
仿真显示在策略学习效率、轨迹规划最优性和窄通道适应性上优于MADDPG和MATD3。