多无人机 AoI 最小化算法

信息新鲜度显著提升

采用集中训练、分散执行的多智能体深度强化学习策略,以AoI最小化协同调度多无人机路径,并在动作掩码下保证能耗与碰撞约束。

王玺钧 · Yi, Mengjie · 刘娟 · 张琰 · 汪萌 · Bo, Bai

IEEE Transactions on Communications 2023

技术优势

数据更新更及时

通过多无人机协同调度和集中训练分散执行的多智能体深度强化学习,显著降低总平均信息年龄,提升物联网数据新鲜度。

满足多类约束

算法在训练中利用动作掩码过滤无效动作,使无人机满足运动学、能量、轨迹和避碰约束,确保飞行安全与任务可行性。

收敛更快

采用动作掩码方法能够提高所提多智能体深度强化学习算法的收敛速度,加快训练过程。

应用场景