鲁棒多智能体PPO算法

动态窃听下保密率大幅提升

通过环境感知与不确定性估计,在用户和窃听者数量动态变化的场景下仍保持显著优于基准的保密率和鲁棒性。

Dai, Chen · Yize, Wang · 79647851 · 谷晓琳 · 曹浩彤 · Sun, Guozi

IEEE Transactions on Network Science and Engineering 2026

技术优势

保密性能大幅提升

所提框架在保密率上明显超越基准方法,验证了其有效性。

环境变化下更鲁棒

通过随机环境分布和不确定性估计,策略在用户和窃听者数量动态变化时仍保持稳定。

高维协同可求解

采用POMDP建模和多智能体PPO,解决了多无人机协同的高维状态空间问题。

应用场景