多故障与DoS攻击下协同
控制器结合强化学习与自适应补偿,能在执行器故障、网络攻击和通信中断下保证四旋翼团队的分布式协同。
Ziming, Ren · 刘昊 · 张宏伟 · 陈辞 · Lewis, Frank L.T.
Automatica 2026
采用事件/自触发通信机制,无需持续通信就能维持协同,从而在网络攻击导致通信中断时保持队形。
基于离线策略强化学习在线学习最优控制器,不依赖四旋翼的动力学参数,因此部署时无需系统辨识。
将学习到的控制器与自适应执行器故障补偿器结合,对执行器故障进行在线补偿,保持系统稳定。
理论上证明了所提事件/自触发控制策略不会发生Zeno行为,即触发次数不会在有限时间内无限累积,保证可实现性。