分布式ADP一致性控制器

降本增效

一种基于分层Stackelberg-Nash博弈框架的分布式自适应动态规划控制方法,在实现多智能体一致性控制的同时降低控制成本。

Zhang, Haoyan · 张颖玮 · Zhao Xudong · Su, Chunyi

IEEE Transactions on Systems, Man, and Cybernetics: Systems 2025

技术优势

无需模型

采用单评判神经网络在线逼近耦合HJB方程,无需系统动态模型。

成本更低

通过博弈框架导出的最优控制策略不仅能实现一致性,还能减少控制成本。

稳定性可保证

理论证明闭环系统所有信号一致最终有界。

应用场景