降本增效
一种基于分层Stackelberg-Nash博弈框架的分布式自适应动态规划控制方法,在实现多智能体一致性控制的同时降低控制成本。
Zhang, Haoyan · 张颖玮 · Zhao Xudong · Su, Chunyi
IEEE Transactions on Systems, Man, and Cybernetics: Systems 2025
采用单评判神经网络在线逼近耦合HJB方程,无需系统动态模型。
通过博弈框架导出的最优控制策略不仅能实现一致性,还能减少控制成本。
理论证明闭环系统所有信号一致最终有界。