RL自适应控制器

无需模型先验

该控制器通过通用系统变换与强化学习直接设计,突破了传统方法对非严格反馈离散时间系统控制的限制。

Bai, Weiwei · 李铁山 · 龙跃 · Chen, C. L.Phillip · Xiao, Yang · Wenjiang, Li · 李荣辉

IEEE Transactions on Systems, Man, and Cybernetics: Systems 2023

参数信息

仿真验证示例数量
2

技术优势

突破非因果限制

提出的通用系统变换可将非严格反馈系统重构为等价形式,使反步法能够直接应用,不再受非因果问题困扰。

直接自适应最优

无需构造评价网络,利用补偿项与RBFNN直接设计控制器,通过多梯度递归算法在线更新权重,实现最优控制。

稳定性有保证

基于Lyapunov理论证明了闭环系统所有信号半全局一致最终有界,为应用提供理论保障。

应用场景