DNN策略学习非线性MPC

在线免优化

用离线训练的深度神经网络策略替代在线优化,让非线性模型预测控制首次能在高采样率机器人上实时部署,并具备概率意义下的闭环稳定性保证。

Rizhong, Wang · 李慧平 · 梁斌 · Shi, Yang · 徐德民

IEEE Transactions on Industrial Electronics 2023

参数信息

采样率可
5 Hz

技术优势

在线免优化

用离线训练的神经网络策略直接映射状态到控制量,在线推断仅需前向传播,避免了求解非线性规划。

概率稳定保证

理论证明了闭环系统在概率意义下渐近稳定,为实际部署提供了安全性依据。

实践可行性

提出了确保策略实施实际可行性的策略,使得学习到的策略可以在真实系统上有效执行。

应用场景