在线免优化
用离线训练的深度神经网络策略替代在线优化,让非线性模型预测控制首次能在高采样率机器人上实时部署,并具备概率意义下的闭环稳定性保证。
Rizhong, Wang · 李慧平 · 梁斌 · Shi, Yang · 徐德民
IEEE Transactions on Industrial Electronics 2023
用离线训练的神经网络策略直接映射状态到控制量,在线推断仅需前向传播,避免了求解非线性规划。
理论证明了闭环系统在概率意义下渐近稳定,为实际部署提供了安全性依据。
提出了确保策略实施实际可行性的策略,使得学习到的策略可以在真实系统上有效执行。