逆MPC控制器

一种从演示中学习MPC代价函数的逆最优控制方法,可让控制器模仿专家行为,在真实移动机器人上验证有效。

Zhang, Fawang · Duan, Jingliang · Haoyuan, Xu · 陈浩 · 刘辉 · Nie, Shida · 李升波

IEEE Transactions on Industrial Informatics 2024

参数信息

仿真任务数量
5
真实移动机器人任务数量
2

技术优势

无需解析梯度

通过微分PMP条件构造辅助最优控制问题求解梯度,避免直接对轨迹求导的复杂性。

专家行为复现

在真实移动机器人上,学习到的代价函数使控制器轨迹与演示轨迹高度吻合。

应用场景