一种从演示中学习MPC代价函数的逆最优控制方法,可让控制器模仿专家行为,在真实移动机器人上验证有效。
Zhang, Fawang · Duan, Jingliang · Haoyuan, Xu · 陈浩 · 刘辉 · Nie, Shida · 李升波
IEEE Transactions on Industrial Informatics 2024
通过微分PMP条件构造辅助最优控制问题求解梯度,避免直接对轨迹求导的复杂性。
在真实移动机器人上,学习到的代价函数使控制器轨迹与演示轨迹高度吻合。