自适应逆最优控制器

仅用状态与输入数据

无需系统动力学先验,在线学习人类最优控制行为并用于模仿,消除了持续激励条件限制。

Wang, Mi · 吴淮宁

IEEE Transactions on Automation Science and Engineering 2024

技术优势

无需系统模型

在动力学完全未知的情况下,仅通过状态和控制输入即可在线学习人类的最优控制行为。

摆脱持续激励限制

自适应积分并发学习算法在线辨识系统矩阵和人类反馈增益,不需要满足传统持续激励条件。

在线学习,实时模仿

算法在线实现,仅需有限数据即可让机器在陌生环境中复现人类的最优控制器。

应用场景