复合自适应逆最优控制器

在线学习人类权重矩阵

一种用于在线学习人类控制行为中目标函数权重矩阵的控制器,无需持续激励条件,就能从系统状态测量中反推出人类操作员的控制权衡。

Jie, Lin · Wang, Mi · 吴淮宁

Information Sciences 2023

技术优势

无需持续激励

复合自适应更新律利用并发学习,去除了传统自适应估计方法所需的持续激励条件。

仅需状态测量

学习人类权重矩阵只需系统状态测量,无需控制输入或人类演示数据。

在线学习

该方法在线估计人类反馈增益矩阵,并实时求解权重矩阵,无需离线批量处理。

应用场景