在线学习人类权重矩阵
一种用于在线学习人类控制行为中目标函数权重矩阵的控制器,无需持续激励条件,就能从系统状态测量中反推出人类操作员的控制权衡。
Jie, Lin · Wang, Mi · 吴淮宁
Information Sciences 2023
复合自适应更新律利用并发学习,去除了传统自适应估计方法所需的持续激励条件。
学习人类权重矩阵只需系统状态测量,无需控制输入或人类演示数据。
该方法在线估计人类反馈增益矩阵,并实时求解权重矩阵,无需离线批量处理。