实时纳什均衡逼近
无需对方意图先验,仅凭系统状态在线辨识人类操控航天器的权重矩阵,使控制策略收敛至合作博弈的纳什均衡附近。
Wu, Mingen · Wang, Mi · 吴淮宁
Journal of the Franklin Institute 2024
仅利用系统状态,通过并发学习在线辨识人类航天器的反馈增益矩阵,再经逆微分博弈恢复其意图权重矩阵,无需对方意图的任何先验知识。
控制律根据辨识出的意图实时更新,使双方控制策略逐渐收敛至纳什均衡附近,保证协同交会任务的最优性。