动态领航与博弈决策
面向多无人车协同任务的弹性编队控制器,通过动态领航者切换与分层博弈决策,确保编队对领航者或目标丧失的鲁棒性。
Xue, Lei · Ma, Bei · 刘剑 · 穆朝絮 · Wunsch, Donald C.
IEEE Transactions on Intelligent Vehicles 2023
通过扩展卡尔曼滤波器估计非合作目标的状态,即使目标轨迹未知也能实现跟踪。
利用Stackelberg博弈刻画动态领航者与跟随者的分层互动,并证明了Stackelberg-Nash均衡的存在性。
设计了一种基于强化学习的算法来达到Stackelberg-Nash均衡,无需精确模型即可学习最优策略。