模糊Q学习+MPC
一种结合模糊Q学习与模型预测控制的追逃博弈方法,通过FQL决策和MPC控制提升四旋翼追捕性能。
Hu, Penglin · 赵春晖 · 潘泉
Drones 2024
模糊Q学习根据位置和速度信息动态提供参考输入,使追捕者能实时调整策略。
模型预测控制在每个周期内优化控制输入,增强四旋翼的鲁棒控制。
模糊Q学习用于感知、决策并预测逃跑者轨迹,提高追捕效果。