通过增益迭代扰动观测器动态补偿外界扰动,并利用强化学习实时优化能耗,实现无人艇编队无碰撞最优控制。
Gengqi, Li · Cao, Liang · 王伟 · 李小萌 · Bai, Weiwei
Information Sciences 2025
增益迭代机制使观测器增益随迭代动态调整,比固定增益观测器更准确地估计外界扰动。
人工势场函数具有平滑连续偏导,当障碍物离开检测范围时避免绕行旋转现象。
利用执行器-评价器强化学习在性能和成本间取得平衡,优化编队过程中的能量消耗。