复杂海况轨迹跟踪
基于 LOS 制导律与混合优先经验回放的深度强化学习控制器,可在真实海流与风场干扰下自适应跟踪参考轨迹。
周圆 · Chongwei, Gong · Chen, Keran
IEEE Internet of Things Journal 2025
在多种干扰强度下平均跟踪误差更低,验证了对复杂海况的适应性。
混合优先经验回放同时考虑TD误差和奖励值,加速网络训练。
使用实际海洋数据构建时变多要素环境模型,而非简单数学模型。