混合优先TD3控制器

复杂海况轨迹跟踪

基于 LOS 制导律与混合优先经验回放的深度强化学习控制器,可在真实海流与风场干扰下自适应跟踪参考轨迹。

周圆 · Chongwei, Gong · Chen, Keran

IEEE Internet of Things Journal 2025

技术优势

跟踪更准

在多种干扰强度下平均跟踪误差更低,验证了对复杂海况的适应性。

收敛更快

混合优先经验回放同时考虑TD误差和奖励值,加速网络训练。

环境更真实

使用实际海洋数据构建时变多要素环境模型,而非简单数学模型。

应用场景