事件触发深度强化学习制导律

训练效率大幅提升

在事件触发机制下训练、以时间触发方式执行,显著加速策略训练且确保制导性能,适用于拦截具有速度优势的机动目标。

王旭 · Deng, Yifan · Cai, Yuan Li · Jiang, Haonan

ISA Transactions 2025

技术优势

训练更快

通过事件触发机制,智能体仅在环境状态满足特定条件时更新动作,大幅减少学习阶段所需的决策步数。

性能不降

训练好的策略以固定的时间间隔执行,即时间触发方式,减轻了事件触发机制可能带来的控制性能下降。

优于传统

在有限机动能力、大初始航向误差和仅测角条件下,ETDRL制导律相比传统制导方法展现出增强的制导性能。

应用场景