收敛快近五成
把固定时间稳定性机理嵌入强化学习的演员-评论家结构和自适应补偿中,收敛时间有与初始状态无关的上界,且对执行器饱和与时变偏置故障强鲁棒。
Wang, Qiufeng · Huajun, Fu · Zhiqiang, Chen · Baile, An · Zhenwei, Ma
Engineering Applications of Artificial Intelligence 2026
固定时间稳定性理论保证了收敛时间存在与初始状态无关的上界,无需担心初始条件变化导致收敛变慢。
在运载火箭姿态控制任务中,稳定时间比强化学习容错基准缩短50%,意味着收敛加速一倍。
自适应补偿机制削弱执行器饱和的影响并抵消时变偏置故障,使系统在故障下仍能保持控制精度。