收敛误差大幅降低
该算法无需系统矩阵先验信息,通过归一化步骤显著抑制最小二乘估计误差,适用任意随机参数分布,且无需初始均方稳定控制策略。
Wenwu, Fan · 熊军林
Systems and Control Letters 2024
归一化无模型值迭代算法通过提取下一个时刻的数据来学习最优控制律,无需系统矩阵的任何信息。
算法先对采集数据进行归一化处理,显著降低了最小二乘法的误差。
算法对随机系统矩阵的分布没有限制,适用任意分布。
算法不要求初始均方稳定控制策略,降低了使用门槛。