阶段代价学习算法

针对模型不准确的输入约束非线性系统,提出无需精确模型的约束最优控制求解新框架

Wang, Jianfeng · Wang, Yan · 纪志成

International Journal of Control, Automation and Systems 2024

技术优势

无需精确模型

通过引入最优阶段代价函数来量化不准确模型与真实动态之间的差异,从而降低对精确模型的依赖。

算法有收敛保证

所提出的基于策略迭代的阶段代价学习算法的收敛性得到了严格证明。

应用场景