ED-DHP 飞行控制算法

在线自学习无需建模

一种基于误差动力学的双重启发式动态规划算法,能同时在线学习前馈与反馈控制项,无需系统动力学知识或离线学习即可实现鲁棒姿态控制。

黄迅 · Yuan, Zhang · 柳嘉润 · Honghao, Zhong · Wang, Zhaolei · Yue, Peng

Applied Sciences (Switzerland) 2023

技术优势

无需系统动力学模型

算法不依赖完整的系统动力学和参考轨迹动力学知识,降低了工程实现的先验建模要求。

在线自学习无需离线训练

执行网络在飞行中实时学习控制策略,无需预先离线训练阶段,提高了适应性和部署效率。

补偿建模误差与扰动

通过 RLS 辨识误差动力学中的总不确定项并进行补偿,增强了对建模不准和参数摄动的鲁棒性。

应用场景