PPO同步控制器

免建模少一维控制

基于改进PPO的深度强化学习控制器,无需系统模型即可同步忆阻混沌系统,控制力从四维降至三维,且对高斯噪声鲁棒。

Shitao, Jin · 陈杰 · 吴杰 · 王晓锋 · 栾小丽 · 付俊杰 · 温广辉

IEEE Transactions on Circuits and Systems I: Regular Papers 2026

参数信息

控制输入维数
3

技术优势

免系统模型

无需系统动力学先验知识或解析模型,直接由数据驱动学习控制策略,省去了建模的麻烦。

控制维度少一维

将控制力从四维降低到三维,直接减少了执行器数量和计算负担,降低了控制复杂度与运行成本。

收敛更快

通过优化PPO中的奖励函数结构,加速了同步收敛,系统能更快进入同步状态。

扛得住高斯噪声

在高斯噪声扰动下仍能保持鲁棒性能,不必为噪声单独设计补偿器。

应用场景