ORC过热DRL控制策略

多工况泛化

通过Sim2Real迁移学习,该控制策略无需显式模型即可在多种工况下稳定控制ORC过热,避免了直接部署DRL的安全风险。

Lin, Runze · Yangyang, Luo · Wu, Xialai · Chen, Junghui · Huang, Biao · 苏宏业 · Lei, Xie

Applied Energy 2024

技术优势

免建模也能控

控制策略通过与仿真环境交互直接学到控制目标,无需建立ORC系统的显式数学模型,省去繁琐的系统辨识与建模过程。

多工况照样稳

Sim2Real迁移训练使智能体能够适应多种运行工况,解决了模型与实际系统之间存在偏差时控制性能下降的问题。

不用拿真机冒险

先在仿真器中训练策略,再迁移到物理系统,避免了强化学习直接在ORC实际设备上试错带来的安全隐患。

应用场景