在线随机学习策略

需求响应实时寻优

基于事件驱动马尔可夫模型与策略迭代,在未知环境下自适应实时优化微电网运行与需求响应。

江琦 · 梁中明 · 唐昊

IEEE Transactions on Systems, Man, and Cybernetics: Systems 2024

技术优势

无需环境模型

算法在未知环境中在线学习最优策略,避免了对精确系统参数的依赖,可直接部署。

在线自适应

基于事件驱动的连续时间马尔可夫控制过程,策略随用能需求、可再生发电和电价动态变化及时调整,适合实时应用。

计算效率高

结合势估计与策略迭代的随机学习算法,适合在线运行,适合实际微电网能源管理系统集成。

应用场景