深度强化学习调度模型

动态分配实时调度

Pathfinder利用三个调度矩阵和专门设计的奖励函数,在动态生产环境中从十种调度规则中智能选择,以提高机器利用率和缩短作业完成时间。

Chenxi, Lyu · 董晨 · Qiancheng, Xiong · 陈羽中 · 翁谦 · Chen, Zhenyi

Computers, Materials and Continua 2025

参数信息

调度规则数量
10

技术优势

动态选规则

根据实时环境条件从十种调度规则中智能选择,而不是固定使用某一种。

持续自适应

通过强化学习不断细化调度策略,适应不断变化的生产需求。

应用场景