多层穿梭车

实时调度提速

采用深度Q学习在多深位跨层穿梭车系统中实现实时调度,相比传统规则缩短平均周期时间。

Zhun, Xu · 徐立云 · Shao, Huan · Shang, Gang · Zhou, Zhuo

Engineering Applications of Artificial Intelligence 2026

技术优势

实时决策

通过将系统视为智能体,利用DQN在双指令周期模式下在线学习最优调度策略,避免了对未来任务的假设。

周期时间更短

实验表明,DQN策略在不同系统配置下的平均周期时间优于随机、先到先得和最短加工时间策略。

适用范围广

该方法在不同系统配置和移库策略下均表现优越,展示了深度强化学习在仓储自动化中的潜力。

应用场景