循环超参优化框架

无需先验知识

通过自博弈强化学习自动调优混合类型超参数,无需任何领域先验知识。

关佶红 · 吴飞 · 周水庚

Nature Communications 2026

参数信息

加速倍数
80 X
优化时间缩短倍数
13.4 fold
成本降低
73 %

技术优势

无需领域知识

策略智能体从零开始自动学习调参策略,不再需要人工设定先验或专家干预。

加速策略学习

针对大规模数据集上的严重奖励延迟,引入基于数据子集的奖励近似机制,使策略学习加速高达80倍。

匹配专家水平

在8个深度学习任务和32个基准上,Rocket使目标模型从零开始取得与专家调优相当的最先进性能。

应用场景