新任务快速自适应
采用MAML元强化学习训练的控制策略,使机械臂面对新任务时能利用多任务经验快速学习,大幅缩短训练时间并保持位置控制精度。
郝丽娜 · Cheng, Qiang · Liu, Hongshuai · 张颖
Applied Sciences (Switzerland) 2024
利用多任务训练中收集的信息与经验,新任务的控制策略学习过程被加速,避免从零开始训练。
通过元学习获取跨任务的初始策略,该策略可作为新任务学习的良好起点,使机械臂能快速适应不同任务。