一种基于模型的上下文强化学习方法,通过集成元启发式解和概率前向模型来提升机器人协同操作的适应能力,克服不确定性带来的学习不稳定问题。
Wenrui, Wang · 汤奇荣 · Hao, Yang · Chao, Yang · Baoping, Ma · Shuqing, Wang · 林荣富
Engineering Applications of Artificial Intelligence 2025
上下文强化学习跨任务泛化控制器,无需针对新物体或轨迹完全重新学习。
概率前向模型计算期望回报,缓解风险敏感偏差,提高在不确定接触动力学下的学习稳定性。
基于投影逆动力学的参数化底层控制策略在约束和无约束子空间实现解耦控制。