提升数据效率
通过自监督视觉Transformer自动提取重要图像补丁,减少强化学习所需的交互样本。
Zhaohui, Jiang · Weng, Paul
Lecture Notes in Computer Science 2023
利用自监督预训练的Vision Transformer从随机采样的补丁重建图像,识别出难以从邻近补丁重建的显著补丁,无需人工选择关键点。
在Atari游戏上仅用少量交互样本就达到与现有先进方法相当甚至更好的性能,减少训练时间和环境交互成本。