泛化与判别兼得
在自监督预训练中引入强化学习,遵循进化博弈论指引,使模型泛化性与判别性同步提升。
Li, Jiangmeng · Zehua, Zang · Qirui, Ji · Sun, Chuxiong · Qiang, Wenwen · 张俊格 · 郑昌文 · 孙富春 · Hui, Xiong
International Journal of Computer Vision 2025
利用进化博弈论指导,并结合强化学习,在预训练过程中同时提升泛化性和判别性,克服了现有方法只能侧重其一的局限。
该方法理论上能够收紧自监督学习的泛化误差上界,为性能提供保障。
提供了一个全面评估表示泛化性和判别性的基准,便于后续研究比较。