进化博弈自监督模型

泛化与判别兼得

在自监督预训练中引入强化学习,遵循进化博弈论指引,使模型泛化性与判别性同步提升。

Li, Jiangmeng · Zehua, Zang · Qirui, Ji · Sun, Chuxiong · Qiang, Wenwen · 张俊格 · 郑昌文 · 孙富春 · Hui, Xiong

International Journal of Computer Vision 2025

技术优势

泛化与判别兼得

利用进化博弈论指导,并结合强化学习,在预训练过程中同时提升泛化性和判别性,克服了现有方法只能侧重其一的局限。

有理论保障

该方法理论上能够收紧自监督学习的泛化误差上界,为性能提供保障。

提供评估基准

提供了一个全面评估表示泛化性和判别性的基准,便于后续研究比较。

应用场景