比SOTA高3.3%
相比已有基于语义的小样本学习方法,该模型以更简洁的架构充分利用预训练语言模型的零样本能力,实现更优性能。
Zhou, Chunpeng · 于智 · Xilu, Yuan · Zhou, Sheng · 卜佳俊 · Wang, Haishuai
Information Fusion 2025
直接将视觉特征与文本特征相加用于推理,无需设计复杂的融合模块。
在1-shot任务上平均超越现有最优方法3.3%,性能增益突出。