低资源识别更准
该模型通过注入词汇、样本和类别三类先验知识,在标注数据稀缺时仍能稳定识别辱骂性语言,并可跨领域泛化。
宋瑞 · Giunchiglia, Fausto · Yingji, Li · 李健 · Jingwen, Wang · 徐昊
Knowledge-Based Systems 2025
利用词汇、样本和类别三类先验知识,模型无需大量标注数据也能达到较好性能。
通过多对比学习获得稳定的样本级和类内表示,跨领域泛化平均提升2.58%。
通过上下文重构将词汇知识注入语言模型,促使模型关注辱骂性关键词。