未标注实体不降性能
通过PU学习和负采样两步处理未标注实体,可嵌入任意token级NER模型,在多个数据集上取得有竞争力的性能。
Shunqin, Zhang · 张三国 · He, Wenduo · 张旋
Semantic Web and Information Systems 2024
该方法采用两步法处理未标注实体,能更有效地减轻它们对模型训练的负面影响。
该算法可轻松集成到任何token级NER模型中,无需为特定模型定制。