多词实体识别更准
通过短语-图像块对齐和门控融合机制,在多模态实体关系联合抽取中实现更准确的表示和噪声抑制。
Li, Yuan · 蔡毅 · Jingyu, Xu · Li Q. · Wang, Tao
IEEE Transactions on Knowledge and Data Engineering 2024
多词解码器集成相邻词对的预测结果,提升多词实体的抽取能力。
门控融合模块抑制与任务无关的图像信息,平衡图像对象和文本表示。
细粒度对齐模块利用短语-图像块连接文本短语和视觉对象,学习一致的多模态表示。