困惑度降约9点
通过整合话语特征与响应评估,同时提升对话的结构理解和生成响应的情感一致性。
Li, Bobo · 费豪 · Su, Fangfang · 李斐 · 姬东鸿
Information Processing and Management 2024
响应评估模块在训练中动态优化,确保生成的情感与语义和上下文一致。
在自动指标Perplexity上比现有基线低约9点,说明生成的文本更流畅、更接近人类表达。
在人类评估的三个细粒度方面均表现优异,覆盖了共情对话质量的关键维度。