单架构兼分类与发现
把域内意图分类和开放世界意图发现统一到条件文本生成框架中,通过自博弈强化学习让模型在对话中自主探索新意图。
Xuechen, Zhao · Liu, Yuying · Yanyi, Huang · Liao, Yuying · Lei, Tian · 周斌
Information Processing and Management 2026
让域内分类和域外发现共享同一个条件生成框架,避免了维护多套系统的麻烦。
自博弈强化学习模拟人机交互来迭代发现和验证新意图标签,减少了人工标注负担。
奖励函数同时考虑语义保真和领域相关性,引导模型生成连贯且有效的意图标签,避免无效探索。