无监督语音增强模型

免配对数据训练

不依赖成对噪声-干净语音数据,仅利用未配对干净语音与最优传输准则即可实现语音增强。

江文斌 · 俞凯 · 文飞

IEEE/ACM Transactions on Audio Speech and Language Processing 2024

技术优势

无需配对数据

利用最优传输准则,仅需未配对的干净语音即可训练,消除了对成对数据的依赖。

性能超越有监督方法

在CHiME4数据集上的语音识别结果优于其有监督对照方法。

训练更稳定

采用多分辨率STFT损失作为验证损失,增强了训练过程的稳定性。

应用场景