免配对数据训练
不依赖成对噪声-干净语音数据,仅利用未配对干净语音与最优传输准则即可实现语音增强。
江文斌 · 俞凯 · 文飞
IEEE/ACM Transactions on Audio Speech and Language Processing 2024
利用最优传输准则,仅需未配对的干净语音即可训练,消除了对成对数据的依赖。
在CHiME4数据集上的语音识别结果优于其有监督对照方法。
采用多分辨率STFT损失作为验证损失,增强了训练过程的稳定性。