Bridging Self-Supervised Learning and Speech Enhancement: A Wav2Vec2-Conditioned Framework
桥接自监督学习与语音增强:一种基于Wav2Vec2的条件框架
机构 * Institute for Systems Research, University of Maryland, College Park(系统研究所,马里兰大学,College Park)
AI总结 提出一种以wav2vec 2.0特征为条件的扩散模型语音增强方法,通过FiLM调制U-Net瓶颈,利用指数平滑聚合系数,在VoiceBank-DEMAND和LibriMix上PESQ提升0.4。