AlphaFlowTSE: One-Step Generative Target Speaker Extraction via Conditional AlphaFlow
AlphaFlowTSE:通过条件AlphaFlow实现的一步生成目标说话人提取
机构 * School of Electronic Science and Engineering, Xiamen University, Xiamen, China(1 厦门大学电子科学与技术学院,厦门,中国) ; School of Informatics, Xiamen University, Xiamen, China(2 厦门大学信息学院,厦门,中国) ; School of Intelligence Science and Technology, Nanjing University, Suzhou, China(3 南京大学智能科学与技术学院,苏州,中国) ; Shenzhen Loop Area Institute, Shenzhen, China(4 深圳循环区研究所,深圳,中国) ; School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen, Shenzhen, China(5 香港中文大学人工智能学院,深圳,中国) ; The Chinese University of Hong Kong, Shatin, N.T., Hong Kong SAR, China(6 香港中文大学,沙田,香港特别行政区,中国)
AI总结 AlphaFlowTSE通过条件AlphaFlow实现一步生成目标说话人提取,提升目标语音保真度和真实混合泛化能力。
Comments Submitted to Interspeech 2026 for review