MeloDISinger: Melody-Aware & Duration-Preserving Singing Voice Editing with Audio Infilling
MeloDISinger: 旋律感知与时长保持的歌唱声音编辑与音频填充
机构 * Graduate School of Artificial Intelligence, KAIST, South Korea(韩国釜山科学技术院人工智能研究生院) ; Graduate School of Culture Technology, KAIST, South Korea(韩国釜山科学技术院文化科技研究生院)
AI总结 提出基于流匹配的MeloDISinger模型,通过MeloDRP模块预测固定预算时长比率实现旋律感知的时长分配,结合流匹配梅尔解码器进行音频填充,在歌唱声音编辑任务上达到最优性能。
Comments Accepted to Interspeech 2026