MAVL: A Multilingual Audio-Video Lyrics Dataset for Animated Song Translation
MAVL:面向动画歌曲翻译的多语言音视频歌词数据集
机构 * Yonsei University(延世大学) ; Seoul National University(首尔国立大学)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL、cs.MM、eess.AS
AI总结 提出首个多语言多模态歌词翻译基准MAVL,并设计音节约束的音视频大语言模型SylAVL-CoT,利用音视频线索和音节约束提升歌词可唱性和翻译准确性。
Comments Accepted to EMNLP 2025, Project Page: https://k1064190.github.io/papers/paper1.html, our codes and datasets are available at https://github.com/k1064190/MAVL