A Survey on Music Generation from Single-Modal, Cross-Modal, and Multi-Modal Perspectives
从单模态、跨模态和多模态视角综述音乐生成
机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) ; Innovation Center of Yangtze River Delta, Zhejiang University(浙江大学长三角创新中心)
专题命中 音频语音多模态 :multi-modal(title,abstract);cross-modal(title);分类 cs.AI、cs.MM
AI总结 本文综述了多模态音乐生成的研究现状,探讨了多模态数据对齐、系统评估方法及未来研究方向。