Dialogue-Aware Video-to-Music Generation Using Public Domain Film Collections
基于公共领域电影集的对话感知视频到音乐生成
机构 * University of California San Diego(加利福尼亚大学圣地亚哥分校) ; University of Michigan(密歇根大学)
AI总结 该研究针对视频到音乐生成的可复现性问题,构建了OSSL-v2数据集,提出用对话作为条件信号的方法,在电影上评估后性能优于现有基线。