VA-Judger: Reward Modeling from Human Preference Feedback for Joint Video-Audio Generation
VA-Judger:用于联合视频-音频生成的人类偏好反馈奖励建模
机构 * Shanghai Innovation Institution(上海创新研究院) ; Fudan University(复旦大学) ; Yinwang Intelligent Technology Co., Ltd(音网智能科技有限公司)
AI总结 本研究针对联合视频-音频生成的奖励信号问题,构建了VAPref-10K数据集与VA-Judger-Bench基准,提出思维链全奖励模型VA-Judger,其在预测人类偏好及提升生成质量上均优于基线方法。
Comments 19 pages, 7 figures, 8 tables. Code: this https URL (https://github.com/ShareLab-SII/VA-Judger)