RewardFlow: Generate Images by Optimizing What You Reward
RewardFlow: 通过优化所奖励的内容生成图像
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; Sony Research, India(索尼印度研究院)
AI总结 RewardFlow通过多奖励Langevin动力学优化预训练扩散和流匹配模型,统一了语义对齐、感知保真度等不同可微奖励,并引入基于VQA的可微奖励提升语义监督。
Comments CVPR 2026. Project page: https://plan-lab.github.io/rewardflow