RationalRewards: Reasoning Rewards Scale Visual Generation Both Training and Test Time
RationalRewards: 基于理性反馈的视觉生成推理奖励
机构 * HKUST(香港科技大学) ; University of Waterloo(滑铁卢大学) ; Alibaba(阿里巴巴)
专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI、cs.LG
AI总结 RationalRewards通过显式多维反馈提升视觉生成模型,训练时提供可解释奖励,测试时通过生成-反馈-优化循环改进输出,无需参数更新。
Comments Project Page: https://tiger-ai-lab.github.io/RationalRewards/ ; Code, Dataset, Models are released