RefReward-SR: LR-Conditioned Reward Modeling for Preference-Aligned Super-Resolution
RefReward-SR: 基于低分辨率参考的偏好对齐超分辨率奖励建模
机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; OPPO AI Center, OPPO Inc.(OPPO人工智能中心)
AI总结 本文提出RefReward-SR,通过低分辨率参考意识奖励模型实现偏好对齐的超分辨率,利用多模态大语言模型评估语义一致性,构建首个大规模低分辨率条件偏好数据集,实验表明其在人类判断对齐方面表现更优。