HPSv3++: Scaling Reward Models Across the Full Spectrum of Diffusion Model Capabilities
HPSv3++:跨扩散模型能力全谱系扩展奖励模型
机构 * Tsinghua University(清华大学) ; JD Explore Academy(京东探索研究院) ; Peking University(北京大学) ; Zhejiang University(浙江大学)
AI总结 提出HPSv3++奖励模型框架,通过双维度偏好数据集HPDv3++和两阶段训练(正交梯度投影+无监督引导),提升对各类T2I模型及RL迭代的偏好预测能力,在多个基准上达到最优。