Trust Your Critic: Robust Reward Modeling and Reinforcement Learning for Faithful Image Editing and Generation
相信你的批评者:用于忠实图像编辑和生成的鲁棒奖励建模与强化学习
机构 * Shanghai Jiao Tong University(上海交通大学) ; Wuhan University(武汉大学) ; BUPT(北京邮电大学) ; CUHK(香港中文大学) ; Fudan University(复旦大学) ; Shanghai AI Laboratory(上海人工智能实验室)
专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV
AI总结 本文提出FIRM框架,通过定制数据集和鲁棒奖励模型,提升图像编辑和生成的忠实性与指令遵循,采用'基础与奖励'策略平衡一致性与质量,实现性能突破。