Finite Difference Flow Optimization for RL Post-Training of Text-to-Image Models
文本到图像模型强化学习后训练的有限差分流优化
机构 * UC Berkeley(加州大学伯克利分校) ; NVIDIA(英伟达)
专题命中 文生图 :text-to-image(title);diffusion(abstract);image synthesis(abstract);分类 cs.CV
AI总结 提出一种在线强化学习变体,通过采样配对轨迹并将流速度拉向更优图像方向来降低模型更新方差,将整个采样过程视为单一动作,实现更快的收敛和更高的输出质量与提示对齐。
Comments Code available at https://github.com/NVlabs/finite-difference-flow-optimization