Flow-Map GRPO: Reinforcement Learning for Few-Step Flow-Map Generators via Anchored Stochastic Composition
Flow-Map GRPO:基于锚定随机组合的少步流映射生成器的强化学习
机构 * Georgia Institute of Technology(佐治亚理工学院)
AI总结 提出Flow-Map GRPO框架,通过锚定随机流映射组合(ASFMC)对确定性少步流映射生成器进行随机化,使其适用于强化学习后训练,并在FLUX文本到图像生成器上提升奖励和感知指标。
Comments 31 pages, 29 figures