2601.05729
2026-05-27
cs.CV
57%
TAGRPO: Boosting GRPO on Image-to-Video Generation with Direct Trajectory Alignment
TAGRPO: 通过直接轨迹对齐提升图像到视频生成中的GRPO
Jin Wang, Jianxiang Lu, Guangzheng Xu, Comi Chen, Haoyu Yang, Linqing Wang, Peng Chen, Mingtao Chen, Zhichao Hu, Longhuang Wu, Shuai Shao, Qinglin Lu, Ping Luo
机构
*
The University of Hong Kong(香港大学)
;
Tencent Hunyuan(腾讯文心)
专题命中
文生图
:text-to-image(abstract);分类 cs.CV
AI总结
针对图像到视频生成中GRPO优化效果不佳的问题,提出基于对比学习的TAGRPO框架,通过中间潜变量对齐高奖励轨迹并远离低奖励轨迹,结合记忆库提升多样性,显著优于DanceGRPO。