VAMPO: Policy Optimization for Improving Visual Dynamics in Video Action Models
VAMPO:通过改进视频动作模型的视觉动态进行策略优化
机构 * Zhejiang University(浙江大学) ; Westlake University(西湖大学) ; Xiamen University(厦门大学) ; University of Sussex(Sussex大学) ; Tianjin University(天津大学) ; Wuhan University(武汉大学) ; Hebei University of Technology(河北工业大学) ; Nanjing University(南京大学) ; Fudan University(复旦大学) ; Beijing Academy of Artificial Intelligence(北京人工智能研究院) ; South China University of Technology(华南理工大学)
专题命中 动作表示与策略 :action model(title,abstract);分类 cs.RO
AI总结 VAMPO通过策略优化直接提升视频动作模型的视觉动态,结合GRPO和非对抗性奖励,在多种模拟和真实任务中提升任务相关视觉动态,增强下游动作生成和泛化能力。