ViVa: A Video-Generative Value Model for Robot Reinforcement Learning
ViVa:用于机器人强化学习的视频生成价值模型
机构 * GigaAI ; Sichuan University(四川大学) ; Tsinghua University(清华大学)
专题命中 VLA模型 :VLA(abstract,abstract_cn);vision-language-action(abstract);分类 cs.RO、cs.AI
AI总结 提出ViVa,利用预训练视频生成器联合预测未来本体感受和标量价值,通过时空先验实现可靠价值估计,在三个任务中取得最优结果,与RECAP结合平均成功率达80%。