ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies
ReCoVLA: VLM引导的奖励编译用于视觉-语言-动作策略的故障恢复
机构 * University of Southern California(南加州大学) ; Mitsubishi Electric Research Laboratories (MERL)(三菱电机研究实验室) ; Harvard University(哈佛大学)
AI总结 提出ReCoVLA框架,通过冻结预训练VLA策略,利用外部VLM推断故障模式并编译结构化奖励,训练残差恢复策略,实现零样本仿真到真实部署,在多种操作任务中提升成功率。
Comments 19 pages, 7 figures