Retrieve, Don't Retrain: Extending Vision Language Action Models to New Tasks at Test Time
检索,不重新训练:在测试时将视觉语言动作模型扩展到新任务
机构 * NAVER AI Lab(NAVER AI实验室) ; Korea University(高丽大学)
专题命中 VLA模型 :action model(title,abstract);vision language action(title);VLA(abstract,abstract_cn);vision-language-action(abstract)
AI总结 提出检索增强策略,通过一次训练冻结模型,部署时仅添加检索数据即可适应新任务,无需逐任务微调,在跨本体泛化中优于基线。
Comments https://recap-robot.github.io/