Co-training with Ego-centric Video and Demonstration for Robot Navigation Task
基于自我中心视频与示范的机器人导航任务协同训练
机构 * Department of Informatics, Graduate School of Informatics, Kyoto University(信息学系,京都大学研究生院) ; Spatial Robotics Research Center, Fujitsu Limited(空间机器人研究中心,富士通有限公司)
专题命中 VLA模型 :VLA(summary_cn,abstract);vision-language-action(abstract);分类 cs.RO
AI总结 提出将自我中心行走视频转化为移动机器人模仿学习数据集的框架,通过联合训练VLA模型提升语言理解和动作生成能力。