ReFineVLA: Multimodal Reasoning-Aware Generalist Robotic Policies via Teacher-Guided Fine-Tuning
ReFineVLA: 通过教师引导微调实现多模态推理感知的通用机器人策略
机构 * VinRobotics ; University of Texas at Arlington(德克萨斯大学阿灵顿分校) ; Max Planck Research School for Intelligent Systems (IMPRS-IS)(智能系统Max Planck研究学校) ; Intelligent Autonomous Systems Lab(智能自主系统实验室) ; TU Darmstadt(德累斯顿技术大学) ; Automation & Control Institute(自动化与控制研究所) ; TU Wien(维也纳技术大学) ; Austrian Institute of Technology (AIT)(奥地利技术研究所)
专题命中 VLA模型 :vision-language-action(abstract,abstract_cn);VLA(abstract,abstract_cn);分类 cs.RO、cs.CV
AI总结 本文提出ReFineVLA框架,通过教师引导的推理增强数据集微调机器人策略,提升多模态推理能力与泛化性能,在模拟任务中取得最佳表现。
Comments arXiv admin note: substantial text overlap with arXiv:2505.19080