GEAR-VLA: Learning Geometry-Aware Action Representations for Generalizable Robotic Manipulation
GEAR-VLA:学习几何感知的动作表示以实现可泛化的机器人操作
机构 * Anhui University(安徽大学) ; University of Science and Technology of China(中国科学技术大学) ; iFLYTEK(科大讯飞)
AI总结 提出GEAR-VLA框架,通过粗到细的动作学习、语义对齐的3D集成和具身规范化,学习统一的几何感知动作表示,实现跨物体、背景和机器人的泛化操作。