Grounding Robot Generalization in Training Data via Retrieval-Augmented VLMs
通过检索增强的视觉语言模型实现机器人在训练数据中的泛化
机构 * Stanford University(斯坦福大学) ; Google DeepMind(谷歌DeepMind) ; Princeton University(普林斯顿大学)
AI总结 本文提出RADAR框架,通过检索和视觉语言模型分析,评估机器人策略在不同场景下的泛化能力,验证了其在大规模数据集中的有效性。
Comments IEEE Robotics and Automation Letters (RA-L)