Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain
Robobench:作为具身大脑的多模态大语言模型的综合评估基准
机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(信息多媒体国家重点实验室,计算机学院,北京大学) ; Beijing Academy of Artificial Intelligence(北京人工智能研究院) ; Institute for Brain and Intelligence, Fudan University(脑与智能研究院,复旦大学) ; University of Science and Technology Beijing(北京科技大学) ; Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)
AI总结 研究针对在动态非结构化环境中构建能感知、推理和行动的机器人的挑战,介绍RoboBench基准,涵盖多维度、多任务等,能评估多模态大语言模型,揭示其局限性并分析与下游控制关系,为量化高级认知提供支架。
Comments ECCV 2026 Camera Ready