SceneActBench: Can Agents Act on the 3D Scenes They See?
SceneActBench:智能体能否对其所看到的3D场景采取行动?
机构 * Tencent Hunyuan(腾讯混元) ; THU(清华大学) ; NJU(南京大学) ; HKUST(香港科技大学) ; UIUC(伊利诺伊大学厄巴纳-香槟分校) ; PKU(北京大学)
AI总结 研究视觉语言模型智能体在3D场景行动能力,提出SceneActBench基准测试,涵盖五个3D任务,通过特定指标评估智能体输出,分析不同配置得分及失败情况,为评估智能体在多对象3D场景行动提供依据。