Beyond Description: Cognitively Benchmarking Fine-Grained Action for Embodied Agents
超越描述:为具身智能体进行细粒度动作的认知基准测试
机构 * Zhejiang University(浙江大学) ; Wolf 1069 b(沃尔夫1069b) ; Sany Group(三一集团) ; The Hong Kong Polytechnic University(香港理工大学) ; Imperial College London(帝国理工学院)
AI总结 本文提出CFG-Bench基准测试,旨在评估具身智能体在物理交互中的细粒度动作能力,揭示现有MLLMs在高层次推理中的不足,并通过监督微调提升其性能。
Comments Accepted to ECCV2026