SceneTeract: Agentic Functional Affordances and VLM Grounding in 3D Scenes
SceneTeract:代理功能可能性与视觉语言模型在3D场景中的 grounded 性
机构 * École Polytechnique(巴黎综合理工学院) ; Dassault Systèmes(达索系统) ; Stanford University(斯坦福大学) ; USI Lugano(卢加诺大学) ; Technion(以色列理工学院) ; NVIDIA(英伟达)
专题命中 Agent评测 :agentic(title);agent(abstract)
AI总结 SceneTeract 通过结合高层语义推理与低层几何检查,验证3D场景功能,评估合成环境中的功能失败及VLM对功能可能性的预测能力,揭示语义信心与物理可行性之间的系统性不匹配。
Comments Project page: https://sceneteract.github.io/