SIMPACT: Simulation-Enabled Action Planning using Vision-Language Models
SIMPACT:基于视觉-语言模型的仿真增强动作规划
机构 * UMD(马里兰大学) ; UIUC(伊利诺伊大学厄巴纳-香槟分校) ; Harvard(哈佛大学) ; Amazon FAR(亚马逊FAR) ; UPenn(宾夕法尼亚大学)
专题命中 GUI与屏幕智能体 :vision-language model(title,abstract);VLM(abstract);分类 cs.CV
AI总结 SIMPACT通过仿真循环世界建模赋予视觉-语言模型物理推理能力,实现高效动作规划,优于现有通用机器人操作模型,在五个复杂真实世界任务中表现优异。
Comments Accepted to CVPR 2026; camera-ready version