Tex3D: Objects as Attack Surfaces via Adversarial 3D Textures for Vision-Language-Action Models
Tex3D: 通过对抗性3D纹理将物体作为攻击面用于视觉-语言-动作模型
机构 * East China Normal University(华东师范大学) ; Zhongguancun Academy(中关村学院) ; CFAR, A*STAR, Singapore(新加坡科技研究局CFAR) ; Tsinghua University(清华大学) ; Harbin Institute of Technology(哈尔滨工业大学)
专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract);分类 cs.CV、cs.AI
AI总结 本文提出Tex3D框架,通过对抗性3D纹理攻击视觉-语言-动作模型,揭示其在物理环境中面临的关键漏洞,展示了在仿真和真实机器人任务中显著降低模型性能的实验结果。