Uncovering Linguistic Fragility in Vision-Language-Action Models via Diversity-Aware Red Teaming
通过多样性感知的红队行动揭示视觉-语言-动作模型中的语言脆弱性
机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) ; The Hong Kong University of Science and Technology(香港科技大学)
专题命中 模仿学习与强化学习 :embodied AI(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV
AI总结 本文提出DAERT框架,通过评估统一策略生成多样化挑战性指令,揭示VLA模型在语言变化下的脆弱性,实验显示任务成功率从93.33%降至5.85%。