Uncovering and Mitigating Positional Blind Spots in Vision-Language-Action Models
揭示并缓解视觉-语言-动作模型中的位置盲区
机构 * Shanghai Normal University(上海师范大学) ; East China Normal University(华东师范大学) ; Northwest A&F University(西北农林科技大学) ; Xidian University(西安电子科技大学)
专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract,abstract_cn);分类 cs.RO
AI总结 针对视觉-语言-动作模型存在的位置盲区问题,提出两阶段黑箱框架,通过网格划分与单侧对数似然比检验定位盲区,再经LoRA微调缓解,在五个模型上验证了方法的有效性。