Grounding-Driven Attack: Improving Encoder-based Adversarial Transferability against Large Vision-Language Models
基于文本驱动的攻击:提升编码器对抗迁移性以攻击大型视觉-语言模型
机构 * The Hong Kong Polytechnic University(香港理工大学) ; Nanyang Technological University(南洋理工大学) ; Harbin Engineering University(哈尔滨工程大学)
专题命中 幻觉与鲁棒性 :vision-language model(title,abstract);grounding(title,abstract);分类 cs.CV
AI总结 提出文本驱动攻击(GDA),通过将扰动优化与文本接地证据对齐,并采用接地感知扰动分配和接地中心证据破坏策略,显著提升编码器攻击在黑盒大型视觉-语言模型上的迁移性。
Comments Under review;