Every Picture Tells a Dangerous Story: Memory-Augmented Multi-Agent Jailbreak Attacks on VLMs
每幅画都讲述一个危险的故事:基于内存增强的多智能体 jailbreak 攻击 VLMs
机构 * Wuhan University(武汉大学) ; Zhongguancun Academy(中关村学院) ; Tianjin University(天津大学) ; University of the Chinese Academy of Sciences(中国科学院大学)
专题命中 越狱攻击 :jailbreak(title,title_cn);alignment(abstract);safety(abstract);分类 cs.AI
AI总结 本文提出MemJack框架,通过视觉语义引导多智能体协作,利用迭代空域投影过滤器提升对VLMs的攻击成功率,实验表明其在COCO数据集上达到71.48%的攻击成功率。
Comments 15 pages, 2 figures