2604.12616
2026-08-21
cs.AI
cs.MM
版本更新
90%
Every Picture Tells a Dangerous Story: Memory-Augmented Multi-Agent Jailbreak Attacks on VLMs
每幅画都讲述一个危险的故事:基于内存增强的多智能体 jailbreak 攻击 VLMs
Jianhao Chen, Shiqin Wang, Haoyang Chen, Hanjie Zhao, Haozhe Liang, Zheng Wang, Tieyun Qian
机构
*
Wuhan University(武汉大学)
;
Zhongguancun Academy(中关村学院)
;
Tianjin University(天津大学)
;
University of the Chinese Academy of Sciences(中国科学院大学)
专题命中
越狱攻击
:jailbreak(title,title_cn);alignment(abstract);safety(abstract);分类 cs.AI
AI总结
本文提出MemJack框架,通过视觉语义引导多智能体协作,利用迭代空域投影过滤器提升对VLMs的攻击成功率,实验表明其在COCO数据集上达到71.48%的攻击成功率。