MirrorCheck: Efficient Adversarial Defense for Vision-Language Models
MirrorCheck: 视觉-语言模型的高效对抗防御
机构 * Mohamed Bin Zayed University of Artificial Intelligence(莫扎伊德大学人工智能大学) ; NVIDIA ; École Polytechnique Fédérale de Lausanne(洛桑联邦理工学院) ; Michigan State University(密歇根州立大学)
AI总结 提出MirrorCheck框架,利用文本到图像模型和随机化策略检测并防御针对视觉-语言模型的自适应对抗攻击。