Structured Visual Narratives Undermine Safety Alignment in Multimodal Large Language Models
结构化视觉叙事削弱多模态大语言模型的安全对齐
机构 * Singapore University of Technology and Design(新加坡技术与设计大学)
专题命中 越狱攻击 :alignment(title,abstract);safety(title,abstract);jailbreak(abstract);分类 cs.AI
AI总结 研究发现结构化视觉叙事在多模态大语言模型中导致安全对齐问题,通过漫画模板劫持攻击展示其危害,揭示现有防御方法在处理非有害敏感内容时的不可靠性。
Comments Code released at: https://github.com/Social-AI-Studio/ComicJailbreak