Unsafe by Reciprocity: How Generation-Understanding Coupling Undermines Safety in Unified Multimodal Models
因互惠而不安全:生成-理解耦合如何在统一多模态模型中损害安全性
机构 * University of Maryland, College Park(马里兰大学帕克分校)
专题命中 越狱攻击 :safety(title,abstract)
AI总结 研究探讨了统一多模态模型中生成与理解之间的互惠关系可能成为安全漏洞的根源,提出RICE攻击方法,揭示了跨功能互惠对安全性的负面影响。
Comments 7 figures, 3 tables