GRM: Utility-Aware Jailbreak Attacks on Audio LLMs via Gradient-Ratio Masking
GRM:通过梯度比掩码实现音频大语言模型的效用感知越权攻击
机构 * Sun Yat-Sen University(中山大学)
专题命中 测试生成 :repository(abstract);分类 cs.AI
AI总结 本文提出GRM框架,通过频率选择性扰动在音频大语言模型中实现效用感知的越权攻击,实验表明其在攻击成功率与效用平衡方面优于基线方法。
Comments Accpeted by MM 2026