Prosody-driven Jailbreaks in Audio LLMs: A Controlled Study and Mechanistic Analysis
音频大语言模型中基于韵律的越狱:一项对照研究与机制分析
机构 * City University of Hong Kong(香港城市大学) ; City University of Hong Kong (Dongguan)(香港城市大学(东莞))
专题命中 安全评测 :safety(abstract);jailbreak(abstract);分类 cs.CL
AI总结 该研究通过控制文本内容改变语音传递预设构建评估协议与基准,发现特定韵律特征的语音能提升音频大语言模型的越狱成功率,表明语音传递是音频大语言模型安全评估的重要因素。
Comments Accepted at ACM Multimedia 2026 (ACM MM '26). 9 pages, 3 figures. Supplementary material included
Journal ref Proceedings of the 34th ACM International Conference on Multimedia (MM '26), November 10-14, 2026, Rio de Janeiro, Brazil