LASH: Adaptive Semantic Hybridization for Black-Box Jailbreaking of Large Language Models
LASH:适应性语义混合用于大语言模型的黑盒劫持
机构 * University of Maine(缅因大学) ; University of Tennessee, Knoxville(田纳西大学, 基纳顿分校) ; University of Florida(佛罗里达大学)
专题命中 越狱攻击 :safety(abstract);jailbreak(abstract);分类 cs.CL
AI总结 本文提出LASH框架,通过适应性语义混合方法,利用多个基础攻击的输出作为可重用的种子提示,针对不同目标模型和有害类别进行自适应组合,从而在黑盒红队测试中取得更高的攻击成功率。