Analysis of LLMs Against Prompt Injection and Jailbreak Attacks
对LLMs对抗提示注入和 jailbreak攻击的分析
机构 * Bishop Cotton Boys’ School(伯希特·康普顿男校)
专题命中 越狱攻击 :jailbreak(title,abstract);prompt injection(title);safety(abstract);分类 cs.AI
AI总结 本文研究了LLMs对提示注入和jailbreak攻击的脆弱性,通过实验分析不同模型的行为差异,并评估了轻量级防御机制的效果。
Comments 12 pages, 5 figures, 6 tables