Assessing Automated Prompt Injection Attacks in Agentic Environments
评估智能体环境中的自动化提示注入攻击
机构 * ETH Zurich(苏黎世联邦理工学院)
专题命中 提示注入 :prompt injection(title,abstract);safety(abstract);分类 cs.AI
AI总结 研究在智能体环境中,黑盒优化方法(TAP)比梯度方法(GCG)更有效,且攻击效果依赖于攻击者模型,任务通用攻击可迁移但跨模型迁移受限。