SEVRA-BENCH: Social Engineering of Vulnerabilities in Review Agents
SEVRA-BENCH:审查智能体中的社会工程漏洞
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Microsoft Core AI(微软核心人工智能) ; Amazon AWS(亚马逊AWS) ; Databricks
AI总结 提出SEVRA-BENCH基准,通过社会工程攻击框架评估LLM代码审查智能体拒绝恶意PR的能力,发现闭源与开源模型间存在显著安全差距。