The Emergence of Autonomous Penetration Capabilities in Large Language Model-Powered AI Systems
大型语言模型驱动的AI系统中自主渗透能力的涌现
机构 * Fudan University(复旦大学) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; Concordia AI ; Shanghai Innovation Institute(上海创新研究院)
专题命中 评测与基准 :LLM(summary_cn,abstract);large language model(title);language model(title);分类 cs.AI
AI总结 针对现有评估方法不透明、场景简化等问题,构建包含两级目标服务器和通用代理框架的自主渗透评估体系,测试19个LLM发现成功率10.7%-69.3%,且能力随模型整体能力提升。