Design Principles for the Construction of a Benchmark Evaluating Security Operation Capabilities of Multi-agent AI Systems
多智能体AI系统安全操作能力评估基准的设计原则
机构 * Pennsylvania State University(宾夕法尼亚州立大学) ; Cyber Security Laboratory(网络安全实验室)
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI
AI总结 本文提出SOC-bench基准设计原则,用于评估多任务蓝队AI系统的能力,聚焦大规模勒索软件攻击事件响应中的五个蓝队任务。
Comments 29 pages, 1 figure