Measuring AI Agents' Progress on Multi-Step Cyber Attack Scenarios
在多步骤网络攻击场景中衡量AI代理的进展
机构 * AI Security Institute, United Kingdom(人工智能安全研究所,英国)
专题命中 其他Agent :AI agent(title);分类 cs.AI、cs.LG
AI总结 本文评估前沿AI模型在需要链式异构能力的多步骤网络攻击场景中的自主攻击能力,发现模型性能与计算资源呈对数线性关系,且后续模型在固定资源下表现更优。