Institutional Red-Teaming: Deployment Rules, Not Just Models, Causally Shape Multi-Agent AI Safety
机构红队测试:部署规则而非模型,因果性地塑造多智能体人工智能安全
机构 * Massachusetts Institute of Technology(麻省理工学院)
专题命中 红队测试 :safety(title,abstract);AI safety(title);分类 cs.AI
AI总结 研究多智能体人工智能安全中部署规则的影响,提出机构红队测试方法,通过IABench-CA实例化,发现规则改变集体安全、无安全默认规则、身份显著性是机制,还打包成安全案例工作流程认证规则区域并明确风险义务。