Multi-Agent AI Safety as an Institutional Design Problem
作为制度设计问题的多智能体AI安全
机构 * POLIS Research Programme, Project AWARE(POLIS研究计划,AWARE项目)
专题命中 安全训练 :safety(title,abstract);AI safety(title);分类 cs.AI、cs.LG
AI总结 本文作为POLIS项目首篇论文,探究多智能体AI安全的制度设计问题,通过含5280回合的实验套件,对比不同守卫机制,发现制度的权威状态与阻止后路径对安全的影响。
Comments 17 pages, 5 figures. Code and reproducibility artifacts available in the public POLIS repository