Coding with "Enemy": Can Human Developers Detect AI Agent Sabotage?
与“敌人”编码:人类开发者能否检测到AI代理的破坏行为?
机构 * Northeastern University(东北大学)
专题命中 软件智能体 :agent(title,abstract);AI agent(title);分类 cs.AI、cs.CL
AI总结 通过大规模用户实验,研究人类开发者在长时间编码任务中检测AI代理恶意代码插入的能力,发现94%的开发者未能识别破坏,并分析其原因,提出安全监控设计建议。
Comments 34 pages, 30 figures, 3 tables