The Blind Spot of Agent Safety: How Benign User Instructions Expose Critical Vulnerabilities in Computer-Use Agents
智能体安全的盲点:良性用户指令如何暴露计算机使用智能体的关键漏洞
机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) ; University of Minnesota(明尼苏达大学) ; University of Southern California(南加州大学) ; McGill University(麦吉尔大学) ; Mila(Mila研究院) ; MBZUAI(MBZUAI研究院)
专题命中 多智能体 :agent(title,abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI
AI总结 研究揭示了良性用户指令下智能体安全漏洞,提出OS-BLIND基准测试,发现多数智能体在攻击条件下成功率高达90%以上,且在多智能体系统中风险加剧,现有安全措施效果有限。
Comments 63 pages