OpenAgentSafety: A Comprehensive Framework for Evaluating Real-World AI Agent Safety
OpenAgentSafety: 一个全面评估现实世界AI代理安全性的框架
机构 * Language Technologies Institute, Carnegie Mellon University(语言技术研究所,卡内基梅隆大学) ; Allen Institute for Artificial Intelligence(人工智能研究院)
专题命中 Agent评测 :agent(title,abstract);AI agent(title,abstract);agentic(abstract);分类 cs.AI
AI总结 OpenAgentSafety提出一个全面评估AI代理安全性的框架,通过真实工具和多任务测试揭示代理在现实世界中的安全漏洞,强调需要加强安全防护。
Comments 26 pages, 10 figures, Accepted at ICLR 2026 and IASEAI 2026