Owner-Harm: A Missing Threat Model for AI Agent Safety
所有权危害:AI代理安全的缺失威胁模型
机构 * BlueFocus Communication Group(蓝ocus通信集团) ; Tongji University(同济大学)
专题命中 Agent评测 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI、cs.CL
AI总结 本文提出Owner-Harm威胁模型,旨在解决AI代理对部署者造成伤害的问题,通过实验验证了现有防御体系的不足,并引入SSDG框架提升检测效果。
Comments 15 pages. Companion manuscript on per-decision proof-obligation synthesis (LSVJ-S) in preparation