Isolation as a First-Class Principle for LLM-Agent System Safety: Concepts, Taxonomy, Challenges and Future Directions
隔离作为大语言模型智能体系统安全的头等原则:概念、分类法、挑战及未来方向
机构 * HKUST(香港科技大学) ; NYU(纽约大学) ; SWUPL(西南政法大学)
专题命中 越狱攻击 :safety(title,abstract);alignment(abstract);prompt injection(abstract);分类 cs.AI
AI总结 探讨大语言模型智能体系统安全问题,将隔离作为头等原则,用边界中心分类法组织文献,助于识别隔离丧失位置、妥协传播方式及相关防御,还总结了故障路径,讨论挑战并勾勒研究议程。