LLM Unlearning for Cyber Defense: A Survey on Methods, Challenges, and Emerging Threats
用于网络防御的大语言模型遗忘:方法、挑战及新出现威胁的综述
机构 * Manipal Institute of Technology, Manipal Academy of Higher Education(马尼帕尔理工学院,马尼帕尔高等教育学院) ; San José State University(圣何塞州立大学)
专题命中 隐私与版权 :safety(abstract);jailbreak(abstract);分类 cs.LG
AI总结 综述聚焦于网络防御中LLM遗忘问题,探讨其面临风险,核心问题是现有方法能否真的去除知识。主要关注基于梯度的方法,因其与现有训练管道兼容且可扩展,从多方面审视LLM遗忘,为解决相关问题提供参考。
Comments 42 pages, 5 tables