Personalization Meets Safety:Mechanisms,Risks,and Mitigations in Personalized LLMs
个性化与安全的交汇:个性化大语言模型中的机制、风险与缓解措施
机构 * China Mobile Jiutian Artificial Intelligence Technology (Beijing) Co., Ltd.(中国移动九天人工智能技术(北京)有限公司) ; Chinese Academy of Sciences(中国科学院)
专题命中 安全训练 :safety(title,abstract);分类 cs.AI
AI总结 本文首次对个性化大语言模型进行安全导向的综述,从用户表征、个性化范式和评估三个维度组织,提出统一的安全风险分类,并分析各范式下的脆弱性及缓解策略。