From Prompts to Responses: Dual-Sided Data Leakage and Defense in Split Large Language Models
从提示到响应:分割大语言模型中的双面数据泄露与防御
专题命中 指令微调 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI
AI总结 提出PIDI攻击方法,同时泄露分割LLM中的输入提示和输出响应;并设计ADMI防御机制,通过适配器热身和互信息正则化有效抵御攻击。
Comments 18 pages, Accepted at ICML 2026