POPS: Recovering Unlearned Multi-Modality Knowledge in MLLMs with Prompt-Optimized Parameter Shaking
POPS:通过提示优化参数抖动恢复多模态大语言模型中未学习的多模态知识
机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) ; DEVCOM Army Research Laboratory(陆军研究实验室)
AI总结 研究针对多模态大语言模型中隐私敏感信息擦除不彻底问题,提出POPS对抗策略,通过提示后缀优化生成潜在私人示例并微调模型,实验揭示现有MMU算法弱点,POPS能近乎完全恢复敏感信息,暴露隐私保护漏洞。