Unlearners Can Lie: Evaluating and Improving Honesty in LLM Unlearning
无法学习者可以撒谎:评估和改进LLM去学习中的诚实性
机构 * Fudan University(复旦大学) ; Central South University(中南大学) ; Michigan State University(密歇根州立大学)
专题命中 预训练与数据 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 本文评估并改进LLM去学习中的诚实性,提出正式定义并引入评估指标,实验显示现有方法无法满足标准,提出ReVa方法提升去学习效果和诚实性。
Comments Accepted by ACL 2026