SuRe: Surprise-Driven Prioritised Replay for Continual LLM Learning
SuRe: 基于惊喜的优先回放用于连续LLM学习
机构 * AI Centre, Department of Computer Science, University College London(伦敦大学学院人工智能中心、计算机科学系) ; Huawei Noah’s Ark Lab(华为诺亚实验室)
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 SuRe通过基于惊喜的优先回放和双学习者设计,提升连续LLM学习的性能和稳定性,有效缓解灾难性遗忘问题。