RL Fine-Tuning Heals OOD Forgetting in SFT
强化学习修复SFT中的分布外遗忘
机构 * Mila - Quebec AI Institute(魁北克人工智能研究所) ; Polytechnique Montréal(蒙特利尔理工学院) ; Université de Montréal(蒙特利尔大学) ; McGill University(麦吉尔大学) ; CIFAR AI Chair(CIFAR人工智能主席) ; Google DeepMind(谷歌DeepMind)
专题命中 指令微调 :SFT(title,title_cn);LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)
AI总结 研究通过分析SFT和RL对ID和OOD推理的影响,发现RL能修复后期SFT导致的OOD能力下降,且与奇异向量旋转相关。
Comments 31 pages, 22 figures