Understanding Forgetting in LLM Supervised Fine-Tuning and Preference Learning -- A Convex Optimization Perspective
机构 * Rensselaer Polytechnic Institute(罗切斯特理工学院) ; IBM Research(IBM研究院) ; Cornell University(康奈尔大学)
专题命中 指令微调 :LLM(title,abstract);post-training(abstract);SFT(abstract);RLHF(abstract)