Representation Collapse in Sequential Post-Training of Large Language Models
大型语言模型顺序后训练中的表示坍缩
机构 * Hangzhou Dianzi University(杭州电子科技大学) ; Zhejiang Gongshang University(浙江工商大学) ; Ningbo University(宁波大学) ; Shanghai University(上海大学)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);preference optimization(abstract)
AI总结 研究大型语言模型在顺序后训练阶段中内部表示逐渐压缩为低秩、各向异性且同质的特征空间,并提出轻量级干预措施以保持未来可学习性。
Comments work in progress