Why Supervised Fine-Tuning Fails to Learn: A Systematic Study of Incomplete Learning in Large Language Models
为何监督微调失效:对大语言模型中不完全学习现象的系统研究
机构 * University of New South Wales(新南威尔士大学) ; Tencent Hunyuan(腾讯文言) ; Tencent Yuanbao(腾讯元宝) ; UESTC(电子科技大学) ; Peking University(北京大学)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);SFT(abstract,abstract_cn)
AI总结 本文系统研究了大语言模型微调中不完全学习现象,揭示了五个导致学习不完整的原因,并提出诊断优先框架和缓解策略,证明监督微调的局限性。
Comments Accepted by ACL 2026 Main