Emergence of Context Characteristics Sensitivity in Large Language Models
大型语言模型中上下文特征敏感性的涌现
机构 * Nanyang Technological University(南洋理工大学) ; University of Copenhagen(哥本哈根大学)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);SFT(abstract,abstract_cn)
AI总结 通过测量监督微调、直接偏好优化和可验证奖励强化学习三个阶段,发现大型语言模型对上下文特征的敏感性在指令微调过程中动态变化,其中监督微调使模型倾向于使用易理解的上下文,而后续阶段可能强化或改变这一偏好。