The Asymmetric Effects of Knowledge Distillation on Bias in Small Language Models
知识蒸馏对小型语言模型偏见的非对称影响
机构 * Meta
专题命中 效率与部署 :language model(title,abstract);small language model(title);SFT(abstract_cn);分类 cs.CL、cs.AI
AI总结 该研究发现知识蒸馏对小型语言模型偏见存在非对称影响,明确任务下提升上下文遵循能力,模糊任务下破坏弃权校准,提出PCCD协议可捕捉聚合指标遗漏的危害。
Comments 18 pages, 5 figures. Preprint