CaliDist: Calibrating Large Language Models via Behavioral Robustness to Distraction
CaliDist: 通过抗干扰行为鲁棒性校准大型语言模型
机构 * Cornelia Caragea(卡伦·卡雷亚) ; Mohammad Anas Jawad(穆罕默德·安斯·贾瓦德)
专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG
AI总结 提出CaliDist方法,通过测量和惩罚模型对语义干扰的敏感性来校准LLM,在7个NLU基准上平均将ECE从23%降至7%。