Do LLM Evaluators Prefer Themselves for a Reason?
大语言模型评估器为何偏好自己?
机构 * University of Virginia(弗吉尼亚大学) ; George Washington University(乔治华盛顿大学)
专题命中 数学推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL
AI总结 研究探讨了大语言模型在评估时自我偏好现象的成因,发现更强模型更倾向于偏好自身输出,但其中大部分偏好源于客观质量优势,同时提出通过扩展策略可减少有害自我偏好。
Comments Added LMArena experiments