Self- and Other-Labels Induce Bidirectional Bias in LLM Judges
自标签与他标签诱导大语言模型评判器产生双向偏差
机构 * School of Digital Humanities and Computational Social Sciences, KAIST(韩国科学技术院数字人文与计算社会科学学院)
AI总结 该研究针对LLM评判器的自偏好混杂问题,通过评估带模型特征的叙事约束选择,发现控制质量后自偏好消失,而自/他标签会双向影响评分,明确了作者归属是评估偏差的独立驱动因素。