Self-Preference Is Weak or Absent in Verifiable Instruction-Following Revision: A Four-Model Test Under Genuine Authorship
自我偏好在可验证的指令遵循修订中弱或不存在:基于真正作者身份的四模型测试
机构 * Department of Industrial Engineering, Tsinghua University(清华大学工业工程系)
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL
AI总结 通过IFEval验证器测试四类中端模型在指令遵循修订中的自我偏好,发现作者拒绝已验证正确编辑的比例与新鲜模型无显著差异,表明自我偏好弱或不存在。
Comments 7 pages, 3 tables. Code and data: https://github.com/williamguey/self-preference-revision