The yes-no bias of large language models reflects answer order and wording, not shifts in moral judgment
大语言模型的是非偏差反映答案顺序和措辞,而非道德判断的转变
机构 * Princeton University(普林斯顿大学)
专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
AI总结 研究大语言模型在道德困境判断中的是非偏差,通过交叉对称化等心理测量方法区分逻辑判断、词汇等因素,发现前沿模型立场与形式无关,部分模型存在顺序和词汇偏差,最小模型可总结伪像,强调跨框架测量模型重视内容。