When Text and Numbers Disagree: Evidence Arbitration in Large Language Models
当文本与数字不一致时:大型语言模型中的证据仲裁
机构 * University of Oxford(牛津大学) ; GlaxoSmithKline(葛兰素史克) ; Oxford Suzhou Centre for Advanced Research(牛津大学苏州高等研究院)
AI总结 该研究构建合成基准探究LLMs在文本与数字证据冲突时的仲裁行为,发现其存在系统性偏好,常依赖启发式策略,凸显工具增强决策系统的失效模式。