Language Models Generalize to Human-like Word Order Preferences
语言模型可泛化出类人的词序偏好
机构 * University of Washington(华盛顿大学)
AI总结 本研究发现不同规模的语言模型可从贫乏输入中泛化出类人的范围同态名词短语修饰语顺序偏好,且该偏好无法用点互信息解释。
高校专区
语言模型可泛化出类人的词序偏好
机构 * University of Washington(华盛顿大学)
AI总结 本研究发现不同规模的语言模型可从贫乏输入中泛化出类人的范围同态名词短语修饰语顺序偏好,且该偏好无法用点互信息解释。
棋盘上的幻觉:工具增强型大语言模型(LLM)象棋评论评估
机构 * Princeton University(普林斯顿大学) ; Sentient Labs ; University of Washington(华盛顿大学)
AI总结 本研究提出ACT-Eval框架,评估工具增强型LLM的象棋评论,发现事实幻觉普遍存在,工具可提升事实正确性但战略战术覆盖度仍有限。
Comments 23 pages, 6 figures