Egocentric Bias in Vision-Language Models
视觉语言模型中的自我中心偏差
机构 * Cognitive Science Program, University of California, Berkeley(加州大学伯克利分校认知科学项目) ; Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电气与计算机工程系) ; School of Computer Science, Georgia Institute of Technology & Emory University(佐治亚理工学院计算机科学学院及埃默里大学) ; Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系) ; Department of Cognitive Science, University of California San Diego(加州大学圣地亚哥分校认知科学系) ; Equal Advising Department of Computer Science & Wilmer Eye Institute, Johns Hopkins University(约翰霍普金斯大学计算机科学系及威尔默眼科研究所) ; Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所) ; Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) ; Weinberg Institute for Cognitive Science, University of Michigan(密歇根大学韦恩伯格认知科学研究所)
专题命中 幻觉与鲁棒性 :vision-language model(title,abstract);分类 cs.CV、cs.AI
AI总结 本文提出FlipSet基准,揭示视觉语言模型在第二级视觉视角推理中存在系统性自我中心偏差,表明模型在整合社会认知与空间操作方面存在根本性不足。
Comments Accepted at CogSci 2026 (Best Undergraduate Student Paper)