Beyond Cross-Modal Alignment: Measuring and Leveraging Modality Gap in Vision-Language Models
超越跨模态对齐:测量和利用模态差距在视觉-语言模型中
Hanqi Yan, Xiangxiang Cui, Lu Yin, Jindong Gu, Paul Pu Liang, Yulan He, Yifei Wang
机构
*
King’s College London(伦敦国王学院)
;
University of Surrey(萨里大学)
;
University of Oxford(牛津大学)
;
MIT CSAIL(麻省理工学院CSAIL实验室)
;
The Alan Turing Institute(阿兰·图灵研究院)
Cognitive Alignment Deciphered: A Self-Developed Scenario-Based Prompt Scale Coupled with Representational Similarity Analysis and Social Network Analysis for Unraveling Bias Mechanisms Across Humans and LLMs
The Consensus Trap: Dissecting Subjectivity and the "Ground Truth" Illusion in Data Annotation
共识陷阱:数据标注中主观性与‘真实真相’幻觉的剖析
Sheza Munir, Benjamin Mah, Krisha Kalsi, Shivani Kapania, Julian Posada, Edith Law, Ding Wang, Syed Ishtiaque Ahmed
机构
*
University of Toronto Computer Science(多伦多大学计算机科学系)
;
University of Toronto Engineering Science(多伦多大学工程科学系)
;
Carnegie Mellon University School of Computer Science(卡内基梅隆大学计算机科学学院)
;
Yale University American Studies(耶鲁大学美国研究系)
;
University of Waterloo Computer Science(滑铁卢大学计算机科学系)
;
Google Research(谷歌研究)
;
University of Toronto(多伦多大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Yale University(耶鲁大学)
;
University of Waterloo(滑铁卢大学)