Beyond Cross-Modal Alignment: Measuring and Leveraging Modality Gap in Vision-Language Models
超越跨模态对齐:测量和利用模态差距在视觉-语言模型中
机构 * King’s College London(伦敦国王学院) ; University of Surrey(萨里大学) ; University of Oxford(牛津大学) ; MIT CSAIL(麻省理工学院CSAIL实验室) ; The Alan Turing Institute(阿兰·图灵研究院)
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.AI
AI总结 本文提出通过测量和利用模态差距改进视觉-语言模型的下游任务,引入模态主导分数和自动可解释性度量,实现轻量级编辑和系统分析。
Comments accepted by ACL26-findings