Vision Language Models are Biased
视觉语言模型存在偏见
机构 * KAIST(韩国科学技术院) ; College of William and Mary(威廉与玛丽学院) ; University of Alberta(阿尔伯塔大学) ; Auburn University(阿伯茨维尔大学)
专题命中 视觉推理 :vision language model(title,abstract);VLM(abstract);分类 cs.CV、cs.LG
AI总结 研究探讨了视觉语言模型在计数和识别任务中的偏见问题,发现其在不同领域表现不佳,去除背景可显著提升准确率,揭示上下文视觉线索导致偏见。
Comments Code and qualitative examples are available at: vlmsarebiased.github.io