Beyond Perception Errors: Semantic Fixation in Large Vision-Language Models
超越感知误差:大型视觉-语言模型中的语义固定
机构 * Rochester Institute of Technology(罗切斯特理工学院)
专题命中 VLM训练与架构 :VLM(summary_cn,abstract);vision-language model(title,abstract);分类 cs.CV、cs.LG
AI总结 研究发现大型视觉-语言模型在面对提示指定的替代映射时,倾向于保留默认解释,通过VLM-Fix基准测试揭示了语义固定现象,且通过训练和激活调整可部分修复误差。