ReWEIGH the Evidence: Calibrating Token-Level Ordinal Visual Evidence to Mitigate Hallucinations in Large Vision-Language Models
重新权衡证据:校准令牌级有序视觉证据以减轻大型视觉语言模型的幻觉
机构 * Pohang University of Science and Technology (POSTECH)(浦项科技大学(POSTECH))
专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI
AI总结 ReWEIGH是一种无需训练的解码干预方法,通过聚合视觉位置的令牌排名并施加有界惩罚,在多个7B至32B规模的LVLM上减少了最多21.3%的幻觉对象提及,且延迟增加极少。