MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models
MIRL:基于互信息的强化学习用于视觉-语言模型
机构 * School of Mathematics, Tianjin University, Tianjin, China(天津大学数学学院) ; Institute of Information Engineering, Chinese Academy of Sciences, Beijing, China(中国科学院信息工程研究所) ; Shanghai Advanced Institute of Finance (SAIFS), East China Normal University, Shanghai, China(上海先进金融研究所(SAIFS),东华大学) ; ENN Group, Digital Technology Research Institute, China(ENN集团,数字技术研究院) ; Nanyang Technological University, Singapore(南洋理工大学) ; National University of Singapore, Singapore(新加坡国立大学)
专题命中 视觉推理 :vision-language model(title,abstract);分类 cs.CV
AI总结 MIRL通过利用生成描述与视觉输入之间的互信息,解决视觉语言模型在复杂推理任务中的感知误差和幻觉问题,提升回答准确性。