Reflect to Inform: Boosting Multimodal Reasoning via Information-Gain-Driven Verification
反思以获取信息:通过信息增益驱动的验证提升多模态推理
机构 * University of Science and Technology of China(中国科学技术大学) ; Huawei Foundation Model Department(华为基础模型部) ; The Chinese University of Hong Kong(香港中文大学) ; Hong Kong University of Science and Technology(香港科技大学)
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI
AI总结 本文提出VRE框架,通过信息增益驱动的自我进化训练,提升多模态大语言模型的推理准确性和感知可靠性,减少幻觉,尤其在长链任务中效果显著。