Ref-Adv: Exploring MLLM Visual Reasoning in Referring Expression Tasks
Ref-Adv:探索提及表达任务中的多模态大语言模型视觉推理
机构 * Northeastern University(东北大学)
AI总结 Ref-Adv 是一个旨在评估多模态大语言模型视觉推理能力的基准,通过增加表达复杂性和减少干扰项,揭示模型在视觉推理和 grounding 方面的不足。
Comments ICLR 2026
高校专区
Ref-Adv:探索提及表达任务中的多模态大语言模型视觉推理
机构 * Northeastern University(东北大学)
AI总结 Ref-Adv 是一个旨在评估多模态大语言模型视觉推理能力的基准,通过增加表达复杂性和减少干扰项,揭示模型在视觉推理和 grounding 方面的不足。
Comments ICLR 2026
读作人类:通过可并行的近读与略读压缩上下文
机构 * Tsinghua University(清华大学) ; Future Living Lab of Alibaba(阿里巴巴未来生活实验室) ; Northeastern University, China(中国东北大学)
AI总结 RAM通过可并行的近读与略读策略,有效压缩上下文,提升长输入处理效率,实现性能与可解释性的双重优化。
Comments 13 pages,5 figures (Compared with v1, the author affiliations have been corrected.)
VISTA: 基于知识的船舶轨迹补全与修复溯源
机构 * Department of Computer Science, Aalborg University, Denmark(计算机科学系,奥胡斯大学,丹麦) ; School of Computer Science and Engineering, Northeastern University, Shenyang, China(计算机科学与工程学院,东北大学,沈阳,中国)
AI总结 VISTA通过基于知识的可解释方法实现船舶轨迹补全,生成修复溯源以提升下游决策的可信度和效率。
Comments 24 pages, 14 figures, 4 algorithms, 8 tables. Code available at https://github.com/hyLiu1994/VISTA