arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Edinburgh(爱丁堡大学)

2026-07-07 至 2026-07-07 共收录 4
2605.27243 2026-07-07 cs.CV 版本更新

Can Retrieval Heads See Images? Multimodal Retrieval Heads in Long-Context Vision-Language Models

检索头能看见图像吗?长上下文视觉语言模型中的多模态检索头

Aaron Branson Cigres Li, Zhaowei Wang, Yu Zhao, Yiming Du, Haobo Li, Xiyu Ren, Ginny Wong, Simon See, Lishu Luo, Haodong Duan, Pasquale Minervini, Yangqiu Song

机构 * HKUST(香港科技大学) University of Edinburgh(爱丁堡大学) CUHK(香港中文大学) NVAITC, NVIDIA, Santa Clara, USA(NVIDIA Santa Clara 分公司) Tsinghua University(清华大学)

AI总结 本文提出一种多模态检索头检测方法,发现视觉语言模型中仅有4.4-10.2%的注意力头贡献了50%的正检索分数,这些头对长上下文推理至关重要,且可直接用于文档检索提升性能。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16806 2026-07-07 cs.AI cs.RO 版本更新

Insect-inspired Visual Point-goal Navigation

一种高效的昆虫启发式方法用于视觉点目标导航

Yihe Lu, Barbara Webb

机构 * School of Informatics, University of Edinburgh(爱丁堡大学信息学院)

AI总结 本文提出了一种基于昆虫大脑结构的新型视觉点目标导航模型,通过模拟昆虫的联想学习和路径整合能力,实现高效导航。

Comments This work has been submitted for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00602 2026-07-07 cs.CL 版本更新

OpenSIR: Open-Ended Self-Improving Reasoner

OpenSIR: 开放式自我改进推理器

Wai-Chung Kwan, Joshua Ong Jun Leang, Pavlos Vougiouklis, Jeff Z. Pan, Marco Valentino, Pasquale Minervini

机构 * University of Edinburgh(爱丁堡大学) Imperial College London(伦敦帝国理工学院)

AI总结 提出OpenSIR框架,通过多样性奖励和难度校准实现开放式自我对弈,无需外部验证器或标注数据,在七个数学基准上平均提升指令模型3.6分、推理模型3.1分,且唯一能泛化到通用推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18509 2026-07-07 cs.AI cs.LG 版本更新

Neuro-symbolic Weak Supervision: Theory and Semantics

神经符号弱监督:理论与语义

Nijesh Upreti, Vaishak Belle

机构 * School of Informatics, University of Edinburgh(信息学院,爱丁堡大学)

AI总结 研究多实例部分标签学习中神经符号框架语义,通过集成归纳逻辑编程用关系约束构建该框架,定义标签转换假设空间等,研究两项归纳任务,便于约束规范等。

详情

展开后加载摘要…

URL PDF HTML 收藏