arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

ETH Zurich(苏黎世联邦理工学院)

2026-07-30 至 2026-07-30 共收录 4
2607.27194 2026-07-30 cs.CV cs.RO 新提交

VidMap: Exploiting Temporal Structure for Video-Based Structure-from-Motion

VidMap:利用时序结构实现基于视频的运动恢复结构

Zador Pataki, Paul-Edouard Sarlin, Marc Pollefeys

机构 * ETH Zurich(苏黎世联邦理工学院) Google(谷歌) Microsoft(微软)

AI总结 VidMap结合SLAM序列约束与SfM全局优化,利用宽基线匹配和深度先验,在多样挑战性数据集上,较最新SLAM和SfM更鲁棒准确,可实现任意长未标定视频的度量重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26326 2026-07-30 cs.CV 新提交

Seeing or Knowing? Visual Context Sensitivity in Multimodal Large Language Models

视觉还是认知?多模态大语言模型的视觉上下文敏感性

Jiaang Li, Chengzu Li, Zhaochong An, Yifei Yuan, Xi Liu, Serge Belongie, Vésteinn Snæbjarnarson

机构 * University of Copenhagen(哥本哈根大学) University of Cambridge(剑桥大学) ETH Zürich(苏黎世联邦理工学院) Clemson University(克莱姆森大学)

AI总结 该研究探究多模态大语言模型在视觉证据与先验冲突任务上的失效原因,引入WhatIfVis基准,发现其能编码视觉证据但难以控制对其的依赖,监督微调等方法可提升可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26165 2026-07-30 cs.CV 新提交

DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving

DVPSFormer:面向自动驾驶的高效在线深度感知视频全景分割

Yung-Hsu Yang, Luigi Piccinelli, Siyuan Li, Mattia Segu, Lei Ke, Martin Danelljan, Yuqian Fu, Zuria Bauer, Fisher Yu, Hermann Blum, Marc Pollefeys

机构 * ETH Zürich(苏黎世联邦理工学院) INSAIT, Sofia University(保加利亚索菲亚大学INSAIT研究所) University of Bonn(波恩大学) Microsoft(微软公司)

AI总结 DVPSFormer是一种统一在线架构,通过ESD和OMV机制实现高效4D场景理解,在两个DVPS基准上达SOTA,为自动驾驶提供在线机器人感知的精简方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18553 2026-07-30 cs.LG cs.DS cs.IT math.IT

The Geometry of LLM Quantization: GPTQ as Babai's Nearest Plane Algorithm

LLM量化几何学:GPTQ作为Babai最近平面算法

Jiale Chen, Yalda Shabanzadeh, Elvir Crnčević, Torsten Hoefler, Dan Alistarh

机构 * Institute of Science and Technology Austria (ISTA)(奥地利科学技术院) Red Hat, Inc.(红帽公司) ETH Zürich(苏黎世联邦理工学院)

AI总结 本文将GPTQ与Babai最近平面算法等价,揭示其几何意义和误差上界,设计出无裁剪的量化方法并提供高效GPU内核,为大规模模型量化理论奠定基础。

Comments Published as a conference paper at the Fourteenth International Conference on Learning Representations (ICLR 2026): https://openreview.net/forum?id=NFB4QGGS65

Journal ref International Conference on Learning Representations, 2026, pp. 122653-122695

详情

展开后加载摘要…

URL PDF HTML 收藏