arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

ETH Zurich(苏黎世联邦理工学院)

2026-05-11 至 2026-05-11 共收录 8
2605.07885 2026-05-11 cs.RO

AERO-VIS: Asynchronous Event-based Real-time Onboard Visual-Inertial SLAM

AERO-VIS:异步事件基于的实时机载视觉-惯性SLAM

Yannick Burkhardt, Sebastián Barbas Laina, Simon Boche, Leonard Freißmuth, Stefan Leutenegger

机构 * Mobile Robotics Lab, ETH Zürich(苏黎世联邦理工学院移动机器人实验室) Technical University of Munich(慕尼黑技术大学) Munich Institute of Robotics and Machine Intelligence (MIRMI)(慕尼黑机器人与机器智能研究所)

AI总结 AERO-VIS是一种集成、数据驱动、稳健且性能优化的双目事件-惯性SLAM系统,通过异步处理事件流,实现低延迟和实时性能,首次实现了纯事件基于的惯性SLAM系统,支持闭环无人机控制和大规模状态估计。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07817 2026-05-11 cs.CV cs.AI cs.CL

GazeVLM: Active Vision via Internal Attention Control for Multimodal Reasoning

GazeVLM:通过内部注意力控制实现多模态推理的主动视觉

Brown Ebouky, Gabriele Carrino, Niccolo Avogaro, Christoph Studer, Andrea Bartezzaghi, Mattia Rigotti

机构 * IBM Research(IBM研究院) ETH Zurich(苏黎世联邦理工学院) TU Wien(维也纳技术大学)

AI总结 GazeVLM通过内部注意力控制实现主动视觉,使模型在多模态推理中实现从全局空间感知到局部聚焦推理的无缝切换,无需外部工具或增加视觉token。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07796 2026-05-11 cs.CL

PolySQL: Scaling Text-to-SQL Evaluation Across SQL Dialects via Automated Backend Isomorphism

PolySQL:通过自动化后端同构性跨SQL方言扩展文本到SQL评估

Yotam Perlitz, Elad Venezian, Corentin Royer, Francesco Fusco, Andrea Giovannini

机构 * IBM Research(IBM研究院) ETH Zürich(苏黎世联邦理工学院)

AI总结 PolySQL通过自动化后端同构性方法,实现跨SQL方言的文本到SQL评估扩展,揭示了从SQLite到其他方言的平均准确率下降10.1%及方言难度层级。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07775 2026-05-11 cs.LG cs.AI stat.ML

POETS: Uncertainty-Aware LLM Optimization via Compute-Efficient Policy Ensembles

POETS: 通过计算高效的策略集合实现不确定性感知的LLM优化

Nicolas Menet, Andreas Krause, Abbas Rahimi

机构 * IBM Research – Zurich(IBM瑞士苏黎世实验室) Department of Computer Science, ETH Zürich(苏黎世联邦理工学院计算机科学系)

AI总结 POETS通过计算高效的策略集合,结合KL正则化和策略优化,实现了在序列决策和黑箱优化中的不确定性量化,提升了样本效率和优化轨迹。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07675 2026-05-11 cs.AI cs.LG

FactoryBench: Evaluating Industrial Machine Understanding

FactoryBench:评估工业机器理解的基准测试

Yanis Merzouki, Coral Izquierdo, Matei Ignuta-Ciuncanu, Marcos Gomez-Bracamonte, Riccardo Maggioni, Alessandro Lombardi, Camilla Mazzoleni, Federico Martelli, Balazs Gunther, Jonas Petersen, Philipp Petersen

机构 * ETH Zurich(苏黎世联邦理工学院) Forgis UC3M Imperial College London(帝国理工学院伦敦分校) University of Berkeley(伯克利大学) KTH Royal Institute of Technology(皇家理工学院) University of Vienna(维也纳大学)

AI总结 本文提出FactoryBench基准测试,用于评估时间序列模型和LLM在工业机器人 telemetry 中的机器理解能力,通过四个因果层次和五种答案格式评估,包含70k问题-答案对,揭示当前模型与实际操作理解之间的差距。

Comments 9 pages, 4 figures, 14 tables; appendix with 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07562 2026-05-11 cs.CV

Beyond GSD-as-Token: Continuous Scale Conditioning for Remote Sensing VLMs

超越GSD-as-Token:远程 sensing VLMs 的连续尺度调节

Song Zhang, Yanlong Chen, Yilin Li, Yining Chen, Zili Yi, Xiaowei Zhang, Yawei Li

机构 * Nanjing University(南京大学) ETH Zurich(苏黎世联邦理工学院) RWTH Aachen University(亚琛工业大学)

AI总结 本文提出ScaleEarth框架,通过连续尺度条件变量动态调节模型计算路径,结合SSE-U和GeoScale-VQA实现遥感VLMs在不同GSD下的高效适应。

Comments Under review. 30 pages, 16 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11758 2026-05-11 cs.RO

HAIC: Humanoid Agile Object Interaction Control via Dynamics-Aware World Model

HAIC:通过动态感知世界模型实现人形敏捷物体交互控制

Dongting Li, Xingyu Chen, Qianyang Wu, Bo Chen, Sikai Wu, Hanyu Wu, Guoyao Zhang, Liang Li, Mingliang Zhou, Diyun Xiang, Jianzhu Ma, Qiang Zhang, Renjing Xu

机构 * Tsinghua University(清华大学) HKUST(Guangzhou)(香港科技大学(广州)) ETH Zurich(苏黎世联邦理工学院) Xiaomi Robotics Lab(小米机器人实验室)

AI总结 本文提出HAIC框架,通过动态预测和空间优先级构建动态占用地图,实现人形机器人在复杂动态环境下与不同物体的稳健交互,提升敏捷任务和多物体长周期任务的完成能力。

Comments RSS 2026. Webpage: https://haic-humanoid.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07051 2026-05-11 cs.CL

NSMQ Riddles: A Benchmark of Scientific and Mathematical Riddles for Quizzing Large Language Models

NSMQ谜题:一个科学和数学谜题的基准,用于评估大型语言模型

George Boateng, Naafi Ibrahim, Samuel John, Philemon Badu, Patrick Agyeman-Budu, Jonathan Mensah, Kevin Yeboah, William Edor, Andrew Mensa-Onumah, Nana Yeboah, Victor Wumbor-Apin Kumbol

机构 * ETH Zurich(苏黎世联邦理工学院) Charité - Universitätsmedizin Berlin(柏林夏里特医学院) Kwame AI Inc.(夸梅人工智能公司) Ashesi University(阿什西大学)

AI总结 本文提出NSMQ谜题基准,基于加纳国家科学与数学竞赛的谜题,评估大型语言模型的科学和数学推理能力,发现即使是最先进的模型也难以应对。

Comments 15 pages. Accepted at the 27th International Conference on Artificial Intelligence in Education

详情

展开后加载摘要…

URL PDF HTML 收藏