arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

ETH Zurich(苏黎世联邦理工学院)

2026-06-23 至 2026-06-23 共收录 20
2606.22333 2026-06-23 eess.SP cs.HC cs.LG 新提交

Towards Whole Hand and Wrist Kinematic Tracking with a Wearable A-Mode Ultrasound Probe

基于可穿戴A型超声探头的手腕和手部运动学跟踪

Giusy Spacone, Luca Benini, Andrea Cossettini

机构 * Integrated Systems Laboratory, ETH Zurich(瑞士苏黎世联邦理工学院集成系统实验室) DEI, University of Bologna(博洛尼亚大学DEI学院)

AI总结 提出使用WULPUS平台的可穿戴A型超声进行23自由度手部运动学跟踪,采用紧凑CNN和增量训练策略,并在微控制器上实现端到端推理,功耗仅33mW。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22527 2026-06-23 cs.CV 新提交

Trajectory Forcing: Structure-First Generation with Controllable Semantic Trajectories

轨迹强制:具有可控语义轨迹的结构优先生成

Merve Kocabas, Gege Gao, Bernhard Schölkopf, Andreas Geiger

机构 * University of Tübingen(图宾根大学) ETH Zürich(苏黎世联邦理工学院) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) ELLIS Institute(ELLIS研究所) Tübingen AI Center(图宾根人工智能中心)

AI总结 提出轨迹强制框架,将生成过程组织为从全局布局到细节的语义阶段,每个阶段产生可解码的潜在状态,支持局部编辑,实现结构优先的可控图像合成。

Comments Project page: https://mervekocabas.github.io/TrajectoryForcing/

Journal ref Proceedings of the European Conference on Computer Vision (ECCV), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22197 2026-06-23 cs.CV 新提交

Multi4D: High-Fidelity Dynamic Gaussian Splatting via Multi-Level Competitive Allocation

Multi4D: 通过多级竞争分配实现高保真动态高斯泼溅

Rui Wang, Quentin Lohmeyer, Siyu Tang, Mirko Meboldt

机构 * ETH Zürich(苏黎世联邦理工学院)

AI总结 提出Multi4D框架,通过三级竞争分配(静态结构、持久动态几何、瞬态外观)解决动态高斯泼溅中运动一致性与视觉保真度的矛盾,实现高保真渲染和实时性能。

Comments Accepted by ECCV 2026, project page:https://batfacewayne.github.io/Multi4D.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22181 2026-06-23 cs.LG 新提交

Residue-Level Attributions in Protein Language Models Do Not Recover Allergen Epitopes

蛋白质语言模型中的残基级归因不能恢复过敏原表位

Jianzhou Yao, Anxiong Song, Katja Baerenfaller, Damir Zhakparov

机构 * Swiss Institute of Allergy and Asthma Research, Davos, Switzerland(瑞士过敏与哮喘研究所,达沃斯,瑞士) ETH Zurich, Zurich, Switzerland(苏黎世联邦理工学院,苏黎世,瑞士) Swiss Institute of Bioinformatics, Lausanne, Switzerland(瑞士生物信息学研究所,洛桑,瑞士)

AI总结 本研究通过引入表位基准,评估蛋白质过敏原性模型的可解释性,发现分类器残基级归因与注释表位对齐不显著,模型可能依赖理化特征而非表位特异性机制。

Comments Accepted at the ICML 2026 Mechanistic Interpretability Workshop (peer-reviewed)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22061 2026-06-23 cs.CL cs.AI 新提交

NL2Scratch: An Executable Benchmark and Evaluation for Block-Based Programming

NL2Scratch: 面向积木式编程的可执行基准与评估

Heejin Do, Alexandre Ballenghien, Yang Wu, April Yi Wang

机构 * ETH Zurich(苏黎世联邦理工学院) ETH AI Center(ETH人工智能中心)

AI总结 提出NL2Scratch基准,包含31万+解析验证的NL-Scratch程序对,并设计语义对齐一致性(SAC)指标评估语义匹配,实验发现词法相似度高但语义对齐不足,尤其在操作槽位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21458 2026-06-23 cs.LG 新提交

Post-Training Speech Enhancement Language Models with Perceptual Rewards

基于感知奖励的语音增强语言模型后训练

Frédéric Berdoz, Luca A. Lanzendörfer, Antonis Asonitis, Roger Wattenhofer

机构 * ETH Zürich(苏黎世联邦理工学院)

AI总结 提出使用组序列策略优化(GSPO)结合多指标感知奖励对自回归语音增强语言模型进行后训练,直接优化非可微质量指标,在DNS2020基准上达到最优,且多奖励优化优于单指标变体。

Comments Accepted at Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21406 2026-06-23 cs.RO cs.CV 新提交

Robot Self-Improvement via Human-Video Dynamics Models

机器人通过人类视频动力学模型自我改进

Hanzhi Chen, Anran Zhang, Simon Schaefer, Kejia Chen, Shi Chen, Daniel Cremers, Oier Mees, Stefan Leutenegger

机构 * ETH Zurich(苏黎世联邦理工学院) Technical University of Munich(慕尼黑工业大学) Microsoft(微软) MCML(慕尼黑机器学习中心)

AI总结 提出DGAC方法,利用人类视频学习跨本体的动作、动力学和价值表征,使机器人能从自身失败中自主改进,在7个真实操作任务中将成功率从40%提升至81%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21321 2026-06-23 cs.LG 新提交

Objective-Behavior Alignment: Diagnostics for MORL Policy Selection

目标-行为对齐:多目标强化学习策略选择的诊断方法

Antonio Mone, Zuzanna Osika, Florian Felten, Pradeep K. Murukannaiah, Mark Fuge, Frans A. Oliehoek, Luciano Cavalcante Siebert

机构 * Delft University of Technology(代尔夫特理工大学) ETH Zurich(苏黎世联邦理工学院)

AI总结 提出一种诊断工作流,自动揭示帕累托前沿上仅靠目标值无法体现的行为差异,通过定量和可视化工具辅助策略选择,在简单网格和连续控制基准上验证有效性。

Comments 22 pages, 41 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20736 2026-06-23 cs.CV 新提交

REKEY: Metadata-Grounded Visual-Key Regeneration for Contamination-Resilient VQA Evaluation

REKEY: 基于元数据的视觉键再生方法用于抗污染的VQA评估

Tengjie Lin, Yutao Sun, Jingwei Ni, Shuhan Ge, Hao-Xuan Ma, Yanting Miao, Wangyue Lu, Mingshuai Chen, Tiancheng Zhao, Jianwei Yin

机构 * Zhejiang University(浙江大学) ETH Zürich(苏黎世联邦理工学院) Nanjing University of Science and Technology(南京理工大学) Nanjing University(南京大学) University of Waterloo(滑铁卢大学) Binjiang Institute of Zhejiang University(浙江大学滨江研究院)

AI总结 提出ReKey协议,通过随机再生图像中的视觉键来防止VQA基准测试泄露,实验显示原始项目得分比再生变体高9.5-18.8个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23637 2026-06-23 cs.LG math.OC 新提交

Muown Implicitly Performs Angular Step-size Decay

Muown 隐式执行角步长衰减

Florian Hübler, Kai Lion, Antonio Orvieto, Niao He

机构 * ETH Zurich(苏黎世联邦理工学院) ELLIS Institute Tübingen(蒂宾根ELLIS研究所) MPI-IS Tübingen AI Center(马克斯·普朗克智能系统研究所蒂宾根人工智能中心)

AI总结 本文揭示 Muown 优化器的方向更新等价于归一化方向上的黎曼步长,其未归一化参数幅度仅调节角步长,据此提出显式角步长的 AngularMuown 方法,在 nanoGPT 竞赛和 Qwen2 等模型上表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23346 2026-06-23 astro-ph.CO cs.AI 新提交

Field-level weak lensing cosmology with $<100$ simulations using multifidelity simulation-based inference

使用少于100次模拟的多保真度基于模拟推理的场级弱引力透镜宇宙学

Alex A. Saoulis, Kiyam Lin, Niall Jeffrey, Maximilian von Wietersheim-Kramsta, Davide Piras, Alessio Spurio Mancini, Ana M. G. Ferreira, Benjamin Joachimi

机构 * Department of Physics & Astronomy, University College London(物理与天文学系,伦敦大学学院) Department of Earth Sciences, University College London(地球科学系,伦敦大学学院) Department of Physics & King’s Institute for Artificial Intelligence, King’s College London(物理系及国王学院人工智能研究所,国王学院) Institute for Computational Cosmology (ICC) & the Centre for Extragalactic Astronomy (CEA), Durham University(计算宇宙学研究所(ICC)及(extragalactic astronomy)天文中心(CEA),杜伦大学) Département de Physique Théorique, Université de Genève(理论物理系,日内瓦大学) ETH Zurich, Institute for Particle Physics and Astrophysics(苏黎世联邦理工学院,粒子物理与天体物理学研究所) Department of Physics, Royal Holloway, University of London(物理系,伦敦皇家霍洛威大学)

AI总结 提出多保真度基于模拟推理方法,用60-100次高保真N体模拟实现场级弱引力透镜宇宙学推断,显著降低模拟成本。

Comments 19 + 7 pages, 13 + 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13102 2026-06-23 cs.RO 新提交

FTP-1: A Generalist Foundation Tactile Policy Across Tactile Sensors for Contact-Rich Manipulation

FTP-1:一种跨触觉传感器的通用基础触觉策略,用于密集接触操作

Chengbo Yuan, Zicheng Zhang, Mingjie Zhou, Wendi Chen, Yi Wang, Zhuoyang Liu, Dantong Niu, Shuo Wang, Hui Zhang, Wenkang Zhang, Yingdong Hu, Yuanqing Gong, Wanli Xing, Chuan Wen, Cewu Lu, Kaifeng Zhang, Yang Gao

机构 * Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海期智研究院) Sharpa Shanghai Jiao Tong University(上海交通大学) University of California, Berkeley(加州大学伯克利分校) ETH Zurich(苏黎世联邦理工学院) Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 提出FTP-1,首个通用基础触觉策略,通过异构编码器和共享Transformer专家,跨21种传感器和3000小时数据预训练,实现触觉操作技能的跨传感器迁移,在未见传感器上成功率提升31%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11917 2026-06-23 cs.CV 版本更新

PicoSAM3: Real-Time In-Sensor Region-of-Interest Segmentation

PicoSAM3:实时传感器区域感兴趣分割

Pietro Bonazzi, Nicola Farronato, Stefan Zihlmann, Haotong Qin, Michele Magno

机构 * ETH Zürich(苏黎世联邦理工学院) IBM Research(IBM研究院)

AI总结 PicoSAM3是一款轻量级实时传感器区域分割模型,结合密集CNN架构、区域兴趣提示编码和知识蒸馏,实现低延迟高精度分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17525 2026-06-23 cs.RO 版本更新

HumanHalo -- Safe and Efficient 3D Navigation Among Humans via Minimally Conservative MPC

HumanHalo -- 通过最小保守MPC实现安全高效的三维人群导航

Simon Schaefer, Helen Oleynikova, Sandra Hirche, Stefan Leutenegger

机构 * Technical University of Munich(慕尼黑技术大学) ETH Zurich(苏黎世联邦理工学院)

AI总结 提出HumanHalo框架,结合可达性安全保证与数据驱动人体运动预测,通过仅约束初始控制输入实现安全高效的3D MAV人群导航,在仿真和真实实验中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00012 2026-06-23 cs.LG cs.AI cs.CY cs.IR 版本更新

OGD4All: A Framework for Accessible Interaction with Geospatial Open Government Data Based on Large Language Models

OGD4All: 基于大语言模型的可访问地理空间开放政府数据交互框架

Michael Siebenmann, Javier Argota Sánchez-Vaquerizo, Stefan Arisona, Krystian Samp, Luis Gisler, Dirk Helbing

机构 * Professorship of Computational Social Science, ETH Zurich(计算社会科学教授职位,苏黎世联邦理工学院) Esri R&D Center Zurich(埃斯里苏黎世研发中心) Complexity Science Hub(复杂性科学中心)

AI总结 提出OGD4All框架,结合语义检索、智能体推理和沙盒执行,实现基于大语言模型的地理空间开放政府数据交互,在430个数据集上达到98%分析正确率和94%召回率,有效减少幻觉风险。

Comments Author Accepted Manuscript (AAM). Proceedings of 2026 IEEE CAI (Granada, Spain). Update manuscript with final DOI. Code & data available at: https://github.com/ethz-coss/ogd4all

Journal ref 2026 IEEE Conference on Artificial Intelligence (CAI), pp. 882-888

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15206 2026-06-23 cs.LG cs.AI 版本更新

MAVRL: Learning Reward Functions from Multiple Feedback Types with Amortized Variational Inference

MAVRL: 通过摊销变分推断从多种反馈类型中学习奖励函数

Raphaël Baur, Yannick Metz, Maria Gkoulta, Mennatallah El-Assady, Giorgia Ramponi, Thomas Kleine Buening

机构 * ETH AI Center, ETH Zurich, Zurich, Switzerland(苏黎世联邦理工学院人工智能中心) Department of Computer Science, ETH Zurich, Zurich, Switzerland(苏黎世联邦理工学院计算机科学系) Department of Informatics, University of Zurich, Zurich, Switzerland(苏黎世大学信息学系)

AI总结 提出一种基于贝叶斯推断的框架,从异构反馈类型(如演示、比较、评分和停止)中联合学习共享潜在奖励函数,采用摊销变分推断方法,无需手动损失平衡,实验表明联合推断的奖励后验优于单类型基线,并提高了策略对环境扰动的鲁棒性。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03357 2026-06-23 cs.CV cs.GR 版本更新

RelightAnyone: A Generalized Relightable 3D Gaussian Head Model

RelightAnyone: 一种通用的可重光照3D高斯头部模型

Yingyan Xu, Pramod Rao, Sebastian Weiss, Gaspard Zoss, Markus Gross, Christian Theobalt, Marc Habermann, Derek Bradley

机构 * ETH Zürich(苏黎世联邦理工学院) DisneyResearch|Studios(迪士尼研究与工作室) Max Planck Institute for Informatics, SIC(马克斯·普朗克信息学院,SIC)

AI总结 提出一种两阶段通用可重光照3D高斯头部模型,无需OLAT数据即可从单/多视图图像重光照任意对象,通过从平光照3DGS头像到物理反射参数的映射实现高质量重光照。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10022 2026-06-23 cs.RO 版本更新

APEX: Action Priors Enable Efficient Exploration for Robust Motion Tracking on Legged Robots

APEX: 动作先验实现高效探索,实现足式机器人鲁棒运动跟踪

Shivam Sood, Laukik Nakhwa, Sun Ge, Yuhong Cao, Jin Cheng, Fatemah Zargarbashi, Taerim Yoon, Sungjoon Choi, Stelian Coros, Guillaume Sartoretti

机构 * Multi-Agent Robotic Motion Lab(多智能体机器人运动实验室) Department of Mechanical Engineering, College of Design and Engineering, National University of Singapore(机械工程系,设计与工程学院,新加坡国立大学) Computational Robotics Lab(计算机器人实验室) Department of Computer Science, ETH Zurich(计算机科学系,苏黎世联邦理工学院) Robot Intelligence Lab(机器人智能实验室) Department of Artificial Intelligence, Korea University(人工智能系,韩国大学)

AI总结 提出APEX框架,通过衰减动作先验引导探索,结合多评判器分离风格与任务信号,实现无需部署时参考动作输入的高效运动跟踪。

Comments \c{opyright} 20XX IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03547 2026-06-23 cs.CL 版本更新

Bearing Syntactic Fruit with Stack-Augmented Neural Networks

使用栈增强神经网络结出句法之果

Brian DuSell, Ryan Cotterell

机构 * ETH Zürich(苏黎世联邦理工学院)

AI总结 本文首次证明,仅基于表面形式训练的栈增强神经网络能够像人类一样进行层次句法泛化,其中非确定性栈增强的Transformer表现最佳。

Comments 18 pages, 6 figures. Updated draft with additional experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06088 2026-06-23 cs.RO cs.CG

Non-planar 3D Printing of Double Shells

非平面三维打印双壳结构

Ioanna Mitropoulou, Amir Vaxman, Olga Diamanti, Benjamin Dillenburger

机构 * Digital Building Technologies, ETH Zurich(数字建筑技术,苏黎世联邦理工学院) Institute of Perception, Action and Behaviour, The University of Edinburgh(感知、行为与动作研究所,爱丁堡大学) Institute for Geometry of the Department of Mathematics, TU Graz(数学系几何研究所,格拉茨技术大学)

AI总结 本文提出利用多轴融合沉积建模(FDM)机器人3D打印技术,沿横向方向打印双壳结构。通过转换横向条带网络表示,实现双壳结构的分体打印与组装,展示了方法在不同尺度和几何复杂度表面的适应性与鲁棒性。

Journal ref In: Robotic Fabrication in Architecture, Art and Design (RobArch 2024), Springer, 2025, pp. 174-191

详情

展开后加载摘要…

URL PDF HTML 收藏