arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

ETH Zurich(苏黎世联邦理工学院)

2026-07-14 至 2026-07-14 共收录 10
2607.11560 2026-07-14 cs.CV cs.AI 新提交

Technical Report on the CVPR 2026@AdvML Workshop Challenge

关于CVPR 2026@AdvML研讨会挑战赛的技术报告

Tianyuan Zhang, Zonglei Jing, Jiangfan Liu, Ligong Zhang, Ke Ma, Chengzhi Sun, Xiaohai Xu, Zhirui Zhang, Qianqian Xu, Qingming Huang, Hanyu Fang, Junhua Liu, Zheng Wang, Xiaoliang Liu, Yuanbo Li, Shuai Gui, Bin Wang, Menghe Zheng, Jing Nie, Hanyang Meng, Zeyang Zhang, Xiang Zhang, Yongxuan Zhu, Rui Ding, Hainan Li, Yongkang Zhang, Zhilei Zhu, Xianglong Kong, Jin Hu, Zonghao Ying, Yisong Xiao, Lei Chen, Haotong Qin, Jiakai Wang, Aishan Liu, Ruikai Li, Julia Karbing, Yinpeng Dong, Zhenfei Yin, Shao Jing, Xia Hu, Jingyi Xu, Juntao Dai, Xinyun Chen, Vishal M. Patel, Xianglong Liu, Dawn Song, Alan Yuille, Philip H. S. Torr, Dacheng Tao

机构 * Beihang University(北京航空航天大学) University of Chinese Academy of Sciences(中国科学院大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Tongji University(同济大学) iFLYTEK Co., Ltd.(科大讯飞股份有限公司) Anhui Laboratory for Safe Artificial Intelligence in the Yangtze River Delta(长三角安全人工智能安徽实验室) Wenzhou Business College(温州商学院) Jiangnan University(江南大学) Guangzhou City University of Technology(广州理工学院) Inceptio Technology(智元机器) Institute of Dataspace(数据空间研究所) Zhongguancun Laboratory(中关村实验室) Tsinghua University(清华大学) ETH Zürich(苏黎世联邦理工学院) University of Oxford(牛津大学) Shanghai AI Laboratory(上海人工智能实验室) BAAI(北京智源人工智能研究院) Meta Johns Hopkins University(约翰·霍普金斯大学) University of California, Berkeley(加州大学伯克利分校) Nanyang Technological University(南洋理工大学)

AI总结 介绍CVPR 2026@AdvML研讨会针对自动驾驶VLAs的对抗性多模态攻击挑战赛,基于多视图视觉问答,参赛者要生成对抗图像和文本扰动。阐述任务设计等,研究领先提交作品发现后缀惩罚等模式,为多模态自动驾驶系统相关工作提供参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11041 2026-07-14 cs.RO 新提交

PAKE: Learning Whole-Body Loco-Manipulation with Partial Kinematic Embeddings

PAKE:利用部分运动学嵌入学习全身移动操作

Zhengmao He, Moonkyu Jung, Hyeongjun Kim, Jiseong Lee, Hui Zhang, Jemin Hwangbo, Jie Song

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Korea Advanced Institute of Science and Technology(韩国科学技术院) ETH Zurich(苏黎世联邦理工学院)

AI总结 研究针对高自由度机器人全身移动操作面临的挑战,提出将其分解为部分参考运动生成和低级模仿控制的框架,用KNF模型生成参考运动,经高低级控制器实现精确控制,在模拟和硬件实验中均表现优异,为相关操作提供实用方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10853 2026-07-14 cs.CV cs.LG 新提交

Diversify Diffusion with Temperature Sampling and Variance-Corrective Time Shifting

通过温度采样和方差校正时间偏移实现扩散多样化

Peizhuo Li, Emre Aksan, Alexandru-Eugen Ichim, Thabo Beeler, Olga Sorkine-Hornung

机构 * ETH Zurich(苏黎世联邦理工学院) Google(谷歌)

AI总结 研究针对扩散模型难以达到罕见模式的问题,提出方差校正时间偏移方法,并结合温度采样,无需重新训练就能提升样本多样性,在多个模型中以低成本实现质量和保真度提升,还能实现从粗到细的控制。

Comments Webpage: https://peizhuoli.github.io/diversify-diffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03496 2026-07-14 cs.SD eess.AS 版本更新

Trajectory Variance: An Unsupervised Measure of Developmental Vocal Plasticity in Birdsong

轨迹方差:鸟类鸣叫发育中无监督的发声可塑性度量

Kanghwi Lee

机构 * Institute of Neuroinformatics, University of Zurich and ETH Zurich(苏黎世大学和瑞士联邦理工学院神经信息学研究所)

AI总结 研究鸟类鸣叫发育中发声变化,提出轨迹方差这一可塑性得分,用位移模型预测自动编码器潜在空间中年龄条件变化,其预测方差量化发声变化,能区分习得音节与先天鸣叫且与频谱平坦度相关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31779 2026-07-14 cs.LG cs.CL 版本更新

Bridging the Gap Between Latent and Explicit Reasoning with Looped Transformers

弥合潜在推理与显式推理之间的差距:循环Transformer

Ying Fan, Anej Svete, Kangwook Lee

机构 * UW-Madison(威斯康星大学麦迪逊分校) Microsoft Research(微软研究院) ETH Zürich(苏黎世联邦理工学院) KRAFTON(魁匠团) Ludo Robotics

AI总结 提出LOTUS方法,利用循环Transformer在潜在空间进行多步推理,通过并行监督潜在块上的CoT令牌,首次在3B规模弥合与显式CoT的差距,并将推理延迟降低2.5-6.9倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15753 2026-07-14 cs.RO cs.CV 版本更新

Hierarchical and Holistic Open-Vocabulary Functional 3D Scene Graphs for Indoor Spaces

层次化和整体化的开放词汇功能3D场景图用于室内空间

Xinggang Hu, Chenyangguang Zhang, Alexandros Delitzas, Xiangkui Zhang, Marc Pollefeys, Francis Engelmann, Xiangyang Ji

机构 * Tsinghua University(清华大学) ETH Zürich(苏黎世联邦理工学院) MPI for Informatics(信息研究所) Dalian University of Technology(大连理工大学) Microsoft(微软) Stanford University(斯坦福大学) University of Lugano(卢加诺大学)

AI总结 本文提出一种开放词汇管道,结合2D视觉定位和3D图优化,解决小规模密集相似实例的场景图推理问题,通过时间图优化和全局层次塑造提升室内空间的功能3D场景图生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17335 2026-07-14 cs.RO 版本更新

Learning Whole-Body Humanoid Locomotion via Motion Generation and Motion Tracking

通过动作生成与动作追踪学习全身体态的人形运动

Zewei Zhang, Kehan Wen, Michael Xu, Junzhe He, Chenhao Li, Takahiro Miki, Clemens Schwarke, Chong Zhang, Xue Bin Peng, Marco Hutter

机构 * Robotic Systems Lab, ETH Zuirch(苏黎世联邦理工学院机器人系统实验室) Simon Fraser University(西蒙弗雷泽大学) ETH AI Center, ETH Zurich(苏黎世联邦理工学院人工智能中心) EPFL(苏黎世联邦理工学院)

AI总结 本文提出结合参考动作学习与地形感知适应的全身体态人形运动框架,通过扩散模型预测地形感知参考动作,并利用强化学习训练全身体态追踪器,提升在不同地形上的适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22320 2026-07-14 cs.LG stat.AP stat.ML 版本更新

How Can Machine Learning Emulators Best Support Climate Science?

弥合气候科学与机器学习之间的差距:在气候模型模拟中的应用

Luca Schmidt, Nina Effenberger, Vitus Benson, Philine L. Bommer, Robert Brunstein, Mikel N. Legasa, Maxim Samarin, Maybritt Schillinger

机构 * Cluster of Excellence Machine Learning University of Tübingen(图宾根大学机器学习卓越中心) Institute for Atmospheric and Climate Science ETH Zurich(大气与气候科学研究所,苏黎世联邦理工学院)

AI总结 本文提出整合气候科学与机器学习的方法,解决模拟器在气候决策中的应用障碍,通过设计易用且可靠的模拟器促进两领域融合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09497 2026-07-14 cs.RO cs.AI 版本更新

Toward Autonomous Soft Robotic Endovascular Navigation via Imitation Learning

通过模仿学习实现自主软机器人血管内导航

Noah Barnes, Ji Woong Kim, Lingyun Di, Hannah Qu, Anuruddha Bhattacharjee, Miroslaw Janowski, Dheeraj Gandhi, Bailey Felix, Shaopeng Jiang, Olivia Young, Mark Fuge, Ryan D. Sochol, Jeremy D. Brown, Axel Krieger

机构 * Johns Hopkins University(约翰霍普金斯大学) Stanford University(斯坦福大学) McGill University(麦吉尔大学) University of Maryland(马里兰大学) Swiss Federal Institute of Technology in Lausanne (EPFL)(日内瓦联邦理工学院(EPFL)) ETH Zurich(苏黎世联邦理工学院)

AI总结 研究旨在实现自主软机器人血管内导航,开发基于变压器的模仿学习框架,通过目标条件等实现通用导航,在多种几何结构上训练并评估,策略成功率高,还进行了相关研究及扩展,提升了在未见几何结构上的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01830 2026-07-14 cs.RO 版本更新

What Matters in RL-Based Methods for Object-Goal Navigation? An Empirical Study and A Unified Framework

基于强化学习的目标导航方法中什么重要?实证研究与统一框架

Hongze Wang, Boyang Sun, Jiaxu Xing, Fan Yang, Marco Hutter, Dhruv Shah, Davide Scaramuzza, Marc Pollefeys

机构 * Computer Vision and Geometry Group, ETH Zurich, Switzerland(苏黎世联邦理工学院计算机视觉与几何组) Robotics and Perception Group, University of Zurich, Switzerland(苏黎世大学机器人与感知组) Robotic Systems Lab, ETH Zurich, Switzerland(苏黎世联邦理工学院机器人系统实验室) Princeton Robotic Intelligence and SysteMs group, Princeton University, USA(普林斯顿大学机器人智能与系统组) Microsoft, Switzerland(微软公司)

AI总结 研究目标导航中基于强化学习方法各组件影响,通过分解导航管道为感知、策略和测试时增强三组件进行实证研究,引入统一框架,构建增强系统达领先性能,提供见解与建议,凸显当前智能体与人类导航差距。

详情

展开后加载摘要…

URL PDF HTML 收藏