arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

ETH Zurich(苏黎世联邦理工学院)

2026-06-16 至 2026-06-16 共收录 8
2606.16771 2026-06-16 cs.LG 新提交

GD$^2$PO: Mitigating Multi-Reward Conflicts via Group-Dynamic reward-Decoupled Policy Optimization

GD$^2$PO: 通过组动态奖励解耦策略优化缓解多奖励冲突

Haotian Liu, Yihao Liu, Jingwei Ni, Siyuan Huang, Xinpeng Liu, Pengyu Cheng, Jiajun Song, Ruijin Ding, Junfeng Li, Zhechao Yu, Mengyu Zhou, Hongteng Xu, Xiaoxi Jiang, Guanjun Jiang

机构 * Qwen Large Model Application Team, Alibaba(阿里巴巴通义千问大模型应用团队) Renmin University of China(中国人民大学) Peking University(北京大学) ETH Zürich(苏黎世联邦理工学院) University of Zurich(苏黎世大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 提出GD$^2$PO算法,通过冲突感知过滤机制屏蔽奖励不一致的rollout,并结合查询级重加权,解决多奖励优化中的信号抵消问题,提升RL训练效率。

Comments 24 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16569 2026-06-16 cs.CV cs.RO 新提交

PROSE: Training-Free Egocentric Scene Registration with Vision-Language Models

PROSE: 基于视觉语言模型的无训练自我中心场景配准

Zhiang Chen, Nahyuk Lee, Boyang Sun, Taein Kwon, Marc Pollefeys, Zuria Bauer, Sunghwan Hong

机构 * ETH Zurich(苏黎世联邦理工学院) VGG, University of Oxford(牛津大学VGG实验室) ETH AI Center(苏黎世联邦理工学院人工智能中心)

AI总结 提出PROSE方法,利用预训练视觉语言模型将RGB序列提升为对象级3D场景图,通过对象高度先验和相同/不同查询匹配实例,无需训练或深度传感器即可实现自我中心场景配准,在Aria基准上超越几何和场景图基线。

Comments Project page: https://rckola.github.io/prose/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16031 2026-06-16 cs.CV 新提交

The Third Challenge on Image Denoising at NTIRE 2026: Methods and Results

NTIRE 2026图像去噪挑战赛第三轮:方法与结果

Lei Sun, Hang Guo, Bin Ren, Shaolin Su, Xian Wang, Danda Pani Paudel, Luc Van Gool, Radu Timofte, Yawei Li

机构 * ETH Zurich(苏黎世联邦理工学院) University of Würzburg(维尔茨堡大学) Beijing University of Posts and Telecommunications(北京邮电大学) Tianjin University(天津大学) Nanjing University of Science and Technology(南京理工大学) University of Beira Interior(贝拉内大学) Siddaganga Institute of Technology(西达甘加理工学院) National Institute of Technology Karnataka(卡纳塔克邦国立理工学院) Sardar Vallabhbhai National Institute of Technology(萨达尔·瓦拉巴伊·帕特尔国立理工学院) University of Luxembourg(卢森堡大学) University of Twente(特温特大学) University of Kragujevac(克拉古耶瓦茨大学) Prince Sultan University(苏丹王子大学) University of Tunis El Manar(突尼斯埃尔马纳尔大学) University of Electronic Science and Technology of China(电子科技大学) Wuhan University(武汉大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Peng Cheng Laboratory(鹏城实验室)

AI总结 报告NTIRE 2026高噪声图像去噪挑战赛,参赛团队采用先进神经网络架构,以PSNR为指标,在无约束条件下实现最先进性能。

Comments accepted by cvprw2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15575 2026-06-16 cs.AI cs.HC 新提交

Do we have the knowledge we need? Rethinking human-AI decision-making in corporations

我们是否拥有所需的知识?重新思考企业中的人机决策

Anne S. R. Marx, Ricardo M. Avelino, Torbjørn Netland, Mennatallah El-Assady

机构 * ETH Zurich(苏黎世联邦理工学院) Department of Computer Science & ETH AI Center, ETH Zurich(苏黎世联邦理工学院计算机科学系与ETH AI中心) Department of Computer Science & Architecture, ETH Zurich(苏黎世联邦理工学院计算机科学与建筑系) Department of Management, Technology, and Economics, ETH Zurich(苏黎世联邦理工学院管理、技术与经济系) Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系)

AI总结 本文提出一个框架,根据任务属性和知识可用性推荐人机代理分配与控制机制,并应用于制造任务示例。

Comments Proceedings of AutomationXP26 Workshop of the 2026 CHI Conference on Human Factors in Computing Systems, April 14, 2026, Barcelona, Spain. ACM, New York, NY, USA, 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15417 2026-06-16 cs.CV 新提交

From Frames to Temporal Graphs: In-Context Egocentric Action Recognition with Vision-Language Models

从帧到时间图:基于视觉语言模型的上下文第一人称动作识别

Bessie Dominguez-Dager, Francisco Gomez-Donoso, Miguel Cazorla, Marc Pollefeys, Daniel Barath, Zuria Bauer

机构 * University of Alicante(阿利坎特大学) ETH Zürich(苏黎世联邦理工学院) Microsoft(微软)

AI总结 提出将视频转换为时间动作图,通过多阶段提示生成自然语言叙述并结构化,实现上下文学习,在EGTEA和Epic-Kitchens-100上显著提升零样本和少样本动作识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15366 2026-06-16 eess.SY cs.RO cs.SY math.OC 新提交

Robust Conformal CBF and CLF Controllers via Iterative Policy Updates

通过迭代策略更新的鲁棒共形CBF和CLF控制器

Omid Mirzaeedodangeh, Eliot Shekhtman, Nikolai Matni, Lars Lindemann

机构 * Automatic Control Laboratory, ETH Zürich(瑞士苏黎世联邦理工学院自动控制实验室) Computer and Information Science, University of Pennsylvania(宾夕法尼亚大学计算机与信息科学系) Electrical and Systems Engineering, University of Pennsylvania(宾夕法尼亚大学电气与系统工程系)

AI总结 针对共形预测嵌入鲁棒控制时因分布偏移导致安全/稳定性保证失效的问题,提出迭代更新策略框架,结合对抗鲁棒共形预测与分布偏移预算,实现跨回合保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14757 2026-06-16 cs.CV cs.LG 新提交

Spatial Priors via Space Filling Curves for Small and Limited Data Vision Transformers

基于空间填充曲线的小型与有限数据视觉Transformer的空间先验

Leyla Naz Candogan, Arshia Afzal, Pol Puigdemont, Volkan Cevher

机构 * ETH Zürich(苏黎世联邦理工学院)

AI总结 提出VIOLIN,一种轻量级掩码注意力机制,通过空间填充曲线编码空间结构,以极小的参数和计算开销为视觉Transformer注入空间归纳偏置,在小模型和有限数据场景下显著提升性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01175 2026-06-16 cs.LG eess.SP math.OC stat.ML 版本更新

On the Benefits of Weight Normalization for Overparameterized Matrix Sensing

关于过参数化矩阵感知中权重归一化的优势

Yudong Wei, Liang Zhang, Bingcong Li, Niao He

机构 * ETH Zurich(苏黎世联邦理工学院)

AI总结 本文证明在过参数化矩阵感知中,权重归一化结合黎曼优化可实现线性收敛,相比未使用归一化的方法获得指数级加速,且过参数化程度越高,迭代和样本复杂度多项式级降低。

详情

展开后加载摘要…

URL PDF HTML 收藏