arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

ETH Zurich(苏黎世联邦理工学院)

共收录 1407
2605.10169 2026-05-12 cs.AI cs.GT

Automated Approach for Solving Infinite-state Polynomial Reachability Games

求解无限状态多项式可达性游戏的自动化方法

Krishnendu Chatterjee, Ehsan Kafshdar Goharshady, Mehrdad Karrabi, Maximilian Seeliger, Đorđe Žikelić

机构 * Institute of Science and Technology Austria (ISTA)(奥地利科学与技术研究所) ETH Zurich(苏黎世联邦理工学院) Singapore Management University(新加坡管理大学)

AI总结 本文提出了一种自动化方法,用于求解无限状态的多项式可达性游戏,通过排名证书证明REACH玩家的胜利策略存在性,并在子指数时间内验证算法的正确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25080 2026-05-12 cs.LG

Towards a Certificate of Trust: Task-Aware OOD Detection for Scientific AI

迈向信任证书:面向科学AI的任务感知异常检测

Bogdan Raonić, Siddhartha Mishra, Samuel Lanthaler

机构 * Seminar for Applied Mathematics, ETH Zurich(应用数学研究所,苏黎世联邦理工学院) ETH AI Center(苏黎世人工智能中心)

AI总结 本文提出基于分数扩散模型估计联合似然的任务感知异常检测方法,通过科学数据集验证其与预测误差的强相关性,为构建可验证的信任证书提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23009 2026-05-12 cs.LG cs.AI

Position: Stop Evaluating AI with Human Tests, Develop Principled, AI-specific Tests instead

评估:停止用人类测试评估AI,改而开发基于AI的原理性测试

Tom Sühr, Florian E. Dorner, Olawale Salaudeen, Augustin Kelava, Samira Samadi

机构 * Max Planck Institute for Intelligent Systems, Tübingen(马克斯·普朗克智能系统研究所,图宾根) ETH Zurich, Zurich(苏黎世联邦理工学院,苏黎世) University of Tübingen, Methods Center, Tübingen(图宾根大学,方法中心,图宾根) Massachusetts Institute of Technology, Cambridge(麻省理工学院,剑桥)

AI总结 本文指出,将AI性能评估等同于人类心理特质是理论和实证上的错误,呼吁开发专门针对AI的评估框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19741 2026-05-12 cs.RO cs.AI

ROS-LLM: A ROS framework for embodied AI with task feedback and structured reasoning

ROS-LLM:一个用于具身AI的ROS框架,具有任务反馈和结构化推理

Christopher E. Mower, Yuhui Wan, Hongzhan Yu, Antoine Grosnit, Jonas Gonzalez-Billandon, Matthieu Zimmer, Jinlong Wang, Xinyu Zhang, Yao Zhao, Anbang Zhai, Puze Liu, Daniel Palenicek, Davide Tateo, Cesar Cadena, Marco Hutter, Jan Peters, Guangjian Tian, Yuzheng Zhuang, Kun Shao, Xingyue Quan, Jianye Hao, Jun Wang, Haitham Bou-Ammar

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) University of Leeds(利兹大学) Technical University of Darmstadt(达姆施塔特技术大学) East China Normal University(华东师范大学) Huawei Technologies(华为技术有限公司) ETH Zurich(苏黎世联邦理工学院) University College London(伦敦大学学院)

AI总结 本文提出一种基于ROS的框架,允许非专家通过自然语言提示和上下文信息编程机器人,结合大语言模型实现任务描述和行为模式控制,实验验证了其在多样化场景中的鲁棒性和扩展性。

Comments This document contains 26 pages and 13 figures

Journal ref Nature Machine Intelligence 8, 313-325 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09742 2026-05-12 cs.LG cs.AI

TIDES: Implicit Time-Awareness in Selective State Space Models

TIDES:在选择性状态空间模型中引入隐式时间感知

Taylan Soydan, Miguel A. Bessa, Dirk Mohr, Rui Barreira

机构 * AIMM, ETH Zürich(AIMM,瑞士联邦理工学院 Zurich)

AI总结 TIDES是一种选择性状态空间模型变体,通过将输入依赖性从时间步长转移到对角状态矩阵,实现了选择性和连续架构的结合,从而保留时间步长的物理意义,提升对不规则时间序列的处理能力,并在多个基准测试中取得新成就。

Comments Preprint submitted for peer-review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09465 2026-05-12 cs.RO

High Precision Hydraulic Excavator Control for Heavy-Duty Grading

高精度液压挖掘机控制用于重型平整作业

Lennart Werner, Pol Eyschen, Sean Costello, Andrei Cramariuc, Marco Hutter

机构 * ETH Zürich, Robotic Systems Lab(苏黎世联邦理工学院机器人系统实验室)

AI总结 本文提出一种自主控制器,实现高精度平整作业,适用于负载传感和负流量控制设备,通过校准过程可适应不同液压系统,精度提升2.6倍,提升设备使用效率。

Comments 12 pages 19 figures, RSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12027 2026-05-12 cs.RO

3DRO: Lidar-level SE(3) Direct Radar Odometry Using a 2D Imaging Radar and a Gyroscope

3DRO:基于2D成像雷达和陀螺仪的激光雷达级SE(3)直接雷达里程计

Cedric Le Gentil, Daniil Lisus, Timothy D. Barfoot

机构 * Robotics Institute, University of Toronto(多伦多大学机器人研究所) Mobile Robotics Lab, ETH Zurich(苏黎世联邦理工学院移动机器人实验室)

AI总结 本文提出3DRO,扩展SE(2)直接雷达里程计框架以实现SE(3)状态估计,通过2D速度估计保持数据平面性并结合3D陀螺仪测量,实现激光雷达级精度。

Comments Accepted for presentation at the ICRA 2026 Workshop on Radar in Robotics (poster: https://drive.google.com/file/d/1P_iBrGxPiZL644B-dHxbvdY-UJUzd4Kp/view )

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18374 2026-05-12 cs.RO cs.SY eess.SY math.DS

Explicit Bounds on the Hausdorff Distance for Truncated mRPI Sets via Norm-Dependent Contraction Rates

截断mRPI集的Hausdorff距离显式界 via 依赖范数的收缩速率

Jiaxun Sun, Hengyu Xue, Yuyang Zhao

机构 * Department of Mechanical and Process Engineering, ETH Zürich(苏黎世联邦理工学院机械与过程工程系) School of Transportation Science and Engineering, Beihang University(北京航空航天大学交通运输工程学院)

AI总结 本文提出通过依赖范数的收缩速率计算截断mRPI集与无限时间极限之间的Hausdorff距离上界,提供显式的horizon选择规则以保证预定的近似精度。

Comments 6 pages, 5 figures. Accepted at the 2026 IEEE Conference on Control Technology and Applications (CCTA), Vancouver, BC, Canada, August 12-14, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21671 2026-05-12 cs.LG q-bio.NC

Neuroprobe: Evaluating Intracranial Brain Responses to Naturalistic Stimuli

Neuroprobe:评估自然刺激下的颅内脑响应

Andrii Zahorodnii, Christopher Wang, Geeling Chau, Bennett Stankovits, Charikleia Moraitaki, Eli Gross, Alexander Brady, Andrei Barbu, Boris Katz, Ila R Fiete

机构 * MIT CSAIL, CBMM(MIT CSAIL,CBMM) MIT McGovern Institute(MIT McGovern研究所) Caltech(加州理工学院) Columbia University(哥伦比亚大学) ETH Zurich(苏黎世联邦理工学院)

AI总结 Neuroprobe通过高分辨率颅内EEG数据研究多模态语言处理,提供评估框架比较不同模型架构,揭示语言处理在大脑中的时间与空间动态。

Comments 38 pages, 7 main figures, 16 supplementary figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09167 2026-05-12 cs.CL cs.AI cs.LG

WorldSpeech: A Multilingual Speech Corpus from Around the World

WorldSpeech: 一种来自全球的多语言语音语料库

Antonis Asonitis, Luca A. Lanzendörfer, Frédéric Berdoz, Roger Wattenhofer

机构 * ETH Zurich(苏黎世联邦理工学院)

AI总结 本文提出WorldSpeech,一个包含76种语言6.5万小时对齐语音数据的多语言语料库,通过微调现有ASR模型,使11种语言的词错误率平均降低63.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09144 2026-05-12 cs.LG

FedVSSAM: Mitigating Flatness Incompatibility in Sharpness-Aware Federated Learning

FedVSSAM: 缓解联邦学习中sharpness-aware学习的flatness不兼容性

Bingnan Xiao, Yuan Gao, Bingcong Li, Wei Ni, Xin Wang, Tony Q. S. Quek

机构 * Fudan University(复旦大学) ETH Zurich(苏黎世联邦理工学院) Edith Cowan University(埃迪斯科文大学) Singapore University of Technology and Design(新加坡科技设计大学)

AI总结 FedVSSAM通过引入方差抑制的sharpness-aware最小化方法,缓解联邦学习中由于数据异质性和友好对抗现象导致的flatness不兼容性,提升全局模型的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09039 2026-05-12 cs.CV

SeasonScapes: Learning Large-scale Re-lightable 3D Landscapes with Seasonal Variation from Sparse Webcams

SeasonScapes: 从稀疏网络摄像头学习大规模可重照明的3D景观及其季节变化

Timo Kleger, Qi Ma, Deheng Zhang, Luc Van Gool, Danda Pani Paudel

机构 * ETH Zurich(苏黎世联邦理工学院)

AI总结 本文提出SeasonScapes框架和数据集,通过稀疏网络摄像头图像构建大规模可重照明的3D景观,利用条件扩散模型处理遮挡和缺失数据,实现季节性变化的3D景观重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26574 2026-05-12 cs.AI cond-mat.other cs.CL hep-th quant-ph

Probing the Critical Point (CritPt) of AI Reasoning: a Frontier Physics Research Benchmark

探测人工智能推理的临界点(CritPt):一个前沿物理研究基准

Minhui Zhu, Minyang Tian, Xiaocheng Yang, Tianci Zhou, Lifan Yuan, Penghao Zhu, Eli Chertkov, Shengyan Liu, Yufeng Du, Ziming Ji, Indranil Das, Qingzhi Chen, Junyi Cao, Yufeng Du, Jiabin Yu, Peixue Wu, Jinchen He, Yifan Su, Yikun Jiang, Yujie Zhang, Chang Liu, Ze-Min Huang, Weizhen Jia, Yunkai Wang, Farshid Jafarpour, Yong Zhao, Xinan Chen, Jessie Shelton, Aaron W. Young, John Bartolotta, Wenchao Xu, Yue Sun, Anjun Chu, Victor Colussi, Chris Akers, Nathan Brooks, Wenbo Fu, Jinchao Zhao, Marvin Qi, Anqi Mu, Yubo Yang, Allen Zang, Yang Lyu, Peizhi Mai, Christopher Wilson, Xuefei Guo, Juntai Zhou, Daniel Inafuku, Chi Xue, Luyu Gao, Ze Yang, Yaïr Hein, Yonatan Kahn, Kevin Zhou, Di Luo, John Drew Wilson, Jarrod T. Reilly, Dmytro Bandak, Ofir Press, Liang Yang, Xueying Wang, Hao Tong, Nicolas Chia, Eliu Huerta, Hao Peng

机构 * Argonne National Laboratory(阿贡国家实验室) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Virginia Tech(弗吉尼亚理工大学) Ohio State University(俄亥俄州立大学) Independent(独立) Northeastern University(东北大学) Caltech(加州理工学院) University of Florida(佛罗里达大学) University of Waterloo(滑铁卢大学) University of Maryland, College Park(马里兰大学学院公园分校) Columbia University(哥伦比亚大学) Perimeter Institute for Theoretical Physics(理论物理研究所) University of Connecticut(康涅狄格大学) University of Cologne(科隆大学) The Chinese University of Hong Kong(香港中文大学) Utrecht University(乌得勒支大学) Harvard University(哈佛大学) ETH Zürich(苏黎世联邦理工学院) Paul Scherrer Institute(保罗·谢尔研究所)

AI总结 本文提出CritPt基准,用于测试LLM在未发表的科研级推理任务中的能力,涵盖现代物理多个领域,发现当前LLM在复杂科研挑战中表现有限,仅能实现5.7%的准确率。

Comments 40 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08317 2026-05-12 cs.LG cs.AI

RDKV: Rate-Distortion Bit Allocation for Joint Eviction and Quantization of the KV Cache

RDKV: 用于联合擦除和量化KV缓存的率-失真位分配

Junkai Zhang, Hang Guo, Luca Benini, Yawei Li

机构 * ETH Zurich(苏黎世联邦理工学院) Tsinghua University(清华大学)

AI总结 RDKV通过联合优化擦除与量化,提升长序列推理效率,实现9.1%的性能提升和97.81%的准确率恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08168 2026-05-12 cs.RO cs.AI cs.LG

Understanding Asynchronous Inference Methods for Vision-Language-Action Models

理解面向视觉-语言-动作模型的异步推理方法

Ayoub Agouzoul

机构 * École polytechnique Systems Group, ETH Zürich(瑞士联邦理工学院系统组,苏黎世联邦理工学院)

AI总结 本文系统比较了四种异步推理方法,评估了其在不同延迟下的性能,发现A2C2在Kinetix上表现最佳,TT-RTC在LIBERO上最稳健,IT-RTC在低延迟下表现良好但高延迟下下降,VLASH在低延迟与高延迟之间存在权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07885 2026-05-11 cs.RO

AERO-VIS: Asynchronous Event-based Real-time Onboard Visual-Inertial SLAM

AERO-VIS:异步事件基于的实时机载视觉-惯性SLAM

Yannick Burkhardt, Sebastián Barbas Laina, Simon Boche, Leonard Freißmuth, Stefan Leutenegger

机构 * Mobile Robotics Lab, ETH Zürich(苏黎世联邦理工学院移动机器人实验室) Technical University of Munich(慕尼黑技术大学) Munich Institute of Robotics and Machine Intelligence (MIRMI)(慕尼黑机器人与机器智能研究所)

AI总结 AERO-VIS是一种集成、数据驱动、稳健且性能优化的双目事件-惯性SLAM系统,通过异步处理事件流,实现低延迟和实时性能,首次实现了纯事件基于的惯性SLAM系统,支持闭环无人机控制和大规模状态估计。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07817 2026-05-11 cs.CV cs.AI cs.CL

GazeVLM: Active Vision via Internal Attention Control for Multimodal Reasoning

GazeVLM:通过内部注意力控制实现多模态推理的主动视觉

Brown Ebouky, Gabriele Carrino, Niccolo Avogaro, Christoph Studer, Andrea Bartezzaghi, Mattia Rigotti

机构 * IBM Research(IBM研究院) ETH Zurich(苏黎世联邦理工学院) TU Wien(维也纳技术大学)

AI总结 GazeVLM通过内部注意力控制实现主动视觉,使模型在多模态推理中实现从全局空间感知到局部聚焦推理的无缝切换,无需外部工具或增加视觉token。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07796 2026-05-11 cs.CL

PolySQL: Scaling Text-to-SQL Evaluation Across SQL Dialects via Automated Backend Isomorphism

PolySQL:通过自动化后端同构性跨SQL方言扩展文本到SQL评估

Yotam Perlitz, Elad Venezian, Corentin Royer, Francesco Fusco, Andrea Giovannini

机构 * IBM Research(IBM研究院) ETH Zürich(苏黎世联邦理工学院)

AI总结 PolySQL通过自动化后端同构性方法,实现跨SQL方言的文本到SQL评估扩展,揭示了从SQLite到其他方言的平均准确率下降10.1%及方言难度层级。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07775 2026-05-11 cs.LG cs.AI stat.ML

POETS: Uncertainty-Aware LLM Optimization via Compute-Efficient Policy Ensembles

POETS: 通过计算高效的策略集合实现不确定性感知的LLM优化

Nicolas Menet, Andreas Krause, Abbas Rahimi

机构 * IBM Research – Zurich(IBM瑞士苏黎世实验室) Department of Computer Science, ETH Zürich(苏黎世联邦理工学院计算机科学系)

AI总结 POETS通过计算高效的策略集合,结合KL正则化和策略优化,实现了在序列决策和黑箱优化中的不确定性量化,提升了样本效率和优化轨迹。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07675 2026-05-11 cs.AI cs.LG

FactoryBench: Evaluating Industrial Machine Understanding

FactoryBench:评估工业机器理解的基准测试

Yanis Merzouki, Coral Izquierdo, Matei Ignuta-Ciuncanu, Marcos Gomez-Bracamonte, Riccardo Maggioni, Alessandro Lombardi, Camilla Mazzoleni, Federico Martelli, Balazs Gunther, Jonas Petersen, Philipp Petersen

机构 * ETH Zurich(苏黎世联邦理工学院) Forgis UC3M Imperial College London(帝国理工学院伦敦分校) University of Berkeley(伯克利大学) KTH Royal Institute of Technology(皇家理工学院) University of Vienna(维也纳大学)

AI总结 本文提出FactoryBench基准测试,用于评估时间序列模型和LLM在工业机器人 telemetry 中的机器理解能力,通过四个因果层次和五种答案格式评估,包含70k问题-答案对,揭示当前模型与实际操作理解之间的差距。

Comments 9 pages, 4 figures, 14 tables; appendix with 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07562 2026-05-11 cs.CV

Beyond GSD-as-Token: Continuous Scale Conditioning for Remote Sensing VLMs

超越GSD-as-Token:远程 sensing VLMs 的连续尺度调节

Song Zhang, Yanlong Chen, Yilin Li, Yining Chen, Zili Yi, Xiaowei Zhang, Yawei Li

机构 * Nanjing University(南京大学) ETH Zurich(苏黎世联邦理工学院) RWTH Aachen University(亚琛工业大学)

AI总结 本文提出ScaleEarth框架,通过连续尺度条件变量动态调节模型计算路径,结合SSE-U和GeoScale-VQA实现遥感VLMs在不同GSD下的高效适应。

Comments Under review. 30 pages, 16 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11758 2026-05-11 cs.RO

HAIC: Humanoid Agile Object Interaction Control via Dynamics-Aware World Model

HAIC:通过动态感知世界模型实现人形敏捷物体交互控制

Dongting Li, Xingyu Chen, Qianyang Wu, Bo Chen, Sikai Wu, Hanyu Wu, Guoyao Zhang, Liang Li, Mingliang Zhou, Diyun Xiang, Jianzhu Ma, Qiang Zhang, Renjing Xu

机构 * Tsinghua University(清华大学) HKUST(Guangzhou)(香港科技大学(广州)) ETH Zurich(苏黎世联邦理工学院) Xiaomi Robotics Lab(小米机器人实验室)

AI总结 本文提出HAIC框架,通过动态预测和空间优先级构建动态占用地图,实现人形机器人在复杂动态环境下与不同物体的稳健交互,提升敏捷任务和多物体长周期任务的完成能力。

Comments RSS 2026. Webpage: https://haic-humanoid.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07051 2026-05-11 cs.CL

NSMQ Riddles: A Benchmark of Scientific and Mathematical Riddles for Quizzing Large Language Models

NSMQ谜题:一个科学和数学谜题的基准,用于评估大型语言模型

George Boateng, Naafi Ibrahim, Samuel John, Philemon Badu, Patrick Agyeman-Budu, Jonathan Mensah, Kevin Yeboah, William Edor, Andrew Mensa-Onumah, Nana Yeboah, Victor Wumbor-Apin Kumbol

机构 * ETH Zurich(苏黎世联邦理工学院) Charité - Universitätsmedizin Berlin(柏林夏里特医学院) Kwame AI Inc.(夸梅人工智能公司) Ashesi University(阿什西大学)

AI总结 本文提出NSMQ谜题基准,基于加纳国家科学与数学竞赛的谜题,评估大型语言模型的科学和数学推理能力,发现即使是最先进的模型也难以应对。

Comments 15 pages. Accepted at the 27th International Conference on Artificial Intelligence in Education

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06643 2026-05-08 cs.CV cs.AI cs.LG cs.MM

Are We Making Progress in Multimodal Domain Generalization? A Comprehensive Benchmark Study

我们是否在多模态领域泛化中取得进展?一个全面的基准研究

Hao Dong, Hongzhao Li, Shupan Li, Muhammad Haris Khan, Eleni Chatzi, Olga Fink

机构 * ETH Zürich(苏黎世联邦理工学院) Zhengzhou University(郑州大学) MBZUAI(马克斯·普朗克人工智能研究所) EPFL(苏黎世联邦理工学院)

AI总结 本文通过MMDG-Bench基准测试,评估了多模态领域泛化方法的有效性,发现现有方法在公平比较下进步有限,且存在领域和模态配置差异,揭示了领域泛化仍需进一步改进。

Comments Code: https://github.com/lihongzhao99/MMDG_Benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06438 2026-05-08 stat.ML cs.LG q-fin.RM

Neural-Actuarial Longevity Forecasting: Anchoring LSTMs for Explainable Risk Management

神经-精算长寿预测:通过LSTM锚定实现可解释的风险管理

Davide Rindori

机构 * ETH Zürich(苏黎世联邦理工学院) University of Florence(佛罗伦萨大学)

AI总结 本文提出Hybrid-Lift框架,结合层级LSTM与Mean-Bias Correction机制,解决传统线性模型在长寿风险评估中的非线性问题,实验证明其在瑞典和西德的预测优势,同时提供治理工具提升监管资本校准和压力测试。

Comments 26 pages, 12 figures. Code available at https://github.com/davide-rindori/Actuarial-DS-Portfolio/tree/main/04_Multi_Population_Longevity_XAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06281 2026-05-08 cs.LG cs.NA math.NA q-fin.CP

INEUS: Iterative Neural Solver for High-Dimensional PIDEs

INEUS:用于高维偏积分微分方程的迭代神经求解器

Jean-Loup Dupret, Davide Gallon, Patrick Cheridito

机构 * Department of Mathematics and RiskLab, ETH Zurich(数学系和风险实验室,苏黎世联邦理工学院) Applied Mathematics: Institute for Analysis and Numerics, University of Münster(应用数学:分析与数值计算研究所,蒙斯特大学)

AI总结 INEUS通过单跳采样替代非局部跳跃积分的显式计算,将PIDE求解转化为递归回归问题,高效处理非局部项并避免复杂残差微分,适用于高维PDE和PIDE的准确可扩展求解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06134 2026-05-08 hep-lat cs.LG

Diffusion model for SU(N) gauge theories

SU(N)规范理论的扩散模型

Javad Komijani, Marina K. Marinkovic, Lara Turgut

机构 * Institute for Theoretical Physics, ETH Zurich, 8093 Zurich, Switzerland(苏黎世联邦理工学院理论物理研究所)

AI总结 本文提出适用于SU(N)晶格规范理论的分数匹配框架,用于训练扩散模型并生成高质量样本,通过与HMC模拟对比验证了其有效性,并探讨了提升采样效率的策略。

Comments 23 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06087 2026-05-08 cs.AI cs.SY eess.SY

Safety Certification is Classification

安全性认证是分类

Oliver Schön, Licio Romao, Sadegh Soudjani

机构 * ETH Zürich(苏黎世联邦理工学院) Technical University of Denmark(丹麦技术大学) Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所)

AI总结 本文提出将安全性认证作为轨迹数据分类问题,直接估计T步安全性概率,避免递归误差,适用于非马尔可夫动态系统。

Comments 32 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06054 2026-05-08 cs.AI cs.HC

Visual Fingerprints for LLM Generation Comparison

用于LLM生成比较的视觉指纹

Amal Alnouri, Andreas Hinterreiter, Christina Humer, Furui Cheng, Marc Streit

机构 * Johannes Kepler University Linz(约翰·凯撒大学林茨分校) ETH Zürich(苏黎世联邦理工学院) Independent Researcher(独立研究者)

AI总结 本文提出通过可视化方法比较不同生成条件下的LLM输出,揭示模型行为的一致性模式,提升提示设计和模型评估效率。

Comments Submitted to the Short Paper track at IEEE VIS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00649 2026-05-08 cs.LG

Model Compression with Exact Budget Constraints via Riemannian Manifolds

通过黎曼流形实现精确预算约束下的模型压缩

Michael Helcig, Dan Alistarh

机构 * ETH Zürich(苏黎世联邦理工学院) IST Austria(奥地利科学院)

AI总结 本文提出基于黎曼流形的约束优化方法RCO,用于在精确预算约束下优化模型压缩任务,通过引入切线投影、二分法回退和动量运输等技术,实现高效优化。

详情

展开后加载摘要…

URL PDF HTML 收藏