arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

共收录 11753
2605.09708 2026-06-30 cs.LG cs.AI cs.DC

Metal-Sci: A Scientific Compute Benchmark for Evolutionary LLM Kernel Search on Apple Silicon

Metal-Sci: 一个用于苹果硅芯片上进化式LLM内核搜索的科学计算基准

Víctor Gallego

机构 * Komorebi AI Technologies(Komorebi人工智能技术)

AI总结 Metal-Sci基准通过10个科学任务和六个优化领域,评估LLM在自动内核搜索中的性能,展示了不同模型在不同任务上的加速效果及结构化评估方法的可靠性。

Comments Published at the Fifth Workshop on Deep Learning for Code (DL4C) at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04385 2026-06-30 cs.CL cs.AI cs.LG

How Alignment Routes: Localizing, Scaling, and Controlling Policy Circuits in Language Models

对齐路由:在语言模型中本地化、扩展和控制策略电路

Gregory N. Frank

机构 * Independent Researcher(独立研究者)

AI总结 研究通过本地化策略路由机制,探讨在语言模型中扩展和控制策略电路的方法,发现路由机制在安全性和性能上的关键作用。

Comments Code and data: https://github.com/gregfrank/how-alignment-routes. Accepted at the Mechanistic Interpretability Workshop at the 43rd International Conference on Machine Learning (ICML), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27273 2026-06-30 cs.SD 版本更新

Few-Shot Synthetic Accented Speech for ASR Fine-Tuning: What Helps and When?

少样本合成方言语音用于ASR微调:什么有助于什么?

Yurii Halychanskyi, Nimet Beyza Bozdag, Mark Hasegawa-Johnson, Dilek Hakkani-Tür, Volodymyr Kindratenko

机构 * University of Washington(华盛顿大学)

AI总结 研究比较了合成方言语音在ASR微调中的有效性,发现随机音素扰动比目标方言音素编辑更有效,且真实语音与合成语音混合可稳定低资源微调。

Comments Accepted as a contributed talk and poster at the ICML 2026 Workshop on Machine Learning for Audio

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12277 2026-06-30 cs.CL cs.AI cs.CR

Prompt Injection as Role Confusion

提示注入作为角色混淆

Charles Ye, Jasmine Cui, Dylan Hadfield-Menell

机构 * Massachusetts Institute of Technology(麻省理工学院)

AI总结 本文通过角色探测和CoT伪造攻击,揭示提示注入源于LLM对文本来源的角色感知混淆,并提出角色混淆程度可预测攻击成功率。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23559 2026-06-30 cs.CR cs.AI cs.CV

CAPTCHA Solving for Native GUI Agents: Automated Reasoning-Action Data Generation and Self-Corrective Training

针对原生GUI代理的CAPTCHA解决:自动化推理-行动数据生成与自我纠正训练

Yuxi Chen, Haoyu Zhai, Chenkai Wang, Rui Yang, Lingming Zhang, Gang Wang, Huan Zhang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本文提出ReCAP,一种能解决现代交互式CAPTCHA挑战的原生GUI代理,通过自动化数据生成和自我纠正训练提升CAPTCHA解决能力,同时保持通用GUI任务性能。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17863 2026-06-30 cs.LG cs.AI

DiscoGen: Procedural Generation of Algorithm Discovery Tasks in Machine Learning

DiscoGen:机器学习算法发现任务的程序生成

Alexander D. Goldie, Zilin Wang, Adrian Hayler, Deepak Nathani, Edan Toledo, Ken Thampiratwong, Aleksandra Kalisz, Michael Beukman, Hannah Erlebach, Alistair Letcher, Shashank Reddy, Clarisse Wibault, Theo Wolf, Charles O'Neill, Uljad Berdica, Nicholas Roberts, Saeed Rahmani, Roberta Raileanu, Shimon Whiteson, Jakob N. Foerster

机构 * University of Oxford(牛津大学) University of California, Santa Barbara(加州大学圣塔芭芭拉分校) University College London(伦敦大学学院) University of Wisconsin--Madison(威斯康星大学麦迪逊分校) Delft University of Technology(代尔夫特理工大学)

AI总结 DiscoGen通过程序生成技术创建大量机器学习算法发现任务,用于优化算法发现代理,提供固定子集用于评估,并推动新的研究方向。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05786 2026-06-30 cs.CR cs.AI cs.CL

Proof-of-Guardrail in AI Agents and What (Not) to Trust from It

AI代理中的证明-护栏以及从其中(不)应信任什么

Xisen Jin, Michael Duan, Qin Lin, Aaron Chan, Zhenglun Chen, Junyi Du, Xiang Ren

AI总结 本文提出proof-of-guardrail系统,通过可信执行环境生成加密证明,确保代理在特定开源护栏后生成响应,同时保护开发者隐私,但指出恶意开发者可能欺骗安全措施的风险。

Comments AI4GOOD Workshop at ICML'26. Code: https://github.com/SaharaLabsAI/Verifiable-ClawGuard

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23353 2026-06-30 cs.LG cs.AI

SOTAlign: Semi-Supervised Alignment of Unimodal Vision and Language Models via Optimal Transport

SOTAlign:通过最优传输实现半监督的单模态视觉与语言模型对齐

Simon Roschmann, Paul Krzakala, Sonia Mazelet, Quentin Bouniot, Zeynep Akata

AI总结 本文提出SOTAlign框架,通过少量配对数据和大量未配对数据实现视觉与语言模型的半监督对齐,利用最优传输理论提升对齐效果,优于传统监督和半监督方法。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14872 2026-06-30 cs.LG cs.AI math.OC stat.ML

On the Emergence of Implicit Curriculum in RLVR Learning Dynamics

在RLVR学习动态中隐式课程的出现

Yu Huang, Zixin Wen, Yuejie Chi, Yuting Wei, Aarti Singh, Yingbin Liang, Yuxin Chen

AI总结 本文研究了RLVR中隐式课程的形成机制,通过理论分析和实验验证,发现混合难度训练能自然诱导隐式课程,使简单问题先被学习并为更难问题奠定基础,其效果由难度谱的平滑性决定。

Comments This is the full version of a paper published at ICML 2026. V3 adds experiments and polishes writing

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13562 2026-06-30 cs.CR cs.AI cs.CL

Mitigating the Safety-utility Trade-off in LLM Alignment via Adaptive Safe Context Learning

通过自适应安全上下文学习缓解LLM对齐中的安全性与效用权衡

Yanbo Wang, Minzheng Wang, Jian Liang, Lu Wang, Yongcan Yu, Ran He

机构 * Ritzz-AI

AI总结 本文提出ASCL框架,通过多轮工具使用过程提升推理能力,引入IFPO平衡优势估计,实现更高的整体性能。

Comments ICML 2026 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12418 2026-06-30 cs.CR cs.CL cs.LG

Sparse Autoencoders are Capable LLM Jailbreak Mitigators

稀疏自编码器是LLM劫持攻击缓解器

Yannick Assogba, Jacopo Cortellazzi, Javier Abad, Pau Rodriguez, Xavier Suau, Arno Blaas

AI总结 本文提出基于SAE的CC-Delta方法,通过比较带有和无劫持上下文的有害请求的token级表示,识别劫持相关的稀疏特征,从而在稀疏SAE特征空间中实现更优的安全-效用权衡。

Comments Accepted at the Mechanistic Interpretability Workshop, ICML 2026. 31 pages, 20 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11395 2026-06-30 cs.LG cs.AI

General and Efficient Steering of Diffusion Models

通用且高效的扩散模型操控

Qingsong Wang, Mikhail Belkin, Yusu Wang

机构 * Halıcıoğlu Data Science Institute, University of California San Diego(哈利奇奥格数据科学研究所,加州大学圣地亚哥分校)

AI总结 本文提出NA-RFM方法,通过噪声对齐和递归特征机激活操控实现无需梯度指导的高效扩散模型操控,提升生成速度和准确性。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10233 2026-06-30 cs.NE cs.AI math.CA math.MG math.OC

ImprovEvolve: Basin-Hopping Meets LLM-Guided Evolutionary Search

ImprovEvolve:盆地跳跃与LLM引导的进化搜索

Alexey Kravatskiy, Valentin Khrulkov, Ivan Oseledets

AI总结 ImprovEvolve通过进化三个专用算子(初始化、局部改进、扰动)降低LLM认知负担,通过迭代局部改进和扰动实现盆地跳跃搜索,在六边形堆叠和球面码问题中取得新成果。

Comments 40 pages, 14 figures, AI for Math Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02498 2026-06-30 cs.CL cs.AI cs.LG

Test-Time Detoxification without Training or Learning Anything

无需训练或学习的测试时去毒化

Baturay Saglam, Dionysis Kalogerias

AI总结 本文提出一种无需训练或学习的测试时去毒化方法,通过零阶优化调整输入嵌入以减少生成文本的毒性,实现安全高效的文本生成。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02472 2026-06-30 cs.LG cs.CL

SPARKLING: Balancing Signal Preservation and Symmetry Breaking for Width-Progressive Learning

SPARKLING:平衡信号保留与对称性破坏以实现宽度渐进学习

Qifan Yu, Xinyu Ma, Zhijian Zhuo, Minrui Wang, Deyi Liu, Shiyi Zhan, Yiyuan Ma, Liang Xiang, Xingyan Bin, Di He

AI总结 SPARKLING通过信号保留和对称性破坏技术,实现中间阶段宽度扩展,提升模型训练效率并减少计算成本。

Comments ICML 2026 camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22823 2026-06-30 cs.LG cs.AI cs.RO

Offline Reinforcement Learning of High-Quality Behaviors Under Robust Style Alignment

在鲁棒风格对齐下高质量行为的离线强化学习

Mathieu Petitbois, Rémy Portelas, Sylvain Lamprier

机构 * Ubisoft La Forge, Bordeaux, France(育碧La Forge,法国波尔多)

AI总结 本文提出SCIQL方法,通过结合离线目标条件RL技术与新的门控优势加权回归机制,在保持风格对齐的同时提升任务性能。

Comments ICML 2026 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13534 2026-06-30 cs.LG cs.AI

Diff-MN: Diffusion Parameterized MoE-NCDE for Continuous Time Series Generation with Irregular Observations

Diff-MN: 基于扩散参数化的MoE-NCDE连续时间序列生成方法用于不规则观测

Xu Zhang, Junwei Deng, Chang Xu, Hao Li, Jiang Bian

机构 * Microsoft Research(微软研究院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 Diff-MN通过引入MoE动态函数和解耦架构设计,提升NCDE在不规则时间序列生成中的性能,实验表明其在不规则到规则及不规则到连续生成任务中优于基线模型。

Comments This paper is accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07287 2026-06-30 cs.LG cs.AI

Experience-Evolving Multi-Turn Tool-Use Agent with Hybrid Episodic-Procedural Memory

具有混合情景-程序记忆的经验演化多轮工具使用智能体

Sijia Li, Yuchen Huang, Zifan Liu, Zijian Li, Jingjing fu, Lei Song, Jiang Bian, Jun Zhang, Rui Wang

AI总结 本文提出混合情景-程序记忆策略,通过动态重用部分重叠的成功经验,使多轮工具使用策略实现经验驱动的自我演化,提升多轮任务中的推理与执行效率。

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21864 2026-06-30 cs.AI

Knowing Bias, Doing Better: Mitigating Social Bias in LLMs via Know-Bias Neuron Enhancement

知晓偏见,表现更好:通过Know-Bias神经元增强减轻大语言模型中的社会偏见

Jinhao Pan, Chahat Raj, Anjishnu Mukherjee, Sina Mansouri, Bowen Wei, Shloka Yada, Ziwei Zhu

AI总结 本文提出KnowBias框架,通过增强而非压制编码偏见知识的神经元来减轻LLM中的社会偏见,实现高效且通用的去偏方法。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00242 2026-06-30 quant-ph cs.AI cs.IT cs.LG math.IT

Neural Minimum Weight Perfect Matching for Quantum Error Codes

神经最小权重完美匹配用于量子纠错码

Yotam Peled, David Zenati, Eliya Nachmani

AI总结 本文提出神经最小权重完美匹配解码器,结合图神经网络和Transformer预测动态边权重,提升量子纠错性能,实验显示在去极化噪声下阈值达到17.9%和10.95%。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06090 2026-06-30 cs.SE cs.AI cs.PF

SWE-fficiency: Can Language Models Optimize Real-World Repositories on Real Workloads?

SWE-fficiency:语言模型能否在真实工作负载上优化现实世界仓库?

Jeffrey Jian Ma, Milad Hashemi, Amir Yazdanbakhsh, Kevin Swersky, Ofir Press, Enhui Li, Vijay Janapa Reddi, Parthasarathy Ranganathan

机构 * Harvard University(哈佛大学) Google DeepMind(谷歌DeepMind) Princeton University(普林斯顿大学) Google(谷歌)

AI总结 本文提出SWE-fficiency基准,评估语言模型在真实工作负载上优化软件仓库性能的能力,发现现有模型在定位优化机会和保持正确性方面表现不佳。

Comments Appearing at ICML 2026. Data, code, and leaderboard are available at https://swefficiency.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02918 2026-06-30 cs.CV

Evaluating Newtonian Mechanics in Video Generative Models with Real Physical Systems

在视频生成模型中评估牛顿力学

Antonios Tragoudaras, Chenyu Zhang, Daniil Cherniavskii, Antonios Vozikis, Thijmen Nijdam, Derck W. E. Prinzhorn, Mark Bodracska, Nicu Sebe, Andrii Zadaianchuk, Efstratios Gavves

AI总结 本文提出Morpheus框架,通过真实物理系统评估视频生成模型对牛顿力学的理解能力,揭示当前模型在物理原理编码上的不足。

Comments Forty-Third International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21530 2026-06-30 cs.LG

Expert-guided Clinical Text Augmentation via Query-Based Model Collaboration

通过基于查询的模型协作进行专家指导的临床文本增强

Dongkyu Cho, Miao Zhang, Rumi Chunara

AI总结 本文提出基于查询的模型协作框架,利用专家知识指导文本增强,提升医疗信息保留并减少幻觉,实验显示在临床预测任务中表现优于传统方法。

Comments 18 pages, 6 figures, Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19809 2026-06-30 cs.LG cs.AI cs.RO

Representation Learning for Equivariant Inference with Guarantees

具有保证的等价推理表示学习

Daniel Ordoñez-Apraez, Vladimir Kostić, Alek Fröhlich, Vivien Brandt, Karim Lounici, Massimiliano Pontil

机构 * CSML, Italian Institute of Technology(意大利技术研究院 CSML) University College London(伦敦大学学院)

AI总结 本文提出一种等价表示学习框架,同时解决回归、条件概率估计和不确定性量化,并提供非渐近的统计学习保证。

Comments 67 pages, 22 figures, accepted to International Conference on Machine Learning (ICML-2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00539 2026-06-30 cs.LG cs.AI cs.CL

Distributionally Robust Reinforcement Learning with Human Feedback

具有人类反馈的分布鲁棒强化学习

Debmalya Mandal, Paulius Sasnauskas, Goran Radanovic

AI总结 本文提出一种分布鲁棒的强化学习方法,通过改进奖励基强化学习和直接偏好优化,提升模型在分布变化时的鲁棒性,实验显示在非分布任务中性能显著提升。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14940 2026-06-30 cs.CL cs.AI

CASE-Bench: Context-Aware SafEty Benchmark for Large Language Models

CASE-Bench:面向大语言模型的上下文感知安全基准

Guangzhi Sun, Xiao Zhan, Shutong Feng, Philip C. Woodland, Jose Such

AI总结 本文提出CASE-Bench,通过整合上下文信息评估大语言模型的安全性,揭示上下文对人类判断的显著影响,并发现商业模型在安全情境下的响应与人类判断存在明显偏差。

Comments 24 pages. This paper has been accepted at ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.24050 2026-06-30 cs.LG stat.ML

A Mechanistic Study of Transformers Training Dynamics

Transformer训练动态的机制研究

Ambroise Odonnat, Wassim Bouaziz, Vivien Cabannes

AI总结 本文通过可控实验研究Transformer训练动态,发现梯度下降可实现聚类头解决稀疏模块加法任务,并揭示训练过程中两阶段学习及归一化层高曲率导致的损失尖峰现象。

Comments Accepted at ICML 2026 Mechanistic Interpretability workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16472 2026-06-30 cs.LG

Personalized Additive Modeling for Multi-level Federated Learning

多级联邦学习中的个性化加法建模

Shutong Chen, Guodong Long, Tianyi Zhou, Jie Ma, Jing Jiang, Chengqi Zhang

机构 * University of Technology Sydney(悉尼科技大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 本文提出FeMAM,通过多级共享模型和加法组合构建个性化预测器,有效处理复杂非独立同分布数据,优于传统联邦学习基线。

Comments Accepted at the International Conference on Machine Learning (ICML), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01718 2026-06-29 cs.CV 版本更新

Dual-branch Robust Unlearnable Examples

双分支鲁棒不可学习样本

Xianlong Wang, Hangtao Zhang, Wenbo Pan, Ziqi Zhou, Changsong Jiang, Li Zeng, Xiaohua Jia

AI总结 提出DUNE方法,通过空间和颜色域的双分支优化及集成策略,增强不可学习样本对高级防御的鲁棒性,在CIFAR-10和ImageNet上平均测试准确率低至14.95%-50.82%。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28182 2026-06-29 cs.LG cs.AI cs.CV cs.RO 新提交

LLawCo: Learning Laws of Cooperation for Modeling Embodied Multi-Agent Behavior

LLawCo: 学习合作法则以建模具身多智能体行为

Qinhong Zhou, Chuang Gan, Anoop Cherian

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Mitsubishi Electric Research Laboratories(三菱电机研究实验室)

AI总结 提出LLawCo框架,通过反思失败提取行为模式并推导高层合作法则,结合监督微调融入推理,提升具身多智能体在分散部分可观测环境中的合作效率与任务成功率。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏