arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

共收录 712
2601.22100 2026-06-23 cs.LG 版本更新

Boosting CVaR Policy Optimization with Quantile Gradients

利用分位数梯度提升CVaR策略优化

Yudong Luo, Erick Delage

机构 * GERAD \& Department of Decision Sciences, HEC Montreal, Canada Mila - Quebec AI Institute, Canada

AI总结 针对CVaR策略优化样本效率低的问题,引入期望分位数项,利用动态规划充分利用所有采样数据,在马尔可夫策略类中显著提升性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04548 2026-06-23 cs.LG stat.ML 版本更新

Gradient Flow Through Diagram Expansions: Learning Regimes and Explicit Solutions

通过图展开的梯度流:学习机制与显式解

Dmitry Yarotsky, Eugene Golikov, Yaroslav Gusev

机构 * Applied AI Institute(应用人工智能研究所) Steklov Mathematical Institute of Russian Academy of Sciences(俄罗斯科学院斯捷克洛夫数学研究所)

AI总结 提出一种数学框架,通过费曼图展开分析大规模学习问题中梯度流的缩放机制,揭示不同学习阶段并得到非线性梯度流的显式解,应用于高阶张量的CP分解。

Comments 51 pages, ICML'2026 spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07532 2026-06-23 cs.LG cs.AI 版本更新

Neural Concept Verifier: Scaling Prover-Verifier Games via Concept Encodings

神经概念验证器:通过概念编码扩展证明者-验证者博弈

Berkant Turan, Suhrab Asadulla, David Steinmann, Kristian Kersting, Wolfgang Stammer, Sebastian Pokutta

机构 * Zuse Institute Berlin, Germany AI \& ML Lab, Computer Science Department, TU Darmstadt Hessian Center for AI (hessian.AI) Lab1141 German Research Center for AI (DFKI) Institute of Mathematics, Technische Universit\"at Berlin, Germany Max Planck Institute for Informatics, SIC

AI总结 提出神经概念验证器(NCV)框架,结合概念编码与证明者-验证者博弈,实现高维输入的可验证分类,优于传统方法并缓解捷径行为。

Comments 28 pages, 5 figures, 12 tables, revised references. An earlier version of this work was presented at the ICML 2025 Workshop on Actionable Interpretability

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07855 2026-06-23 cs.LG cs.AI cs.CL 版本更新

DPO Unchained: Your Training Algorithm is Secretly Disentangled in Human Choice Theory (and its Loss' Convexity is Dispensable)

DPO 解绑:你的训练算法在人类选择理论中实际上是解耦的(且其损失函数的凸性并非必需)

Wenxuan Zhou, Shujian Zhang, Brice Magdalou, John Lambert, Ehsan Amid, Richard Nock, Andrew Hard

机构 * Google Research(谷歌研究) Google DeepMind(谷歌DeepMind) Work done while at Google DeepMind(在谷歌深Mind的工作) CEE-M, Univ Montpellier, CNRS, INRAE, Institut Agro(CEE-M,蒙彼利埃大学,CNRS,INRAE,农业研究所)

AI总结 本文揭示了DPO与人类选择理论的深层联系,证明其损失函数凸性并非必需,并扩展了非凸损失、任意人类选择模型嵌入等新特性。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03389 2026-06-23 cs.LG cs.AI 版本更新

Chain-of-Goals Hierarchical Policy for Long-Horizon Offline Goal-Conditioned RL

Chain-of-Goals 分层策略用于长视界离线目标条件强化学习

Jinwoo Choi, Sang-Hyun Lee, Seung-Woo Seo

机构 * Department of Electrical and Computer Engineering, Seoul National University, Seoul, South Korea(首尔国立大学电气与计算机工程系) Department of Automotive Engineering, Ajou University, Gyeonggi-do, South Korea(全州大学汽车工程系)

AI总结 提出 Chain-of-Goals 分层策略 (CoGHP),通过自回归生成潜在子目标序列,利用 MLP-Mixer 统一架构建模层次决策,在长视界任务中优于离线基线方法。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02056 2026-06-23 cs.AR cs.LG cs.SY eess.SY stat.ML 版本更新

Ultrafast On-Chip Online Learning via Spline Locality in Kolmogorov-Arnold Networks

基于Kolmogorov-Arnold网络中样条局部性的超快片上在线学习

Duc Hoang, Aarush Gupta, Philip Harris

机构 * MIT(麻省理工学院)

AI总结 针对量子计算和核聚变控制等高频系统对亚微秒级在线学习的需求,提出利用Kolmogorov-Arnold网络的B样条局部性实现稀疏更新和固定点量化鲁棒性,在FPGA上实现比MLP更高效、更具表达力的超快在线学习。

Comments Forty-Third International Conference on Machine Learning (ICML'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01624 2026-06-23 cs.CV 版本更新

PISCES: Annotation-free Text-to-Video Post-Training via Optimal Transport-Aligned Rewards

PISCES: 基于最优传输对齐奖励的无标注文本到视频后训练

Minh-Quan Le, Gaurav Mittal, Cheng Zhao, David Gu, Dimitris Samaras, Mei Chen

机构 * Microsoft(微软) Stony Brook University(石溪大学)

AI总结 提出PISCES算法,通过双重最优传输对齐奖励模块,无需人工标注即可提升文本生成视频的质量和语义对齐,在VBench上超越现有方法。

Comments Accepted to ICML 2026. Project page and code: https://roar-ai.github.io/pisces/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23124 2026-06-23 math.ST stat.TH 版本更新

Semi-knockoffs: a model-agnostic conditional independence testing method with finite-sample guarantees

半敲除:一种具有有限样本保证的模型无关条件独立性检验方法

Angel Reyero-Lobo, Bertrand Thirion, Pierre Neuvial

AI总结 提出半敲除方法,利用预训练模型避免训练-测试分割,在高维设置下提供有效p值和FDR控制,仅需连续变量的条件期望,并证明了稳定性和双重稳健性。

Journal ref Proceedings of the 43rd International Conference on Machine Learning (ICML 2026), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22969 2026-06-23 cs.LG 版本更新

Improved Algorithms for Nash Welfare in Linear Bandits

线性赌博机中纳什福利的改进算法

Dhruv Sarkar, Nishant Pandey, Sayak Ray Chowdhury

机构 * Indian Institute of Technology Kharagpur(印度理工学院克哈格普尔学院) Indian Institute of Technology Kanpur(印度理工学院坎普尔学院)

AI总结 针对线性赌博机中纳什遗憾的次优性,提出新分析工具实现阶最优界,并引入p-均值遗憾统一框架,设计元算法FairLinBandit,在真实数据集上优于现有方法。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22446 2026-06-23 cs.AI 版本更新

Anytime Safe PAC Efficient Reasoning

任意时间安全PAC高效推理

Chengyao Yu, Hao Zeng, Youxin Zhu, Jianguo Huang, Huajun Zeng, Bingyi Jing

机构 * Department of Statistics and Data Science(统计与数据科学系) Department of Statistics(统计系) Data Science, Southern University of Science(数据科学,南方科技大学) College of Computing(计算学院) College of Computing and Data Science(计算与数据科学学院) School of Statistics(统计学系) School of Statistics and Data Science(统计与数据科学系) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(人工智能学院,香港中文大学(深圳)) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 针对大型推理模型计算成本高的问题,提出B-PAC推理方法,利用逆倾向评分估计构建测试超鞅,动态调整路由阈值,在部分反馈下实现任意时间安全高效推理,理论保证性能损失控制,实验减少思考模型使用达81.01%。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.00310 2026-06-23 cs.LG stat.ML 版本更新

Parametrized Power-Iteration Clustering for Directed Graphs

有向图的参数化幂迭代聚类

Gwendal Debaussart-Joniec, Harry Sevi, Matthieu Jonckheere, Argyris Kalogeratos

机构 * Universit\'e Paris-Saclay, ENS Paris-Saclay, Centre Borelli, CNRS, France. CNRS, LAAS, France

AI总结 针对有向图顶点聚类问题,提出基于参数化可逆随机游走的ParPIC方法,通过自动调优扩散时间和高效截断嵌入,在保持聚类精度的同时提升可扩展性。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10999 2026-06-23 cs.CL 版本更新

KBQA-R1: Reinforcing Large Language Models for Knowledge Base Question Answering

KBQA-R1:强化大语言模型用于知识库问答

Xin Sun, Zhongqi Chen, Xing Zheng, Qiang Liu, Shu Wu, Bowen Song, Zilei Wang, Weiqiang Wang, Liang Wang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出KBQA-R1框架,通过强化学习(GRPO)将知识库问答建模为多轮决策过程,并引入参考拒绝采样(RRS)解决冷启动问题,在多个基准上取得最优性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10324 2026-06-23 cs.CV 版本更新

EchoingPixels: Aliasing-Resistant Joint Token Reduction for Audio-Visual LLMs

EchoingPixels: 抗混叠的音频-视觉联合令牌缩减方法

Chao Gong, Depeng Wang, Zhipeng Wei, Ya Guo, Huijia Zhu, Jingjing Chen

机构 * Fudan University(复旦大学)

AI总结 针对音频-视觉大语言模型中令牌冗余和位置混叠问题,提出EchoingPixels框架,通过跨模态语义筛和Sync-RoPE实现抗混叠的联合令牌缩减,仅用5-20%令牌达到全模型性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03136 2026-06-23 cs.MA cs.GT 版本更新

Distributionally Robust Markov Games with Average Reward

平均奖励的分布鲁棒马尔可夫博弈

Zachary Roch, Yue Wang

AI总结 提出平均奖励准则下的分布鲁棒马尔可夫博弈(DR-MG)框架,通过鲁棒贝尔曼方程证明平稳纳什均衡存在性,设计两种收敛算法,并证明折扣因子趋近1时均衡可近似。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00918 2026-06-23 cs.AI 版本更新

Sparse Neuron Ablation Triggers Catastrophic Collapse of the Language Core in Large Vision-Language Models

稀疏神经元消融引发大型视觉-语言模型中语言核心的灾难性崩溃

Cen Lu, Yung-Chen Tang, Andrea Cavallaro

机构 * École Polytechnique Fédérale de Lausanne (EPFL)(瑞士洛桑联邦理工学院) Idiap Research Institute(日内瓦研究所)

AI总结 提出渐进式神经元消融方法CAN,发现消融极少量(如LLaVA-1.5-7b中仅4个)位于语言模型下投影层的神经元即可导致LVLM灾难性崩溃,揭示功能依赖语言骨干中的稀疏神经元子集。

Comments Accepted to ICML 2026 Mechanistic Interpretability Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09898 2026-06-23 cs.LG cs.AI 版本更新

Learning Bug Context for PyTorch-to-JAX Translation with LLMs

学习 PyTorch 到 JAX 翻译中的 Bug 上下文

Hung Phan, Son Vu, Tuan Dinh, Nesreen Ahmed, Ali Payani, Ali Jannesari

机构 * Department of Computer Science, Iowa State University, Ames, IA, USA(Iowa State大学计算机科学系) Department of Human Science, Iowa State University, Ames, IA, USA(Iowa State大学人类科学系) Cisco AI Research, Outshift, San Jose, CA, USA(Cisco AI研究,Outshift,San Jose,加利福尼亚州,美国)

AI总结 针对 LLM 在 PyTorch 到 JAX 代码翻译中易出错的问题,构建 T2J 基准(含 bug 及修复),通过上下文学习使弱 LLM 翻译质量提升达 20%。

Comments ICML Deep Learning for Code (DL4C) workshop, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09597 2026-06-23 cs.LG cs.AI cs.CV 版本更新

Graph Alignment via Dual-Pass Spectral Encoding and Latent Space Communication

通过双通道谱编码和潜在空间通信的图对齐

Maysam Behmanesh, Erkan Turan, Maks Ovsjanikov

机构 * LIX, Ecole Polytechnique, IP Paris(LIX,巴黎高等师范学院,IP巴黎)

AI总结 提出双通道编码器增强节点区分性,结合几何感知功能映射对齐潜在空间,解决图对齐中节点区分性下降和潜在空间错位问题。

Comments 27 pages

Journal ref Proceedings of ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12462 2026-06-23 cs.LG stat.ML 版本更新

Model-Free Robust Average-Reward Reinforcement Learning with Sample Complexity Analysis

无模型鲁棒平均奖励强化学习及样本复杂度分析

Zachary Roch, George Atia, Yue Wang

机构 * Department of Electrical and Computer Engineering, University of Central Florida, Orlando, Florida, USA(电气与计算机工程系,中央佛罗里达大学,奥兰多,佛罗里达州,美国) Department of Computer Science, University of Central Florida, Orlando, Florida, USA(计算机科学系,中央佛罗里达大学,奥兰多,佛罗里达州,美国)

AI总结 提出无模型算法RHI,基于黑箱采样或acles和K阶多级蒙特卡洛估计器,在生成模型下实现ε-最优鲁棒策略,样本复杂度为Õ(SAH²/ε^(2+o(1)))。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05846 2026-06-19 cs.CL eess.AS 版本更新

Towards Truly Multilingual ASR: Generalizing Code-Switching ASR to Unseen Language Pairs

迈向真正的多语言ASR:将代码切换ASR泛化到未见语言对

Gio Paik, Hyunseo Shin, Soungmin Lee

机构 * University of Tokyo(东京大学)

AI总结 通过模型合并和领域泛化方法,研究从有限语言对中学到的代码切换能力能否泛化到未见语言对,实验表明双语CS-ASR模型对未见语言对有一定泛化能力但有限。

Comments ICML 2026 Workshop on Machine Learning for Audio

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30089 2026-06-19 cs.LG 版本更新

Distributionally Robust Set Representation Learning Under Inference-Time Element Corruption

推理时元素损坏下的分布鲁棒集合表示学习

Yankai Chen, Hanrong Zhang, Bowei He, Philip S. Yu, Xue Liu

机构 * McGill University(麦吉尔大学) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

AI总结 针对推理时元素损坏问题,提出SW-DRSO分布鲁棒优化框架,通过重心对抗近似最坏情况损失,在四个任务上验证了鲁棒性和性能。

Comments Accepted by ICML'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05435 2026-06-19 cs.AI 版本更新

CareTransition-Audit: A Benchmark to Audit Discharge Summaries for Efficient Care Transitions

CareTransition-Audit:用于高效护理过渡的出院总结审计基准

Akshat Dasula, Prasanna Desikan, Jaideep Srivastava, Shivali Dalmia, Abhishek Mukherji

机构 * Department of Computer Science \& Engineering, University of Minnesota-Twin Cities, Minneapolis, USA Centific AI Research, Redmond, USA

AI总结 提出基于大语言模型的自动化框架,通过46项检查清单审计出院总结完整性,在MIMIC-IV数据集上基准测试11个模型,最佳模型与临床医生标签的Cohen's kappa约0.5,所有模型难以识别模糊文档。

Comments Accepted as a poster at IEEE-ICHI 2026; Accepted at SD4H@ICML

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14696 2026-06-19 cs.LG 版本更新

A Critical Look at Targeted Instruction Selection: Disentangling What Matters (and What Doesn't)

对目标指令选择的批判性审视:厘清什么重要(以及什么不重要)

Nihal V. Nayak, Paula Rodriguez-Diaz, Neha Hulkund, Sara Beery, David Alvarez-Melis

机构 * Harvard University(哈佛大学) MIT(麻省理工学院) Kempner Institute(凯门研究所)

AI总结 本文系统解构指令微调中目标指令选择的两大核心要素——数据表示与选择算法,发现基于梯度的表示结合贪心轮询选择在低预算下表现最佳,但收益随预算增加而减弱,并统一了多种算法为近似距离最小化。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04396 2026-06-19 cs.LG cs.AI 版本更新

LoRDO: Distributed Low-Rank Optimization with Infrequent Communication

LoRDO: 分布式低秩优化与低频通信

Andrej Jovanović, Alex Iacob, Mher Safaryan, Ionut-Vlad Modoranu, Lorenzo Sani, William F. Shen, Xinchi Qiu, Dan Alistarh, Nicholas D. Lane

机构 * University of Cambridge(剑桥大学) Institute of Science and Technology Austria(奥地利科学与技术研究院) Lancaster University(兰卡斯特大学) Flower Labs(Flower实验室)

AI总结 提出LoRDO框架,统一低秩优化与低频同步,通过全秩准双曲更新恢复子空间探索,在125M-720M模型规模下实现与低秩DDP近似的性能,通信量减少约10倍。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01425 2026-06-19 cs.AI cs.LG 版本更新

One Probe Won't Catch Them All: Towards Targeted Deception Detection

一个探针无法捕捉所有:迈向有针对性的欺骗检测

Vikram Natarajan, Devina Jain, Shivam Arora, Satvik Golechha, Joseph Bloom

机构 * LASR Labs(LASR实验室) UK AI Security Institute(英国人工智能安全研究所)

AI总结 针对线性探针在欺骗检测中的异质性,提出根据具体欺骗类型匹配探针可显著提升性能(AUC提升0.108),建议组织定义威胁模型并部署相应探针。

Journal ref Proceedings of the 43rd International Conference on Machine Learning, PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01391 2026-06-19 cs.CV 版本更新

Relighting as a Probe of Visual Priors via Augmented Latent Intrinsics

通过增强潜在本征属性将重光照作为视觉先验的探针

Xiaoyan Xing, Xiao Zhang, Sezer Karaoglu, Theo Gevers, Anand Bhattad

机构 * UvA-Bosch Delta Lab, University of Amsterdam, Amsterdam, Netherlands(乌得勒支大学阿姆斯特丹分校博世Delta实验室) The University of Chicago, Chicago, USA(芝加哥大学) Johns Hopkins University, Baltimore, USA(约翰霍普金斯大学)

AI总结 提出增强潜在本征属性(ALI)方法,融合密集像素对齐视觉特征到潜在本征重光照模型,平衡语义与光度保真度,提升复杂材质重光照质量。

Comments Camera-ready version for ICML 2026. Project page: https://augmented-latent-intrinsics.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20014 2026-06-19 cs.RO cs.AI 版本更新

Bring My Cup! Personalizing Vision-Language-Action Models with Visual Attentive Prompting

Bring My Cup! 使用视觉注意力提示个性化视觉-语言-动作模型

Sangoh Lee, Sangwoo Mo, Wook-Shin Han

机构 * GSAI, POSTECH(POSTECH 人工智能研究所) IME, POSTECH(POSTECH 信息媒体研究所)

AI总结 针对VLA模型难以处理个性化指令的问题,提出无需训练的视觉注意力提示(VAP)方法,通过参考图像作为非参数记忆,利用开放词汇检测和嵌入匹配定位个人物品,并以视觉提示注入模型,在多个仿真和真实场景中显著提升成功率和正确物体操作。

Comments ICML 2026. Project page: https://vap-project.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00875 2026-06-19 cs.CL cs.HC cs.MA 版本更新

TransLaw: A Large-Scale Dataset and Multi-Agent Benchmark Simulating Professional Translation of Hong Kong Case Law

TransLaw:模拟香港判例法专业翻译的大规模数据集与多智能体基准

Xi Xuan, Chunyu Kit

机构 * City University of Hong Kong, Hong Kong SAR, China(香港城市大学)

AI总结 针对香港判例法英译中资源匮乏、法律术语和格式要求严格的问题,构建了首个大规模句对齐平行语料库HKCFA Judgment 97-22,并提出多智能体框架TransLaw,通过分解翻译任务、集成法律词汇库和检索增强生成,显著提升翻译质量,但仍未达到人类专家的风格自然度。

Comments Accepted at ICML 2026 - AI for Law

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14990 2026-06-19 cs.AI 版本更新

MEAL: A Benchmark for Continual Multi-Agent Reinforcement Learning

MEAL: 持续多智能体强化学习基准

Tristan Tomilin, Luka van den Boogaard, Samuel Garcin, Constantin Ruhdorfer, Bram Grooten, Fabrice Kusters, Yali Du, Andreas Bulling, Mykola Pechenizkiy, Meng Fang

机构 * Eindhoven University of Technology, The Netherlands(埃因霍温理工大学,荷兰) University of Edinburgh, UK(爱丁堡大学,英国) University of Stuttgart, Germany(斯图加特大学,德国) King's College London, UK(伦敦国王学院,英国) University of Liverpool, UK(利物浦大学,英国)

AI总结 提出MEAL基准,利用JAX和GPU加速实现100任务序列训练,揭示长序列中出现的失败模式。

Comments To be published in the International Conference on Machine Learning (ICML) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18726 2026-06-19 cs.SD cs.LG eess.AS 版本更新

Bioacoustic Geolocation: Species Sounds as Geographic Signals

生物声学地理定位:物种声音作为地理信号

Mustafa Chasmai, Wuao Liu, Subhransu Maji, Grant Van Horn

机构 * University of Massachusetts, Amherst(马萨诸塞大学阿姆赫斯特分校)

AI总结 本文研究仅通过声音进行全球尺度地理定位,利用生物声学信号中的物种地理分布线索,提出结合物种范围预测与检索的地理定位方法,并验证多模态融合的潜力。

Comments Accepted to ICML 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06361 2026-06-18 cs.CV 版本更新

Physics in 2-Steps: Locking Motion Priors Before Visual Refinement Erases Them

两步物理:在视觉细化之前锁定运动先验会擦除它们

Woojung Han, Seil Kang, Youngjun Jun, Min-Hung Chen, Fu-En Yang, Seong Jae Hwang

机构 * National Institute of Standards and Technology(国家标准与技术研究院)

AI总结 本文发现图像到视频扩散模型在两步生成中比多步生成具有更好的物理一致性,通过频谱分析将原因归结为去噪过程中的相位侵蚀,并提出无需训练的PhaseLock框架,通过从两步推理中提取运动先验并利用潜在增量引导强制到高保真生成中,有效缓解相位退化,提升物理一致性平均6.2点,同时保持视觉保真度且开销极小。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏