arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

2026-07-01 至 2026-07-01 共收录 20
2606.32000 2026-07-01 cs.LG cs.AI 新提交

Radial Suppression Accelerates Algorithmic Generalization: A Geometric Analysis of Delayed Generalization

径向抑制加速算法泛化:延迟泛化的几何分析

Srijan Tiwari, Aditya Chauhan, Manjot Singh

机构 * Indian Institute of Technology Roorkee(印度理工学院罗尔基分校)

AI总结 通过几何分析揭示交叉熵优化下隐藏表示的径向膨胀导致记忆-泛化延迟,提出径向惩罚加速泛化,在模算术和加法任务上实现最高6倍加速。

Comments 16 pages, 5 figures, 10 tables. Presented at the Workshop on High-dimensional Learning Dynamics at the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31813 2026-07-01 cs.LG cs.AI 新提交

Geometry-Preserving Orthonormal Initialization for Low-Rank Adaptation in RLVR

保持几何的正交初始化用于RLVR中的低秩适应

Ruijia Zhang, Jiacheng Zhu, Hanqing Zhu, Laixi Shi

机构 * Johns Hopkins University(约翰霍普金斯大学) Meta Superintelligence Labs(Meta超级智能实验室) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 针对RLVR中LoRA初始化问题,提出保持几何的正交初始化方法(RLPO和RLMO),理论证明其最小化与全微调差距,实验表明稳定训练且优于标准LoRA。

Comments 30 pages, accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31567 2026-07-01 cs.CY cs.AI 新提交

FLARE-AI: Flaw Reporting for AI

FLARE-AI:AI缺陷报告

Shayne Longpre, Elaine Zhu, Carson Ezell, Avijit Ghosh, Sean McGregor, Kevin Paeth, Kevin Klyman, Sayash Kapoor, Rishi Bommasani, Ruth Appel, Gregory Strom, Lauren McIlvenny, Mark M. Jaycox, Peter Slattery, Nathan Butters, Arvind Narayanan, Percy Liang, Alex Pentland

AI总结 针对AI系统缺陷报告生态碎片化问题,提出开源系统FLARE-AI,通过条件逻辑和早期分类简化报告创建,支持标准化机器可读报告分发,降低报告门槛并提升互操作性。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31519 2026-07-01 cs.LG cs.CL 新提交

RaBitQCache: Rotated Binary Quantization for KVCache in Long Context LLM Inference

RaBitQCache: 面向长上下文LLM推理中KVCache的旋转二值量化

Wenhao Li, Jinhao Dong, Hailin Zhang, Wenhang Shi, Wei Lu, Xiaoyong Du

机构 * School of Information, Renmin University of China(中国人民大学信息学院) Peking University(北京大学)

AI总结 针对长上下文大语言模型推理中KV缓存导致的瓶颈,提出RaBitQCache框架,利用随机旋转二值量化和高效二进制-INT4算术无偏估计注意力权重,实现自适应Top-p检索,加速推理并减少内存I/O。

Comments Accept by ICML 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31474 2026-07-01 cs.LG 新提交

TabPATE: Differentially Private Tabular In-Context Learning Without Public Data

TabPATE: 无需公开数据的差分隐私表格上下文学习

Dariush Wahdany, Matthew Jagielski, Jesse C. Cresswell, Adam Dziedzic, Franziska Boenisch

机构 * CISPA(CISPA亥姆霍兹信息安全中心) Anthropic Layer 6 AI

AI总结 提出TabPATE,一种无需公开数据的差分隐私PATE风格防御方法,通过教师模型分区和私有聚合生成学生上下文,在表格基准上保持可用性并将成员推断降至随机水平。

Comments Presented at the 2nd ICML Workshop on Foundation Models for Structured Data (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31397 2026-07-01 cs.LG cs.AI 新提交

Mixture-of-Control: State-Aware Fine-Tuning for Transformer-based Models

控制混合:基于Transformer模型的状态感知微调

Duc Anh Nguyen, Tien Ngoc Luu, Tung Pham, Toan Tran

机构 * Qualcomm AI Research(高通人工智能研究院)

AI总结 提出Mixture-of-Control(MoC)框架,通过稀疏混合专家机制自适应融合局部和全局控制信号,增强Transformer块间信息交换,实现高效微调。

Comments ICML 2026 Workshop on Connecting Low-rank Representations in AI, CoLoRAI, 26 pages, 12 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31338 2026-07-01 cs.SD cs.AI eess.AS 新提交

Beyond Binary Instrument QA: Probing Instrument Grounding in Music Audio-Language Models

超越二元乐器问答:探究音乐音频-语言模型中的乐器接地

Yujun Lee, Joonhyeok Shin, Hyoeun Kim, Kyuhong Shim

AI总结 本文通过多轴诊断基准测试发现,音乐音频-语言模型在二元乐器问答中的高准确率常掩盖选项位置偏差、易混淆乐器错误和时间响应偏差等问题,表明乐器接地评估需采用多维度基准而非单一准确率。

Comments Workshop on Machine Learning for Audio, ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31282 2026-07-01 cs.LG 新提交

Revisiting the Volume Hypothesis

重新审视体积假说

Ari Pakman, Lior Kreimer, Yakir Berchenko

AI总结 通过复制交换Wang-Landau算法估计二元网络中的联合态密度,研究梯度学习与随机采样在泛化性能上的差异如何随训练数据量变化,发现数据量增大时梯度学习的优势减弱,从而解释了关于体积假说的矛盾实验结果。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31208 2026-07-01 cs.LG cs.CR 新提交

Probing Memorization of Tabular In-Context Learning

探测表格上下文学习中的记忆化

Francesco Capano, Jonas Böhler

机构 * SAP SE(SAP公司)

AI总结 提出ICLMEM框架探测表格基础模型在上下文学习中的参数记忆化,发现低基数任务中存在中等记忆信号,但实际训练条件下信号消失。

Comments Accepted at 2nd ICML Workshop on Foundation Models for Structured Data, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31168 2026-07-01 cs.CR cs.LG 新提交

Probe Choice Changes Canary-Memorization Verdicts: Three Post-Hoc Disagreement Case Studies in a Text-Dominant LoRA-Tuned Autoregressive Testbed

探针选择改变金丝雀记忆判定:在文本主导的LoRA微调自回归测试平台上的三个事后分歧案例研究

Zhichao Fan, Zexin Zhuang, Yanhang Li

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Northeastern University(东北大学)

AI总结 研究在Qwen2.5-VL-7B金丝雀测试平台上,固定窗口均值NLL记忆探针与全跨度秘密NLL或贪婪精确召回之间的分歧,发现窗口截断、非秘密漂移和窗口内下降三种案例,建议报告全跨度秘密NLL、跨度局部分解、行为精确召回和诱饵探针。

Comments ICML 2026 FoGen Workshop camera-ready. 17 pages, 4 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31154 2026-07-01 cs.LG cs.AI 新提交

PPT-Eval: A Benchmark for Computer-Use Agents on PowerPoint Tasks

PPT-Eval: 面向PowerPoint任务的计算机使用智能体基准

Apurva Gandhi, Vishwas Suryanarayanan, Raja Hasnain Anwar, Firoz Shaik, Shubhang Desai, Thong Q. Nguyen, Muhammad Taqi Raza, Vishal Chowdhary, Graham Neubig

机构 * Carnegie Mellon University(卡内基梅隆大学) Microsoft(微软) UMass Amherst(马萨诸塞大学阿默斯特分校) Google(谷歌) Snowflake

AI总结 提出PPT-Eval基准,包含120个PowerPoint任务,并设计基于评分标准的评估框架,通过部分评分和自然语言反馈衡量智能体表现,发现现有最强模型仅达45%成功率。

Comments Proceedings of the 43rd International Conference on Machine Learning, Seoul, South Korea. PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31082 2026-07-01 cs.CV 新提交

Fleet: Few Shots Lead Effective AI-generated Image Detection

Fleet: 少量样本引导的有效AI生成图像检测

Jiaan Wang, Sirui Liu, Yu Li, Kaiyuan Yang, Juan Cao, Sheng Tang

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 针对AI生成图像检测中静态特征空间泛化能力不足的问题,提出动态适应框架Fleet,通过约束路由校正实现少量样本快速适应新兴生成器,在64模型基准上将性能从20.4%提升至73.1%。

Comments 25 pages, accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30940 2026-07-01 cs.RO cs.AI cs.LG 新提交

Motion Planning in Compressed Representation Spaces

压缩表示空间中的运动规划

Lukas Lao Beyer, Sertac Karaman

机构 * MIT LIDS(麻省理工学院信息与决策系统实验室)

AI总结 提出一种生成式框架,通过高压缩率自编码器学习离散层级化潜在空间,并在其中直接搜索进行运动规划,兼顾灵活性与效率,无需任务特定训练。

Comments To appear in the Proceedings of the 43rd International Conference on Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30813 2026-07-01 cs.LG cs.AI 新提交

Gradient Smoothing: Coupling Layer-wise Updates for Improved Optimization

梯度平滑:耦合逐层更新以改进优化

Haoming Meng, Anton Sugolov, Vardan Papyan

机构 * Vector Institute(向量研究所)

AI总结 提出深度梯度增强框架,通过窗口平滑算子沿深度方向变换优化器更新,在不改变模型架构或训练目标下提升多种架构和任务的优化与泛化性能。

Comments Published in the Proceedings of the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30783 2026-07-01 cs.CR cs.AI 新提交

Security--Fidelity Tradeoffs: The Hidden Cost of Prompt Injection Defense

安全--保真度权衡:提示注入防御的隐藏成本

Mitchell Hermon, Rahul Gupta, Weitong Ruan, Ekraam Sabir, Haohan Wang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Amazon(亚马逊)

AI总结 本文发现防御间接提示注入会损害需要保留未信任文本的任务(如翻译),引入SecFid基准衡量保真度,揭示安全与保真度之间存在权衡,且无固定防御可同时最优。

Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026). 34 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30774 2026-07-01 cs.AI 新提交

What Drives Interactive Improvement from Feedback?

什么驱动了来自反馈的交互式改进?

Bartłomiej Cupiał, Jan Łojek, Mikołaj Garstecki, Szymon Pobłocki, Alicja Ziarko, Piotr Miłoś

机构 * University of Warsaw(华沙大学) AKCES NCBR Princeton University(普林斯顿大学) Mistral AI Institute of Mathematics, Polish Academy of Sciences(波兰科学院数学研究所)

AI总结 通过受控的学生-教师协议,分离反馈、重试和格式修正对多轮语言智能体性能提升的影响,发现有用反馈必须提供超越通用重试的指导,且学生利用反馈的能力是交互改进的关键瓶颈。

Comments 9 pages, 7 figures, accepted to the RLxF Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30702 2026-07-01 cs.LG cs.AI stat.ML 新提交

Accelerometry-Derived Digital Biomarkers for Cardiometabolic Risk: A Population-Representative Tabular Benchmark with Uncertainty Quantification

基于加速度计的心血管代谢风险数字生物标志物:一个具有不确定性量化的群体代表性表格基准

Federico Felizzi

机构 * SIIAM, Rome, Italy(意大利罗马SIIAM)

AI总结 基于NHANES 2003-2006数据构建加速度计心血管代谢基准,评估三种表格学习方法预测HbA1c、甘油三酯和CRP的性能,并应用分裂共形预测进行不确定性量化与公平性分析。

Comments Accepted at the SD4H Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31856 2026-07-01 cs.LG math.GT 新提交

Low-dimensional topology of deep neural networks

深度神经网络的低维拓扑

Junyu Ren, Lek-Heng Lim

机构 * University of Chicago(芝加哥大学)

AI总结 通过限制每层宽度为3,研究前馈网络、ResNet和Transformer如何改变低维拓扑不变量(如环绕数),揭示不同架构的表达能力差异。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28322 2026-07-01 cs.CV 新提交

PerceptionRubrics: Calibrating Multimodal Evaluation to Human Perception

PerceptionRubrics:将多模态评估校准至人类感知

Yana Wei, Hongbo Peng, Yanlin Lai, Liang Zhao, Kangheng Lin, En Yu, Keyu Lv, Han Zhou, Yin Tang, Haodong Li, Mitt Huang, Hangyu Guo, Jianjian Sun, Zheng Ge, Xiangyu Zhang, Daxin Jiang, Vishal M. Patel

机构 * Johns Hopkins University(约翰霍普金斯大学) StepFun Tsinghua University(清华大学) Independent Researcher(独立研究者)

AI总结 提出基于准则的评估框架PerceptionRubrics,通过双流准则和门控评分机制,解决基准分数饱和而实际脆弱性问题,揭示可靠性差距、开源与闭源感知差异,并实现与人类感知的高度对齐。

Comments ICML 2026. Project page: https://weiyana.github.io/PerceptionRubrics

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15054 2026-07-01 cs.LG 新提交

Size Doesn't Matter: Cosine-Scored Sparse Autoencoders

大小无关:余弦评分稀疏自编码器

Silen Naihin, Lev Stambler

AI总结 针对稀疏自编码器中内积评分受输入范数干扰的问题,提出余弦评分方法,使特征检测更关注方向对齐,实验表明该方法能更频繁地学习到人类可识别的概念。

Journal ref ICML 2026, Spotlight at the Mechanistic Interpretability Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏