arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

2026-07-01 至 2026-07-01 共收录 17
2605.03288 2026-07-01 cs.RO 版本更新

Neural Control: Adjoint Learning Through Equilibrium Constraints

神经控制:通过平衡约束的伴随学习

Dezhong Tong, Jiawen Wang, Hengyi Zhou, Yinglong Shen, Xiaonan Huang, M. Khalid Jawed

机构 * University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

AI总结 提出Neural Control框架,利用伴随方法通过平衡条件微分传播梯度,避免求解器展开,结合滚动时域延续实现长时程隐式控制,在可变形线性物体操作中验证有效性。

Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03741 2026-07-01 cs.AI 版本更新

When to Re-Plan: Subgoal Persistence in Hierarchical Latent Reasoning

何时重新规划:分层潜在推理中的子目标持久性

Ayushi Chadha

机构 * Independent Researcher(独立研究者)

AI总结 研究分层潜在推理中稳定性与适应性的权衡,通过封建式管理-工人接口控制子目标持久周期,发现中等周期(3-6步)最优,内在对齐权重存在窄最优值(约0.05)。

Comments Accepted at the Workshop on Compositional Learning: Safety, Interpretability, and Agents (CompLearn), ICML 2026. 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00553 2026-07-01 cs.LG 版本更新

Stable-GFlowNet: Toward Diverse and Robust LLM Red-Teaming via Contrastive Trajectory Balance

Stable-GFlowNet: 通过对比轨迹平衡实现多样且鲁棒的LLM红队测试

Minchan Kwon, Sunghyun Baek, Minseo Kim, Jaemyung Yu, Dongyoon Han, Junmo Kim

机构 * Naver AI Lab(Naver AI实验室)

AI总结 针对大语言模型红队测试中有效性与多样性难以兼顾的问题,提出Stable-GFlowNet方法,通过消除配分函数估计和对比轨迹平衡实现稳定训练,在保持最优策略的同时提升攻击性能与多样性。

Comments ICML 2026 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16399 2026-07-01 cs.CV cs.LG 版本更新

Stable and Near-Reversible Diffusion ODE Solvers for Image Editing

稳定且近可逆的图像编辑扩散ODE求解器

Barbora Barancikova, Daniil Shmelev, Cristopher Salvi

机构 * Department of Computing, Imperial College London, London, United Kingdom(帝国理工学院伦敦分校计算机系,伦敦,英国) Department of Mathematics, Imperial College London, London, United Kingdom(帝国理工学院伦敦分校数学系,伦敦,英国)

AI总结 本文提出近可逆Runge-Kutta方法以提升图像编辑的稳定性与精度,平衡可逆性与数值稳定性,保留背景保真优势。

Comments ICML 2026 Workshop on Structured Probabilistic Inference & Generative Modeling (SPIGM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22027 2026-07-01 cs.CL cs.AI cs.LG 版本更新

Shared Lexical Task Representations Explain Behavioral Variability In LLMs

共享的词汇任务表示解释了大语言模型中的行为变异

Zhuonan Yang, Jacob Xiaochen Li, Francisco Piedrahita Velez, Eric Todd, David Bau, Michael L. Littman, Stephen H. Bach, Ellie Pavlick

机构 * Brown University(布朗大学) MIT(麻省理工学院) Northeastern University(东北大学)

AI总结 研究通过比较指令式和示例式提示发现,大语言模型在不同提示下行为差异可由共享的词汇任务表示解释,揭示了任务特定注意力头在不同提示风格中的共同机制。

Comments Accepted to ICML 2026. Updated to the camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01070 2026-07-01 cs.CL 版本更新

What If We Allocate Test-Time Compute Adaptively?

如果我们在测试时动态分配计算资源呢?

Ahsan Bilal, Ahmed Mohsin, Muhammad Umer, Ali Subhan, Hassan Rizwan, Ayesha Mohsin, Dean Hougen

机构 * Stanford University(斯坦福大学) University of Oklahoma(俄克拉荷马大学) University of California Riverside(加州大学河滨分校) National University of Sciences and Technology(国立科技大学)

AI总结 本文提出了一种基于验证器的自适应框架,通过迭代轨迹生成与选择提升推理效率,在多个数据集上优于传统测试时缩放方法。

Comments International Conference on Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19453 2026-07-01 cs.CL cs.GT 版本更新

Beyond Scalar Rewards: Dense Feedback for LLM Policy Synthesis in Sequential Social Dilemmas

超越标量奖励:面向序列社会困境的LLM策略合成中的密集反馈

Víctor Gallego

机构 * Komorebi AI Technologies(Komorebi AI技术公司)

AI总结 本研究通过反馈工程,比较稀疏奖励与密集社会指标反馈对LLM在多智能体环境中生成程序化策略的影响,发现密集反馈能打破奖励别名,提升策略性能。

Comments Accepted to NExT-Game 2026: New Frontiers in Game-Theoretic Learning, ICML 2026 Workshop. Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15029 2026-07-01 cs.LG cond-mat.dis-nn cs.CL 版本更新

Symmetry in language statistics shapes the geometry of model representations

语言统计中的对称性塑造了模型表示的几何结构

Dhruva Karkada, Daniel J. Korchinski, Andres Nava, Matthieu Wyart, Yasaman Bahri

机构 * UC Berkeley(加州大学伯克利分校) EPFL(瑞士联邦理工学院洛桑分校) Johns Hopkins(约翰斯·霍普金斯大学) Google DeepMind(谷歌DeepMind)

AI总结 本文证明语言统计中的平移对称性(如月份共现频率仅取决于时间间隔)决定了词嵌入模型的高维几何结构,并推导出表示流形的解析形式,该几何在统计扰动下仍保持鲁棒。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18778 2026-07-01 cs.LG cs.CL 版本更新

Teaching Models to Teach Themselves: Reasoning at the Edge of Learnability

教模型自学:在可学习性边缘推理

Shobhita Sundaram, John Quan, Ariel Kwiatkowski, Kartik Ahuja, Yann Ollivier, Julia Kempe

机构 * MIT(麻省理工学院) Meta FAIR New York University(纽约大学)

AI总结 提出SOAR非对称自对弈框架,通过元强化学习生成自动课程,解决低初始成功率数据集上的推理模型扩展问题,发现基于学生进步的奖励优于内在可学习性奖励,且问题结构比答案正确性更重要。

Comments ICML 2026. Blog post: https://ssundaram21.github.io/soar/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23088 2026-07-01 cs.CR cs.AI 版本更新

From Similarity to Vulnerability: Key Collision Attack on LLM Semantic Caching

从相似性到脆弱性:LLM语义缓存的密钥碰撞攻击

Zhixiang Zhang, Zesen Liu, Yuchong Xie, Quanfeng Huang, Dongdong She

AI总结 提出语义缓存存在密钥碰撞攻击风险,通过CacheAttack框架在黑盒条件下实现86%的LLM响应劫持命中率,并能在不同嵌入模型间迁移,威胁智能体安全。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04008 2026-07-01 cs.LG cs.CR 版本更新

Efficient Public Verification of Private ML via Regularization

通过正则化实现私有ML的高效公开验证

Zoë Ruha Bell, Anvith Thudi, Olive Franzese-McLaughlin, Nicolas Papernot, Shafi Goldwasser

机构 * University of California, Berkeley(加州大学伯克利分校) University of Toronto(多伦多大学) Vector Institute(向量研究所)

AI总结 提出首个差分隐私算法,在接近最优隐私-效用权衡下,DP保证的验证成本低于训练成本,通过正则化目标最小化和标准DP组合界限实现。

Comments Proceedings of the 43rd International Conference on Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12309 2026-07-01 cs.LG cs.AI stat.ML 版本更新

Optimal Self-Consistency for Efficient Reasoning with Large Language Models

最优自一致性:用于大语言模型高效推理

Austin Feng, Marius Alonso, Ambroise Odonnat, Vasilii Feofanov, Ievgen Redko

机构 * Yale University(耶鲁大学) Inria(法国国家信息与自动化研究所) com(42.com)

AI总结 本文分析自一致性(SC)的缩放行为,提出动态分配样本的Blend-ASC变体,平均减少4.8倍样本量,实现最先进的样本效率。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17917 2026-07-01 cs.LG cs.AI cs.CR 版本更新

Not Every Time and Frequency Need to Be Forgotten in Diffusion Unlearning

并非所有时间和频率都需要在扩散遗忘中被遗忘

Jinseong Park, Mijung Park

机构 * Korea Institute for Advanced Study(韩国高等研究院) University of British Columbia(不列颠哥伦比亚大学)

AI总结 提出选择性遗忘扩散模型中的时间和频率,通过理论分析分布失真与遗忘-效用权衡,在多种设置下实现更高遗忘成功率和生成质量。

Comments ICML 2026 Workshop FoGen

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12270 2026-07-01 cs.LG cs.CV 版本更新

L-SR1: Learned Symmetric-Rank-One Preconditioning

L-SR1: 学习型对称秩一预处理

Gal Lifshitz, Shahar Zuler, Ori Fouks, Dan Raviv

机构 * Tel Aviv University(特拉维夫大学)

AI总结 提出一种学习型二阶优化器,通过可训练的预处理单元增强经典SR1算法,在单目人体网格恢复任务中优于现有方法,无需标注数据或微调。

Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026). Project page: https://gallif.github.io/lsr1/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21550 2026-07-01 cs.NI cs.AI cs.MA 版本更新

Position: Collaborative Agentic AI Needs Interoperability Across Ecosystems

立场:协作式自主AI需要跨生态系统的互操作性

Rishi Sharma, Martijn de Vos, Pradyumna Chari, Ramesh Raskar, Anne-Marie Kermarrec

机构 * EPFL, Lausanne, Switzerland(瑞士洛桑联邦理工学院)

AI总结 本文提出通过采用最小标准实现互操作性,以构建开放、安全、可扩展的自主代理生态系统,并设计了名为“代理网络”的架构基础。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12557 2026-07-01 cs.LG cs.AI 版本更新

TraCeS: Learning Per-Timestep Constraint-Violation Credit from Sparse Trajectory-Level Labels

TraCeS: 从稀疏轨迹级标签学习每时间步约束违反信用

Siow Meng Low, Ze Gong, Akshat Kumar

AI总结 提出TraCeS方法,通过稀疏轨迹级标签学习每时间步的约束违反信用,用于强化学习中的安全约束优化,无需已知成本函数或阈值,在连续控制基准上提升约束满足和反馈效率。

Comments Accepted at ICML 2026. Code available at https://github.com/siowmeng/TraCeS

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15637 2026-07-01 cs.LG cs.AI stat.ML 版本更新

Mantis: Lightweight Foundation Model for Time Series Classification

Mantis: 用于时间序列分类的轻量级基础模型

Vasilii Feofanov, Songkang Wen, Shifeng Xie, Simon Roschmann, Marius Alonso, Hongbo Guo, Romain Ilbert, Malik Tiomoko, Quentin Bouniot, Zeynep Akata, Lujia Pan, Jianfeng Zhang, Ievgen Redko

机构 * com(42.com) Helmholtz Munich(亥姆霍兹慕尼黑中心) Technical University of Munich(慕尼黑工业大学) Criteo Meta Telecom Paris(巴黎电信学院)

AI总结 提出基于Transformer的轻量级基础模型Mantis,通过自监督对比学习在合成数据上预训练,并引入新颖的令牌生成单元和增强测试方法,在多个数据集上超越现有基础模型。

Journal ref Proceedings of the 43rd International Conference on Machine Learning, Seoul, South Korea. PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏