arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

2026-05-18 至 2026-05-18 共收录 28
2605.15921 2026-05-18 cs.CV

AdaEraser: Training-Free Object Removal via Adaptive Attention Suppression

AdaEraser:通过自适应注意力抑制实现无训练对象去除

Dingming Liu

机构 * School of Computer Science, Peking University(北京大学计算机科学学院)

AI总结 本文提出AdaEraser框架,通过动态调节注意力机制实现对象去除,解决无训练方法中盲目抑制注意力导致生成质量下降的问题,实验表明其在对象去除任务中表现优异。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15877 2026-05-18 cs.LG cs.AI

Shapley Neuron Values for Continual Learning: Which Neurons Matter Most?

Shapley神经元值用于持续学习:哪些神经元最为关键?

Mohammad Ali Vahedifar, Abhisek Ray, Qi Zhang

机构 * Department of Electrical and Computer Engineering, Aarhus University, Denmark(电气与计算机工程系,奥胡斯大学,丹麦)

AI总结 本文提出Shapley神经元估值框架,通过量化持续学习中神经元重要性,实现无缓冲的持续学习,实验显示其在类别增量学习和任务增量学习中分别提升准确率2.88%和6.46%。

Comments This paper has been accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15803 2026-05-18 cs.CV cs.LG

Embedding-perturbed Exploration Preference Optimization for Flow Models

嵌入扰动探索偏好优化用于流模型

Sujie Hu, Chubin Chen, Jiashu Zhu, Jiahong Wu, Xiangxiang Chu, Xiu Li

机构 * Tsinghua University(清华大学) AMAP, Alibaba Group(阿里集团AMAP)

AI总结 本文提出E²PO框架,通过嵌入层面扰动维持优化稳定性,提升生成模型对人类偏好的对齐效果。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15775 2026-05-18 cs.LG

Continual Learning of Domain-Invariant Representations

持续学习领域不变表示

Pascal Janetzky, Tobias Schlagenhauf, Stefan Feuerriegel

机构 * Bosch Center for Artificial Intelligence(博世人工智能中心) Munich Center for Machine Learning(慕尼黑机器学习中心) Albstadt-Sigmaringen University(阿尔布斯塔德-西格马林根大学)

AI总结 本文提出持续学习领域不变表示方法,通过结合回放训练和定制的序列不变性对齐,提升模型在未见目标领域上的泛化能力。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21798 2026-05-18 cs.CV

CG-MLLM: Captioning and Generating 3D content via Multi-modal Large Language Models

CG-MLLM:通过多模态大语言模型实现图像描述与3D内容生成

Junming Huang, Chi Wang, Letian Li, Guangkai Xu, Donglin Huang, Hao Chen, Qiang Dai, Weiwei Xu

机构 * Zhejiang University, China(浙江大学)

AI总结 本文提出CG-MLLM,一种能实现3D描述和高分辨率3D生成的多模态大语言模型,通过混合Transformer架构分离不同建模需求,结合预训练视觉语言模型与专用3D VAE潜在空间,提升3D生成质量与感知能力。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13108 2026-05-18 cs.CV

DGS-Net: Distillation-Guided Gradient Surgery for CLIP Fine-Tuning in AI-Generated Image Detection

DGS-Net:基于知识蒸馏的梯度手术用于AI生成图像检测中的CLIP微调

Jiazhen Yan, Ziqiang Li, Fan Wang, Boyu Wang, Ziwen He, Zhangjie Fu

机构 * School of Computer Science, Nanjing University of Information Science(南京信息工程大学计算机学院) University of Macau(澳门大学)

AI总结 本文提出DGS-Net,通过梯度空间分解分离有害和有益的下降方向,提升CLIP在AI生成图像检测中的微调效果,实验表明其在检测性能和泛化能力上优于现有方法。

Comments Accepted by ICML 2026 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02453 2026-05-18 cs.LG cs.AI cs.CL

How to Train Your Advisor: Steering Black-Box LLMs with Advisor Models

如何训练你的导师:通过导师模型引导黑盒大语言模型

Parth Asawa, Alan Zhu, Abigail O'Neill, Matei Zaharia, Alexandros G. Dimakis, Joseph E. Gonzalez

机构 * University of California, Berkeley(加州大学伯克利分校) Bespoke Labs(Bespoke实验室)

AI总结 本文提出Advisor Models,通过训练小型开放权重模型生成动态个性化建议,提升黑盒前沿模型性能,实验显示在多个任务中效果显著,且具有良好的迁移性和鲁棒性。

Comments International Conference on Machine Learning (ICML) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21173 2026-05-18 cs.CV cs.AI cs.LG

Less Precise Can Be More Reliable: A Systematic Evaluation of Quantization's Impact on VLMs Beyond Accuracy

精度降低可能更可靠:对VLMs量化影响的系统评估

Aymen Bouguerra, Daniel Montoya, Alexandra Gomez-Villa, Chokri Mraidha, Fabio Arnez

机构 * Computer Vision Center(计算机视觉中心)

AI总结 本文系统评估了量化对VLMs可靠性的影响,发现量化能提升准确率、校准、异常检测和抗噪能力,但不改善协变量偏移或虚假相关性。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09006 2026-05-18 cs.GT cs.LG

Learning in Structured Stackelberg Games

在结构化Stackelberg游戏中学习

Maria-Florina Balcan, Kiriaki Fragkia, Keegan Harris

机构 * Carnegie Mellon University(卡内基梅隆大学) University of California(加州大学)

AI总结 本文研究了结构化Stackelberg游戏,提出Stackelberg-Littlestone维度以优化在线学习算法,并在分布设定中提供样本复杂度的上下界。

Comments Accepted as a spotlight paper to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15669 2026-05-18 cs.LG

Rule2DRC: Benchmarking LLM Agents for DRC Script Synthesis with Execution-Guided Test Generation

Rule2DRC:用于DRC脚本合成的LLM代理基准测试

Jinuk Kim, Junsoo Byun, Donghwi Hwang, Seong-Jin Park, Hyun Oh Song

机构 * Department of Computer Science and Engineering, Seoul National University(首尔国立大学计算机科学与工程系) Neural Processing Research Center(神经处理研究所以) Samsung Electronics Co., Ltd(三星电子公司)

AI总结 Rule2DRC是一个大规模基准,用于评估DRC脚本生成代理,包含1000个规则到脚本任务和13921个用于执行评分的评估芯片布局。它提供了一种通过DRC执行结果衡量功能正确性的评估流程,并引入SplitTester生成区分性测试用例以提升Best-of-N选择性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15615 2026-05-18 cs.CV cs.LG

Neutral-Reference Prompting for Vision-Language Models

视觉-语言模型的中性参考提示

Senmao Tian, Xiang Wei, Shunli Zhang

机构 * Beijing Jiaotong University(北京交通大学)

AI总结 本文提出NeRP策略,通过中性提示和参考图像提升模型对未知类别的判别能力,同时保持对已知类别的准确性。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15603 2026-05-18 cs.LG cs.AI

Offline Reinforcement Learning with Universal Horizon Models

离线强化学习中的通用时间 horizon 模型

Hojun Chung, Junseo Lee, Songhwai Oh

机构 * Interdisciplinary Program in Artificial Intelligence and ASRI, Seoul National University(人工智能交叉学科项目及首尔国立大学ASRI) Department of Electrical and Computer Engineering, Seoul National University(电气与计算机工程系,首尔国立大学)

AI总结 本文提出通用时间 horizon 模型,通过灵活预测任意时间 horizon 的未来状态,改进了传统几何时间 horizon 模型在远期状态建模上的不足,并在100个OGBench任务中验证了其有效性。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15567 2026-05-18 cs.AI

Position: Artificial Intelligence Needs Meta Intelligence -- the Case for Metacognitive AI

位置:人工智能需要元智能——元认知AI的案例

Sergei Chuprov, Richard D. Lange, Leon Reznik, Paulo Shakarian, Raman Zatsarenko, Dmitrii Korobeinikov

机构 * University of Texas Rio Grande Valley, Edinburg, TX, USA(德克萨斯大学里奥格兰德谷分校) Rochester Institute of Technology, Rochester, NY, USA(罗切斯特理工学院) Syracuse University, Syracuse, NY, USA(锡拉库萨大学)

AI总结 本文主张将元认知作为设计更准确、安全和高效AI的通用原则,通过联邦学习案例展示元认知提升学习效率和安全性的方法,提出新的软件框架用于实现元认知AI。

Comments This is a preliminary version accepted for presentation and publication at the 43rd International Conference on Machine Learning (ICML26). The modified final version will be available in the conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15445 2026-05-18 cs.AI

From LLM-Generated Conjectures to Lean Formalizations: Automated Polynomial Inequality Proving via Sum-of-Squares Certificates

从LLM生成的猜想到Lean形式化:通过求和平方证书实现自动多项式不等式证明

Ruobing Zuo, Hanrui Zhao, Gaolei He, Zhengfeng Yang, Jianlin Wang

机构 * School of Software Engineering, East China Normal University, Shanghai, China(东华大学软件工程学院) College of Computer Science and Technology, National University of Defense Technology, Changsha, China(国防科技大学计算机科学与技术学院) School of Computer and Information Engineering, Henan University, Kaifeng, China(河南大学计算机与信息工程学院)

AI总结 本文提出NSPI框架,结合LLM和符号计算,通过求和平方证书实现多项式不等式证明,展示其在10变量多项式上的有效性与可扩展性。

Comments Accepted to ICML 2026. Preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15417 2026-05-18 cs.LG cs.AI

$f$-Trajectory Balance: A Loss Family for Tuning GFlowNets, Generative Models, and LLMs with Off- and On-Policy Data

$f$-轨迹平衡:一种用于调整GFlowNets、生成模型和LLMs的损失家族,结合on-policy和off-policy数据

Jake Fawkes, Jason Hartford

机构 * Department of Statistics, University College London, UK(伦敦大学学院统计学系) Valence Labs, London, UK(伦敦Valence实验室)

AI总结 本文提出一种基于$f$-散度的损失家族,通过on-policy和off-policy数据调整生成模型,提升模型覆盖性和泛化能力。

Comments Published at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15353 2026-05-18 cs.LG cs.AI q-bio.MN q-bio.QM

PACER: Acyclic Causal Discovery from Large-Scale Interventional Data

PACER:从大规模干预数据中进行无环因果发现

Ramon Viñas Torné, Sílvia Fàbregas Salazar, Soyon Park, Ivo Alexander Ban, Artyom Gadetsky, Nikita Doikov, Maria Brbić

机构 * Swiss Federal Technology Institute of Lausanne (EPFL), Switzerland(瑞士联邦理工学院洛桑分校) Cornell University, USA(康奈尔大学) ETH Zurich, Zurich, Switzerland(苏黎世联邦理工学院)

AI总结 PACER通过构建无环性保证的因果发现框架,在大规模高维干预数据中实现高效且准确的因果结构推断,优于现有方法。

Comments Accepted at the 43rd International Conference on Machine Learning (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15300 2026-05-18 cs.CV

Deep Pre-Alignment for VLMs

视觉语言模型的深度预对齐

Tianyu Yu, Kechen Fang, Zihao Wan, Kaidong Zhang, Yicheng Zhang, Jun Song, Bo Zheng, Yuan Yao

机构 * Tsinghua University Shanghai Qi Zhi Institute Taobao \& Tmall Group of Alibaba

AI总结 本文提出深度预对齐(DPA),通过替换传统ViT编码器为小型VLM作为感知器,实现视觉特征与目标大语言模型文本空间的深度对齐,提升了多模态基准性能,并降低了语言能力遗忘。

Comments Accepted by ICML 2026. Project Website: https://github.com/THUMAI-Lab/Deep-Pre-Alignment

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15253 2026-05-18 cs.LG

Position: Ideas Should be the Center of Machine Learning Research

位置:想法应是机器学习研究的中心

Jairo Diaz-Rodriguez

机构 * Department of Mathematics and Statistics(数学与统计学系) York University(约克大学) Toronto M3J 1P3, Canada(多伦多M3J 1P3, 加拿大)

AI总结 本文主张机器学习研究应以想法为核心,通过行为签名测试促进理论与实践的结合,并消除复杂性溢价,使更多研究人员能做出严谨贡献。

Comments Accepted into ICML 2026 https://icml.cc/virtual/2026/poster/67144

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07557 2026-05-18 cs.LG

Beyond Distribution Estimation: Simplex Anchored Structural Inference Towards Universal Semi-Supervised Learning

超越分布估计:基于简单集锚定的结构推断以实现通用半监督学习

Yaxin Hou, Jun Ma, Hanyang Li, Bo Han, Jie Yu, Yuheng Jia

机构 * Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, Nanjing, China(新一代人工智能技术及其交叉应用重点实验室(东南大学),教育部,南京,中国) School of Computer Science and Engineering, Southeast University, Nanjing, China(计算机科学与工程学院,东南大学,南京,中国) School of Electrical Engineering, Southeast University, Nanjing, China(电气工程学院,东南大学,南京,中国)

AI总结 本文提出SAGE方法,通过在表示层面进行结构推断,避免分布估计,利用简单集锚定框架提升半监督学习性能,实验表明其在五个基准数据集上平均准确率提升8.52%。

Comments The paper is accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10687 2026-05-18 cs.CV cs.AI

OmniVL-Guard: Towards Unified Vision-Language Forgery Detection and Grounding via Balanced RL

OmniVL-Guard: 向统一视觉-语言伪造检测与定位迈进的平衡强化学习

Jinjie Shen, Jing Wu, Yaxiong Wang, Lechao Cheng, Shengeng Tang, Tianrui Hui, Nan Pu, Zhun Zhong

机构 * School of Computer Science and Information Engineering, Hefei University of Technology, Hefei, China(合肥工业大学计算机科学与信息工程学院) Wuhan University, Wuhan, China(武汉大学) Lab for Intelligence and visiON (LION)(智能视觉实验室)

AI总结 本文提出OmniVL-Guard,通过平衡强化学习解决多模态伪造检测与定位中的难度偏差问题,通过自演化CoT生成和自适应奖励缩放策略优化提升性能。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03812 2026-05-18 cs.LG cs.AI cs.CL

Antidistillation Fingerprinting

对抗蒸馏指纹

Yixuan Even Xu, John Kirchenbauer, Yash Savani, Asher Trockman, Alexander Robey, Tom Goldstein, Fei Fang, J. Zico Kolter

机构 * Carnegie Mellon University, Pittsburgh, PA, USA(卡内基梅隆大学) University of Maryland, College Park, MD, USA(马里兰大学学院市分校)

AI总结 本文提出对抗蒸馏指纹方法,通过代理模型识别并采样最大化指纹检测性的token,提升检测效果同时减少对模型性能的影响。

Comments 28 pages, 13 figures, ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19399 2026-05-18 cs.CL cs.AI cs.LG

DR Tulu: Reinforcement Learning with Evolving Rubrics for Deep Research

DR Tulu:基于演进标准的深度研究强化学习

Rulin Shao, Akari Asai, Shannon Zejiang Shen, Hamish Ivison, Varsha Kishore, Jingming Zhuo, Xinran Zhao, Molly Park, Samuel G. Finlayson, David Sontag, Tyler Murray, Sewon Min, Pradeep Dasigi, Luca Soldaini, Faeze Brahman, Wen-tau Yih, Tongshuang Wu, Luke Zettlemoyer, Yoon Kim, Hannaneh Hajishirzi, Pang Wei Koh

机构 * University of Washington(华盛顿大学) Allen Institute for AI(人工智能研究院) Carnegie Mellon University(卡内基梅隆大学) Massachusetts Institute of Technology(麻省理工学院) Seattle Children's Hospital(西雅图儿童医院) University of California, Berkeley(加州大学伯克利分校)

AI总结 本文提出RLER方法,通过演进标准与策略模型共进化,开发出首个开源深度研究模型DR Tulu,其在多个长文深度研究基准上表现优异,且成本显著低于现有模型。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08008 2026-05-18 cs.LG

Beyond Sunk Costs: Boosting LLM Pre-training Efficiency via Orthogonal Growth of Mixture-of-Experts

超越沉没成本:通过专家混合的正交增长提升LLM预训练效率

Ruizhe Wang, Yucheng Ding, Xiao Liu, Yaoxiang Wang, Peng Cheng, Baining Guo, Zhengjun Zha, Yeyun Gong

机构 * ustc(中国科学技术大学) msra(微软亚洲研究院) stju(上海交通大学) xmu(厦门大学)

AI总结 本文提出正交增长策略,通过优化专家混合模型的深度和宽度,提升LLM预训练效率,实验证明在相同计算预算下,模型准确率提升10.6%。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24798 2026-05-18 cs.CV cs.AI

Causal-Adapter: Taming Text-to-Image Diffusion for Faithful Counterfactual Generation

Causal-Adapter:驯服文本到图像扩散模型以实现忠实的反事实生成

Lei Tong, Zhihua Liu, Chaochao Lu, Dino Oglic, Tom Diethe, Philip Teare, Sotirios A. Tsaftaris, Chen Jin

机构 * Centre for AI, DS\&AI, Astrazeneca, UK(英国阿斯利康人工智能中心) Institute for Imaging, Data and Communications (IDCOM), School of Engineering, University of Edinburgh, Edinburgh, UK(爱丁堡大学工程学院影像、数据与通信研究所) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 Causal-Adapter通过模块化框架实现文本到图像扩散模型的反事实生成,利用结构因果建模和属性正则化策略,在保持图像核心身份的同时实现精确的属性控制。

Comments Project Page: https://leitong02.github.io/causaladapter/

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01679 2026-05-18 cs.LG cs.AI cs.CL

Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling

融合监督学习与强化学习微调的前缀采样

Zeyu Huang, Tianhao Cheng, Zihan Qiu, Zili Wang, Yinghui Xu, Edoardo M. Ponti, Ivan Titov

机构 * ILCC, University of Edinburgh(爱丁堡大学ILCC) Fudan University(复旦大学) Qwen Team, Alibaba Group(阿里集团Qwen团队) ILLC, University of Amsterdam(阿姆斯特丹大学ILLC)

AI总结 本文提出Prefix-RFT方法,结合示范数据与探索学习,通过数学问题验证其有效性,超越了单独SFT和RFT以及混合策略方法。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02597 2026-05-18 cs.CV cs.AI

Seeing is Understanding: Unlocking Causal Attention into Modality-Mutual Attention for Multimodal LLMs

视觉即理解:解锁因果注意力以实现模态互注意力用于多模态大语言模型

Wei-Yao Wang, Zhao Wang, Helen Suzuki, Yoshiyuki Kobayashi

机构 * Sony Group Corporation, Tokyo, Japan(索尼集团,日本东京)

AI总结 本文提出模态互注意力机制,通过解锁因果注意力,提升多模态理解性能,无需额外参数,在12个基准测试中平均提升6.2%。

Comments ICML 2026. Code is available at https://github.com/sony/aki

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17116 2026-05-18 cs.LG cs.CL

Optimizing Large Language Model Training Using FP4 Quantization

使用FP4量化优化大型语言模型训练

Ruizhe Wang, Yeyun Gong, Xiao Liu, Guoshuai Zhao, Ziyue Yang, Baining Guo, Zhengjun Zha, Peng Cheng

机构 * University of Science and Technology of China(科学技术大学) Microsoft Research Asia(微软亚洲研究院) Microsoft SIGMA Team(微软SIGMA团队)

AI总结 本文提出首个FP4训练框架,通过可微量化估计器和异常值钳制补偿策略,解决量化误差和表示能力限制问题,实现与BF16和FP8相近的精度,适用于大规模语言模型训练。

Journal ref Proceedings of the 42nd International Conference on Machine Learning, PMLR 267:62937-62957, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.03658 2026-05-18 cs.CL cs.AI cs.LG stat.ML

The Linear Representation Hypothesis and the Geometry of Large Language Models

线性表示假说与大语言模型的几何学

Kiho Park, Yo Joong Choe, Victor Veitch

机构 * University of Chicago(芝加哥大学)

AI总结 本文探讨线性表示的定义及其在表示空间中的几何意义,通过反事实语言形式化并证明其与线性探测和模型操控的关联,提出非欧几里得内积统一线性表示概念,实验验证概念表示的存在及其对解释与控制的重要性。

Comments Accepted for a presentation at ICML 2024 and an oral presentation at NeurIPS 2023 Workshop on Causal Representation Learning. Code is available at https://github.com/KihoPark/linear_rep_geometry

Journal ref In Proceedings of the 41st International Conference on Machine Learning (ICML), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏