Geometry-Aware Dataset Condensation for Diffusion Model Training
面向扩散模型训练的几何感知数据集压缩
AI总结 针对扩散模型训练,提出基于几何感知分布对齐的真实子集选择方法,利用单侧部分最优传输保持几何结构,并辅以轻量级特征统计与语义一致性正则化,通过两阶段离散优化实现高效压缩。
Comments ICML 2026
期刊&会议
International Conference on Machine Learning · 会议 · Machine Learning
面向扩散模型训练的几何感知数据集压缩
AI总结 针对扩散模型训练,提出基于几何感知分布对齐的真实子集选择方法,利用单侧部分最优传输保持几何结构,并辅以轻量级特征统计与语义一致性正则化,通过两阶段离散优化实现高效压缩。
Comments ICML 2026
通过纠正失真改进视觉令牌减少以实现高效多模态大语言模型推理
机构 * KAIST(韩国科学技术院)
AI总结 提出RESTORE框架,通过校准位置和注意力失真来改进视觉令牌减少,在保持效率的同时提升多模态大语言模型性能。
Comments Accepted to ICML 2026
多智能体系统是专家混合:谁成为影响者?
机构 * CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全中心) ; Faculty of Computer Science, University of Vienna(维也纳大学计算机科学系)
AI总结 本文通过Friedkin-Johnsen意见动力学模型分析多智能体LLM协商机制,揭示输入依赖的FJ参数使系统成为专家混合,并探讨基于自信度、感知自信度和初始观点对齐的影响者形成机制。
Comments Accepted at the 2nd Workshop on Compositional Learning at ICML 2026
iTryOn: 通过空间-语义引导掌握交互式视频虚拟试穿
机构 * Shenzhen Campus of Sun Yat-sen University ; Taobao \& Tmall Group of Alibaba
AI总结 本文提出iTryOn框架,通过空间-语义引导解决交互式视频虚拟试穿中的语义模糊和复杂服装变形问题,实现了更动态可控的虚拟试穿体验。
Comments Project Page: https://zhengjun-ai.github.io/itryon-page. Accepted by ICML 2026
Riemannian MeanFlow用于流形上的单步生成
机构 * School of Software, Shandong University, Jinan, China(软件学院,山东大学,济南,中国)
AI总结 本文提出Riemannian MeanFlow(RMF),通过平行运输定义平均速度场,并推导出将平均速度与瞬时速度联系起来的Riemannian MeanFlow恒等式,从而实现流形上基于位置的切空间中的单步生成,改进了生成质量与效率的权衡并降低了采样成本。
Comments ICML 2026
MemBoost:一种面向成本感知的LLM推理的内存增强框架
机构 * University of Cambridge(剑桥大学) ; ETH Zurich(苏黎世联邦理工学院)
AI总结 提出MemBoost框架,通过轻量模型重用历史答案和检索支持信息,并选择性将困难查询路由到强模型,以降低LLM推理成本,同时保持回答质量。
Comments ICML MemFM 2026 Workshop
DSB: 扩散语言模型的动态滑动块调度
机构 * Nanyang Technological University(南洋理工大学)
AI总结 针对扩散语言模型固定块调度忽视语义难度的问题,提出无训练的动态滑动块方法DSB及配套KV缓存机制DSB Cache,显著提升生成质量和推理效率。
Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026)
反因果域泛化:利用无标签数据
机构 * Apple(苹果公司) ; ETH Zürich(苏黎世联邦理工学院)
AI总结 针对反因果设置下的域泛化问题,提出利用无标签数据估计环境扰动方向,通过惩罚模型对协变量均值和协方差变化的敏感性实现鲁棒性,并提供最坏情况最优性保证。
Comments Accepted at the International Conference on Machine Learning (ICML) 2026
PRISM:一种用于可解释形状建模的三维概率神经表示
机构 * Department of Computer Science, University of North Carolina at Chapel Hill, Chapel Hill, USA(北卡罗来纳大学教堂山分校计算机科学系) ; Department of Computer Science, University of California San Diego, La Jolla, USA(加州大学圣地亚哥分校计算机科学系) ; School of Medicine, University of North Carolina at Chapel Hill, Chapel Hill, USA(北卡罗来纳大学教堂山分校医学院)
AI总结 提出PRISM框架,结合隐式神经表示与不确定性感知统计形状分析,通过封闭形式Fisher信息度量实现高效局部时间不确定性量化,在形状演化、个性化预测和异常检测任务中表现优异。
Comments ICML 2026, camera-ready version, 24 pages
LALM-as-a-Judge:用于多轮口语对话安全评估的大型音频语言模型基准测试
机构 * Computer Engineering, Technion--Israel Institute of Technology, Haifa, Israel(技术学院电子工程系,技术离子技术研究所,以色列海法) ; Language Technologies Institute, Carnegie Mellon University, Pittsburgh, PA, USA(语言技术研究所,卡内基梅隆大学,美国匹兹堡)
AI总结 针对口语对话中社会不安全内容评估仍以文本为中心、忽略韵律和转录失败的问题,提出包含24000个多轮口语对话的开放基准,评估6种大型音频语言模型在文本、音频和多模态设置下的敏感性、严重性顺序特异性和轮次位置偏差,发现音频提供非词汇证据,多模态增益非普遍且存在多种模式。
Comments Accepted to ICML 2026
语义路由器:通过单一对抗扰动劫持多模态大语言模型的可行性研究
机构 * The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)) ; School of Data Science, School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen, China(数据科学学院、人工智能学院、香港中文大学(深圳))
AI总结 提出语义感知通用扰动(SAUP),作为语义路由器同时劫持多个无状态决策,通过理论分析和SORT优化策略实现,在Qwen上对五个目标达到66%攻击成功率。
Comments Accepted to ICML 2026
TINNs:时间诱导神经网络求解时变偏微分方程
机构 * Department of Applied Mathematics, National Yang Ming Chiao Tung University, Hsinchu 30010, Taiwan(应用数学系,国立阳明交通大学,新竹30010,台湾) ; Institute of Artificial Intelligence Innovation, National Yang Ming Chiao Tung University, Hsinchu 30010, Taiwan(人工智能创新研究所,国立阳明交通大学,新竹30010,台湾) ; National Center for Theoretical Sciences, National Taiwan University, Taipei 10617, Taiwan(理论科学研究中心,国立台湾大学,台北10617,台湾)
AI总结 提出时间诱导神经网络(TINNs),将网络权重参数化为时间的函数,使空间表示随时间演化,结合Levenberg-Marquardt优化,在时变PDE求解中相对误差降低4倍,收敛速度提升10倍。
Comments Accepted at ICML 2026. Camera-ready version. Includes appendix
FutureOmni:从全模态上下文中评估多模态大语言模型的未来预测能力
机构 * Fudan University(复旦大学) ; Shanghai Innovation Institute(上海创新研究院) ; Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳分校) ; National University of Singapore(新加坡国立大学)
AI总结 提出FutureOmni基准,评估多模态大模型从音视频线索预测未来的能力,发现现有模型在语音密集场景下表现差,并设计OFF训练策略提升性能。
Comments Accepted by ICML 2026
基于不确定性感知注意力头的高效大语言模型幻觉检测
机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(莫扎德人工智能大学) ; ETH Zurich(苏黎世联邦理工学院) ; Independent Researcher(独立研究者) ; Applied AI Institute(应用人工智能研究所)
AI总结 提出RAUQ框架,利用不确定性感知注意力头与令牌级置信度,通过单次前向传递实现无监督、高效的序列级幻觉检测,在12个数据集上优于现有方法且额外计算少于1%。
Journal ref Proceedings of the 43rd International Conference on Machine Learning (ICML), Seoul, South Korea, 2026
从记忆到参数干扰:过度训练专家如何损害模型合并
机构 * Concordia University(康科德大学) ; Mila -- Québec AI Institute(魁北克人工智能研究所) ; Google DeepMind(谷歌DeepMind)
AI总结 本文研究专家模型微调过度对模型合并的影响,发现长时间微调导致记忆困难样本,造成参数干扰,降低合并性能,并提出任务相关的早停策略改善合并效果。
Comments Proceedings of the 43rd International Conference on Machine Learning, Seoul, South Korea. PMLR 306, 2026
ASyMOB:代数符号数学运算基准
机构 * MIT(麻省理工学院) ; Technion - Israel Institute of Technology(技术学院-以色列理工学院)
AI总结 提出ASyMOB基准,包含35,368个符号数学问题,通过扰动测试揭示大模型在符号数学推理中的鲁棒性不足,并发现LLM与CAS的互补潜力。
Comments Published in ICML2026: https://icml.cc/virtual/2026/poster/63549 Code repository: https://github.com/RamanujanMachine/ASyMOB Complete benchmark dataset: https://huggingface.co/datasets/Shalyt/ASyMOB-Algebraic_Symbolic_Mathematical_Operations_Benchmark
OmniSapiens: 一种通过异质性感知相对策略优化进行社会行为处理的基础模型
机构 * Massachusetts Institute of Technology(麻省理工学院) ; National University of Singapore(新加坡国立大学) ; Nanyang Technological University(南洋理工大学) ; Prince Sattam bin Abdulaziz University(普森·萨塔姆·本·阿卜杜勒阿齐兹大学) ; University of Rochester(罗切斯特大学)
AI总结 针对行为数据异质性导致的训练不平衡问题,提出Omnisapiens-7B 2.0基础模型,采用异质性感知相对策略优化(HARPO)方法,在10个行为任务和5个零样本泛化基准上取得最佳性能。
Comments Accepted to ICML 2026 Main Conference
基于流匹配的原理化强化学习从片段级策略优化中涌现
AI总结 本文提出了一种基于片段级策略优化的流匹配强化学习方法GCPO,通过将连续步骤聚合为相干片段并改变策略优化层级,有效缓解了优势归因不准确的问题,实验表明其在文本到图像生成任务中表现优于现有方法。
Comments ICML 2026
Curiosity-Critic:累积预测误差改进作为世界模型训练的可处理内在奖励
机构 * Department of Computer Science, University of Toronto, Toronto, Canada(多伦多大学计算机科学系)
AI总结 提出Curiosity-Critic方法,通过可处理的每步替代项(当前预测误差与渐近误差基线的差值)作为内在奖励,利用共训练的评论家在线估计误差基线,有效分离可约与不可约预测误差,在随机网格世界实验中优于现有方法。
Comments Accepted to ICML 2026 Workshop on Epistemic Intelligence in Machine Learning (EIML@ICML 2026). Code: https://github.com/vinbhaskara/Curiosity-Critic
克服激励崩溃悖论
机构 * Department of Statistics, University of Chicago(芝加哥大学统计系) ; Booth School of Business, University of Chicago(芝加哥大学博世商学院)
AI总结 针对AI辅助任务中激励崩溃问题,提出哨兵审计支付机制,在有限成本下维持正人力努力,并构建激励感知的主动统计推断框架优化审计率与采样分配。
Comments Accepted to ICML 2026
STRIDE: 通过编辑轨迹对生物序列进行后训练推理与优化
AI总结 提出STRIDE框架,通过后训练使LLM生成可执行的插入/删除/替换轨迹,结合监督微调和策略优化实现离散生物序列的迭代优化,在蛋白质和分子编辑任务上显著提升成功率和新颖性。
Comments Accepted to ICML 2026
Position: 模块化记忆是持续学习智能体的关键
机构 * University of Bremen(不莱梅大学) ; Seoul National University(首尔国立大学) ; Computer Vision Center Barcelona(巴塞罗那计算机视觉中心) ; University of Florence(佛罗伦萨大学) ; Microsoft Research(微软研究院) ; HEC Montreal, Mila--Quebec AI Institute, Canada CIFAR AI Chair(蒙特利尔HEC学院、魁北克人工智能研究所、加拿大CIFAR人工智能 chair) ; Bielefeld University(比勒海姆大学) ; Georgia Institute of Technology(佐治亚理工学院) ; University of Rochester(罗切斯特大学) ; University of Texas at San Antonio(德克萨斯大学圣安东尼奥分校) ; Nankai University(南开大学) ; LUISS University(卢西亚诺大学) ; Stony Brook University(石溪大学) ; University of Tübingen(图宾根大学) ; University of Trento, FBK(特伦托大学,FBK) ; Tsinghua University(清华大学) ; University of Groningen(Groningen大学)
AI总结 本文提出通过模块化记忆结合权重内学习与上下文学习,解决持续学习中的灾难性遗忘问题,实现大规模持续适应。
Comments ICML 2026 Position Track Spotlight. This work stems from discussions held at the Dagstuhl seminar on Continual Learning in the Era of Foundation Models (October 2025)
通过分布鲁棒优化学习信度集成
机构 * Department of Computer Science, KU Leuven, Belgium(比利时库勒万大学计算机科学系) ; College of Computing and Data Science, Nanyang Technological University, Singapore(新加坡南洋理工大学计算与数据科学学院) ; Department of Mechanical Engineering, KU Leuven, Belgium(比利时库勒万大学机械工程系) ; School of Engineering, Computing and Mathematics, Oxford Brookes University, U.K.(英国奥德赛布鲁克斯大学工程、计算与数学学院)
AI总结 提出CreDRO方法,通过分布鲁棒优化学习集成模型,捕获由训练与测试数据分布偏移导致的认知不确定性,在分布外检测和选择性分类任务上优于现有方法。
Comments Accepted by ICML 2026 as Spotlight paper (https://icml.cc/virtual/2026/poster/62862)
SPATIA: 空间细胞表型的多模态生成与预测
机构 * Department of Biomedical Informatics, Harvard Medical School(哈佛医学学校生物医学信息学系) ; Department of Computer Science, University of North Carolina(北卡罗来纳大学计算机科学系) ; Department of Computer Science, Massachusetts Institute of Technology(麻省理工学院计算机科学系)
AI总结 提出SPATIA模型,融合细胞形态、基因表达和空间上下文,通过置信感知流匹配和形态-谱对齐实现多尺度生成与预测,在12项任务中优于18个基线模型。
Comments ICML 2026
RAIGen: 文本到图像生成模型中的罕见属性识别
机构 * University of California, Berkeley(加州大学伯克利分校) ; UC Berkeley(加州大学伯克利分校)
AI总结 提出RAIGen框架,利用Matryoshka稀疏自编码器和新颖的少数度量,在无标签条件下发现扩散模型中的罕见属性,并支持属性放大。
Comments Accepted at ICML 2026. Webpage and code available at https://github.com/VSSILPA/RAIGen
MoSE: 混合可瘦身专家实现高效自适应语言模型
机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI), UAE(Mohamed bin Zayed人工智能大学(MBZUAI)) ; Michigan State University (MSU), USA(密歇根州立大学(MSU)) ; Amazon Science, UK(亚马逊科学)
AI总结 提出MoSE架构,每个专家具有可变宽度的嵌套结构,支持在推理时连续调节精度-计算权衡,通过多宽度训练和轻量级测试时训练实现高效自适应。
Comments Accepted to ICML 2026
部分环形扫描:重新审视视觉状态空间模型中的扫描顺序
机构 * College of Artificial Intelligence(人工智能学院) ; National Yang Ming Chiao Tung University(国立阳明交通大学) ; Mitsubishi Electric Research Labs(三菱电机研究实验室) ; Computer Science Department(计算机科学系) ; University at Albany, SUNY, NY, USA(纽约州立大学阿尔巴尼分校)
AI总结 提出PRISMamba,通过环形扫描和部分通道滤波提升视觉状态空间模型的旋转鲁棒性和效率,在ImageNet-1K上达到84.5% Top-1精度。
Comments Accepted to the 43rd International Conference on Machine Learning (ICML 2026)
最大化相对改进:将公平学习视为讨价还价问题
机构 * Department of Statistics, University of Michigan, Ann Arbor, USA(密歇根大学统计学系,安阿伯,美国)
AI总结 提出将群体公平解释为子群体间的讨价还价问题,通过相对改进指标恢复Kalai-Smorodinsky解,并给出公理化和有限样本收敛保证。
Comments Accepted at ICML 2026
R1-SyntheticVL:生成模型的合成数据是否已为多模态大语言模型做好准备?
机构 * Hong Kong Polytechnic University(香港理工大学) ; Nanyang Technological University(南洋理工大学) ; Tsinghua University(清华大学) ; National University of Singapore(新加坡国立大学)
AI总结 提出集体对抗数据合成(CADS)方法,通过集体智能和对抗学习自动生成高质量、多样且具有挑战性的多模态数据,用于增强多模态大语言模型(MLLM)在复杂现实任务中的性能。
Comments ICML 2026 Camera Ready
先澄清再绘制:面向鲁棒文本到CAD生成的主动式智能体
机构 * Georgia Institute of Technology(佐治亚理工学院) ; University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
AI总结 提出主动式智能体框架ProCAD,通过澄清代理在代码生成前解决用户提示中的歧义,再通过CAD编码代理生成可执行程序,显著提升鲁棒性,平均Chamfer距离降低79.9%。
Comments ICML 2026