arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Learning Representations · 会议 · Machine Learning

共收录 9454
2602.01719 2026-03-09 cs.CL

COMI: Coarse-to-fine Context Compression via Marginal Information Gain

COMI:通过边际信息增益的粗到细上下文压缩

Jiwei Tang, Shilei Liu, Zhicheng Zhang, Yujin Yuan, Libin Zheng, Wenbo Su, Bo Zheng

机构 * Tsinghua University(清华大学) Future Living Lab of Alibaba(阿里巴巴未来生活实验室) Sun Yat-sen University(中山大学)

AI总结 COMI通过边际信息增益实现粗到细的上下文压缩,在长上下文任务中提升压缩效率和语义保留能力。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14202 2026-03-09 cs.LG cs.AI

Understanding and Improving Hyperbolic Deep Reinforcement Learning

理解并改进双曲深度强化学习

Timo Klein, Thomas Lang, Andrii Shkabrii, Alexander Sturm, Kevin Sidak, Lukas Miklautz, Claudia Plant, Yllka Velaj, Sebastian Tschiatschek

机构 * Faculty of Computer Science, University of Vienna(维也纳大学计算机科学系) UniVie Doctoral School Computer Science, University of Vienna(维也纳大学UniVie计算机科学博士学院) Department of Machine Learning and Systems Biology, Max Planck Institute of Biochemistry(马克斯·普朗克生物化学研究所机器学习与系统生物学部门) ds:UniVie, University of Vienna(维也纳大学ds:UniVie)

AI总结 Hyper++通过改进双曲深度RL的训练稳定性与效率,提升了强化学习性能。

Comments ICLR 2026 Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05962 2026-03-09 cs.LG cs.AI

Whatever Remains Must Be True: Filtering Drives Reasoning in LLMs, Shaping Diversity

Whatever Remains Must Be True: 过滤驱动LLM推理,塑造多样性

Germán Kruszewski, Pierre Erbacher, Jos Rozen, Marc Dymetman

机构 * NAVER Labs Europe(NAVER欧洲实验室)

AI总结 本文通过过滤错误答案获得目标分布,利用α-散度族控制精度与多样性权衡,提升LLM在推理任务中的覆盖与精度表现。

Comments Published as an ICLR 2026 conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04559 2026-03-09 cs.LG cs.AI

Diffusion Fine-Tuning via Reparameterized Policy Gradient of the Soft Q-Function

通过软Q函数的重参数化策略梯度进行扩散微调

Hyeongyu Kang, Jaewoo Lee, Woocheol Shin, Kiyoung Om, Jinkyoo Park

AI总结 SQDF通过软Q函数的重参数化策略梯度方法,解决扩散模型奖励过优化问题,提升样本多样性和自然性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08723 2026-03-09 eess.AS eess.SP

ParaS2S: Benchmarking and Aligning Spoken Language Models for Paralinguistic-aware Speech-to-Speech Interaction

ParaS2S:用于基于语篇语言模型的语音到语音交互的基准测试与对齐

Shu-wen Yang, Ming Tu, Andy T. Liu, Xinghua Qu, Hung-yi Lee, Lu Lu, Yuxuan Wang, Yonghui Wu

AI总结 ParaS2S通过强化学习框架提升语音到语音交互中对语篇线索的处理能力,实现响应内容和风格的显著改进。

Comments To appear in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11512 2026-03-09 cs.CV cs.AI

LikePhys: Evaluating Intuitive Physics Understanding in Video Diffusion Models via Likelihood Preference

LikePhys: 通过似然偏好评估视频扩散模型中的直观物理理解

Jianhao Yuan, Fabio Pizzati, Francesco Pinto, Lars Kunze, Ivan Laptev, Paul Newman, Philip Torr, Daniele De Martini

机构 * University of Oxford(牛津大学) MBZUAI(穆斯林人工智能研究所) University of Chicago(芝加哥大学) UWE Bristol(布里斯托尔大学)

AI总结 LikePhys通过似然偏好评估视频扩散模型的直观物理理解,展示其与人类偏好一致,优于现有基线,并揭示模型设计和推理设置对物理理解的影响。

Comments 23 pages, 9 figures, Project Page: https://yuanjianhao508.github.io/LikePhys/

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08023 2026-03-09 cs.LG

Do We Really Need Permutations? Impact of Model Width on Linear Mode Connectivity

我们真的需要排列吗?模型宽度对线性模式连接的影响

Akira Ito, Masanori Yamada, Daiki Chijiwa, Atsutoshi Kumagai

机构 * Tohoku University(东大理工大学) NTT DOCOMO, INC.(NTT DOCOMO公司) NTT Computer and Data Science Laboratories(NTT计算机与数据科学实验室)

AI总结 本研究发现,通过扩大模型宽度并使用合适的softmax温度校准,无需排列即可实现线性模式连接。

Comments Accepted to the Fourteenth International Conference on Learning Representations (ICLR 2026). OpenReview: https://openreview.net/forum?id=ll8GLAic7q

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05278 2026-03-09 cs.LG cs.CL

Decoding Partial Differential Equations: Cross-Modal Adaptation of Decoder-only Models to PDEs

解码偏微分方程:解码器-only模型在偏微分方程上的跨模态适应

Paloma García-de-Herreros, Philipp Slusallek, Dietrich Klakow, Vagrant Gautam

机构 * Saarland University(萨尔兰大学) DFKI Heidelberg Institute for Theoretical Studies(海德堡理论研究所)

AI总结 本文研究了解码器-only模型在偏微分方程时间依赖模拟任务中的跨模态适应,提出并行翻转和序列加倍两种方法,提升模型性能,缩小与编码器-only模型的差距。

Comments ICLR 2026 Workshop on AI and Partial Differential Equations

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04377 2026-03-09 q-bio.QM cs.CE cs.LG

TCR-EML: Explainable Model Layers for TCR-pMHC Prediction

TCR-EML: 用于TCR-pMHC预测的可解释模型层

Jiarui Li, Zixiang Yin, Zhengming Ding, Samuel J. Landry, Ramgopal R. Mettu

机构 * Department of Computer Science, Tulane University(计算机科学系,路易斯安那大学) Department of Biochemistry and Molecular Biology, Tulane University School of Medicine(生物化学与分子生物学系,路易斯安那大学医学学院)

AI总结 本文提出TCR-EML模型层,通过整合已知的TCR-pMHC结合机制,提升TCR-pMHC预测的可解释性与预测准确性。

Comments [Abstract] Learning Meaningful Representations of Life (LMRL) Workshop at ICLR 2026 (Project Page: https://tcreml.jiarui.li/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03929 2026-03-09 stat.ML cs.LG

Self-Speculative Masked Diffusions

自推测掩码扩散

Andrew Campbell, Valentin De Bortoli, Jiaxin Shi, Arnaud Doucet

机构 * Google DeepMind(谷歌DeepMind)

AI总结 自推测掩码扩散通过非因子化预测减少计算负担,实现文本和蛋白质序列生成的高效样本生成。

Comments 32 pages, 7 figures, 4 tables

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00803 2026-03-09 cs.LG cs.SI

Online Minimization of Polarization and Disagreement via Low-Rank Matrix Bandits

在线最小化极化和分歧的低秩矩阵老虎机

Federico Cinus, Yuko Kuroki, Atsushi Miyauchi, Francesco Bonchi

机构 * Intesa Sanpaolo AI Research(Intesa Sanpaolo人工智能研究)

AI总结 本文提出了一种基于低秩矩阵老虎机的在线算法,用于在不完全信息下最小化社交媒体上的极化和分歧,通过两阶段方法实现低维结构估计与线性老虎机算法结合,有效降低累积后悔。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00502 2026-03-09 cs.LG

Diffusion Alignment as Variational Expectation-Maximization

扩散对齐作为变分期望最大化

Jaewoo Lee, Minsu Kim, Sanghyeok Choi, Inhyuck Song, Sujin Yun, Hyeongyu Kang, Woocheol Shin, Taeyoung Yun, Kiyoung Om, Jinkyoo Park

机构 * KAIST(韩国科学技术院) MongooseAI Mila - Quebec AI Institute(魁北克人工智能研究所) University of Edinburgh(爱丁堡大学) Mila, Université de Montréal(魁北克大学Mila) Omelet

AI总结 DAV通过变分期望最大化框架,在文本生成和DNA设计中实现奖励优化与多样性保持。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11629 2026-03-09 cs.LG cs.AI

Reasoned Safety Alignment: Ensuring Jailbreak Defense via Answer-Then-Check

理性安全对齐:通过答案后检查确保对抗攻击防御

Chentao Cao, Xiaojun Xu, Bo Han, Hang Li

机构 * TMLR Group, Department of Computer Science, Hong Kong Baptist University(TMLR小组,计算机科学系,香港 Baptist大学)

AI总结 本文提出答案后检查方法,通过推理增强模型对抗攻击防御能力,实验表明其在安全性和效率上的优势。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07945 2026-03-09 cs.LG

One Model for All Tasks: Leveraging Efficient World Models in Multi-Task Planning

一个模型用于所有任务:利用高效的world models进行多任务规划

Yuan Pu, Yazhe Niu, Jia Tang, Junyu Xiong, Shuai Hu, Hongsheng Li

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Chinese University of Hong Kong MMLab(香港中文大学 MMLab) University of Science and Technology of China(中国科学技术大学) Novosibirsk State University(新西伯利亚州立大学) Centre for Perceptual and Interactive Intelligence(感知与交互智能中心)

AI总结 ScaleZero通过混合专家架构和动态参数扩展策略,实现单一模型在多任务规划中的高效性能。

Comments 55 pages, 20 figures. Accepted as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21513 2026-03-09 cs.LG cond-mat.dis-nn cs.AI

A Geometric Perspective on the Difficulties of Learning GNN-based SAT Solvers

从几何视角看基于GNN的SAT求解器学习难题

Geri Skenderi

机构 * Department of Computing Sciences, Bocconi University, Milan, Italy(计算机科学系,博科尼大学,米兰,意大利) Bocconi Institute for Data Science and Analytics (BIDSA)(博科尼数据科学与分析研究所)

AI总结 本文从几何视角分析了基于GNN的SAT求解器学习难题,揭示了曲率与问题复杂性及泛化误差的关系,并提出了改进求解器设计的思路。

Comments Accepted in the Proceedings track of the GRaM Workshop @ ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03197 2026-03-09 cs.CE cs.LG q-bio.BM

Quantifying Cross-Attention Interaction in Transformers for Interpreting TCR-pMHC Binding

量化Transformer中跨注意力交互以解释TCR-pMHC结合

Jiarui Li, Zixiang Yin, Haley Smith, Zhengming Ding, Samuel J. Landry, Ramgopal R. Mettu

AI总结 QCAI是一种新的事后方法,用于解释Transformer解码器中的跨注意力机制,通过定量评估在TCR-pMHC结合基准中实现最佳性能。

Comments The Fourteenth International Conference on Learning Representations (Project Page: https://qcai.jiarui.li/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06727 2026-03-09 cs.AI cs.CV

VisioMath: Benchmarking Figure-based Mathematical Reasoning in LMMs

VisioMath: 评估LMMs中基于图的数学推理能力的基准测试

Can Li, Ying Liu, Ting Zhang, Mei Wang, Hua Huang

机构 * School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院) Beijing Key Laboratory of Artificial Intelligence for Education(北京人工智能教育重点实验室) Engineering Research Center of Intelligent Technology and Educational Application, Ministry of Education(教育部智能技术与教育应用工程研究中心)

AI总结 VisioMath是一个针对LMMs中基于图表的数学推理能力的基准测试,通过1,800个高质量K-12数学问题评估模型在视觉相似图像间的推理能力,并提出三种提升对齐效果的策略。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11165 2026-03-09 cs.LG cs.AI cs.CL cs.CV

Maximizing Asynchronicity in Event-based Neural Networks

在事件驱动神经网络中最大化异步性

Haiqing Hao, Nikola Zubić, Weihua He, Zhipeng Sui, Davide Scaramuzza, Wenhui Wang

机构 * State Key Laboratory of Precision Measurement Technology and Instrument, Department of Precision Instrument, Tsinghua University(精密测量技术与仪器国家重点实验室,精密仪器系,清华大学) Robotics and Perception Group, University of Zurich(机器人与感知组,苏黎世大学)

AI总结 EVA通过借鉴语言建模技术,提出一种新的A2S框架,生成高表达性和通用性的事件特征,在识别和检测任务中表现出色。

Comments 22 pages, 7 figures, 15 tables, ICLR 2026 Camera Ready paper

Journal ref International Conference on Learning Representations (ICLR), Brazil, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02387 2026-03-09 cs.CL cs.AI cs.LG

RM-R1: Reward Modeling as Reasoning

RM-R1: 作为推理的奖励建模

Xiusi Chen, Gaotang Li, Ziqi Wang, Bowen Jin, Cheng Qian, Yu Wang, Hongru Wang, Yu Zhang, Denghui Zhang, Tong Zhang, Hanghang Tong, Heng Ji

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California, San Diego(加州大学圣地亚哥分校) Texas A&M University(德克萨斯A&M大学) Stevens Institute of Technology(史蒂文斯理工学院)

AI总结 RM-R1通过将奖励建模作为推理任务,提升模型的可解释性和性能,实验证明其在多个基准测试中表现优于现有模型。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15805 2026-03-09 cs.LG cs.AI physics.chem-ph

FragFM: Hierarchical Framework for Efficient Molecule Generation via Fragment-Level Discrete Flow Matching

FragFM:基于片段级离散流匹配的高效分子生成分层框架

Joongwon Lee, Seonghwan Kim, Seokhyun Moon, Hyunwoo Kim, Woo Youn Kim

机构 * Department of Chemistry, KAIST(韩国科学技术院化学系) InnoCORE AI-CRED Institute, KAIST(韩国科学技术院InnoCORE AI-CRED研究所) College of Pharmacy, Dongguk University(东国大学药学院) Department of Data Science, KAIST(韩国科学技术院数据科学系)

AI总结 FragFM通过片段级离散流匹配实现高效分子生成,优于原子级方法,并提出NPGen基准评估自然产物生成能力。

Comments Published in International Conference on Learning Representations (ICLR), 2026

Journal ref Proceedings of the Fourteenth International Conference on Learning Representations (ICLR 2026), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05483 2026-03-06 cs.LG cs.AI stat.ML

SurvHTE-Bench: A Benchmark for Heterogeneous Treatment Effect Estimation in Survival Analysis

SurvHTE-Bench:生存分析中异质治疗效应估计的基准测试

Shahriar Noroozizadeh, Xiaobin Shen, Jeremy C. Weiss, George H. Chen

机构 * Machine Learning Department & Heinz College Carnegie Mellon University(机器学习系及卡内基梅隆大学海因兹学院) Heinz College Carnegie Mellon University(卡内基梅隆大学海因兹学院) National Library of Medicine National Institutes of Health(国家医学图书馆国立卫生研究院)

AI总结 SurvHTE-Bench是一个用于生存分析中异质治疗效应估计的首个综合基准测试,通过合成、半合成和现实数据集评估不同方法在复杂条件下的性能。

Comments The Fourteenth International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05468 2026-03-06 cs.LG

Kraus Constrained Sequence Learning For Quantum Trajectories from Continuous Measurement

基于Kraus约束的序列学习用于连续测量的量子轨迹

Priyanshi Singh, Krishna Bhatia

机构 * Department of Computer Science and Engineering(计算机科学与工程系) SRM Institute of Science and Technology(SRM科学与技术学院) QuantumAI Lab(量子AI实验室)

AI总结 本文提出Kraus结构的输出层,将序列模型转换为物理有效的量子操作,通过Kraus-LSTM在非平稳环境下提升状态估计质量7%。

Comments Poster at AI&PDE: ICLR 2026 Workshop on AI and Partial Differential Equations. 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05454 2026-03-06 cs.CV

Beyond Scattered Acceptance: Fast and Coherent Inference for DLMs via Longest Stable Prefixes

超越零散接受:通过最长稳定前缀实现DLMs的快速且一致推理

Pengxiang Li, Joey Tsai, Hongwei Xue, Kunyu Shi, Shilin Yan

机构 * Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学)

AI总结 通过最长稳定前缀调度器,提升DLMs推理速度3.4倍,同时保持输出质量。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05440 2026-03-06 cs.LG

Latent Wasserstein Adversarial Imitation Learning

潜在Wasserstein对抗模仿学习

Siqi Yang, Kai Yan, Alexander G. Schwing, Yu-Xiong Wang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本文提出LWAIL方法,通过动态感知潜在空间和ICVF训练,实现仅需少量状态示例即可达到专家级性能的模仿学习。

Comments 10 pages, accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05399 2026-03-06 cs.AI

Judge Reliability Harness: Stress Testing the Reliability of LLM Judges

LLM裁判可靠性检测工具:检验LLM裁判的可靠性

Sunishchal Dev, Andrew Sloan, Joshua Kavner, Nicholas Kong, Morgan Sandler

机构 * RAND Corporation(RAND公司)

AI总结 本研究提出了一种开源工具,用于评估LLM裁判在不同基准中的可靠性,发现模型和扰动类型对性能有显著影响。

Comments Accepted at Agents in the Wild: Safety, Security, and Beyond Workshop at ICLR 2026 - April 26, 2026, Rio de Janeiro, Brazil

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09988 2026-03-06 cs.LG cs.AI physics.comp-ph

Empirical Stability Analysis of Kolmogorov-Arnold Networks in Hard-Constrained Recurrent Physics-Informed Discovery

Kolmogorov-Arnold网络在硬约束递归物理信息发现中的经验稳定性分析

Enzo Nicolas Spotorno, Josafat Leal Filho, Antonio Augusto Medeiros Frohlich

机构 * Department of Informatics and Statistics(信息与统计学系)

AI总结 本文研究了Kolmogorov-Arnold网络在硬约束递归物理信息发现中的稳定性,发现其在处理乘法项时表现欠佳,且存在超参数脆弱性问题,表明原有加法归纳偏置的局限性。

Comments 5 pages, 1 figure, 1 table, accepted as Poster at AI&PDE ICLR 2026 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01565 2026-03-06 math.OC cs.AI

Deep FlexQP: Accelerated Nonlinear Programming via Deep Unfolding

Deep FlexQP:通过深度展开实现非线性规划的加速

Alex Oshin, Rahul Vodeb Ghosh, Augustinos D. Saravanos, Evangelos A. Theodorou

机构 * Georgia Institute of Technology(佐治亚理工学院) Massachusetts Institute of Technology(麻省理工学院)

AI总结 Deep FlexQP通过深度展开学习反馈策略,实现加速的非线性规划求解,优于现有方法并在多个基准测试中表现优异。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00141 2026-03-06 cs.CV cs.AI

FLoC: Facility Location-Based Efficient Visual Token Compression for Long Video Understanding

FLoC:基于设施定位的高效视觉令牌压缩用于长视频理解

Janghoon Cho, Jungsoo Lee, Munawar Hayat, Kyuwoong Hwang, Fatih Porikli, Sungha Choi

机构 * Qualcomm AI Research(高通人工智能研究)

AI总结 FLoC提出了一种基于设施定位函数的高效视觉令牌压缩方法,通过懒惰贪心算法实现紧凑且多样化的令牌选择,有效提升长视频理解的处理效率和性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22503 2026-03-06 cs.LG cond-mat.mtrl-sci cs.AI cs.NE

LLEMA: Evolutionary Search with LLMs for Multi-Objective Materials Discovery

LLEMA:基于LLM的多目标材料发现进化搜索

Nikhil Abhyankar, Sanchit Kabra, Saaketh Desai, Chandan K. Reddy

机构 * Department of Computer Science, Virginia Tech(弗吉尼亚理工学院计算机科学系) Center of Integrated Nanotechnologies, Sandia National Laboratories(桑迪亚国家实验室集成纳米技术中心)

AI总结 LLEMA结合大语言模型与进化规则,通过多目标优化提升材料发现效率,实现高命中率和稳定性质的候选材料生成。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23886 2026-03-06 cs.LG cs.AI

Towards Understanding Subliminal Learning: When and How Hidden Biases Transfer

迈向理解潜意识学习:何时以及如何隐藏偏见转移

Simon Schrodi, Elias Kempf, Fazl Barez, Thomas Brox

机构 * University of Freiburg(弗赖堡大学) University of Oxford(牛津大学) WhiteBox

AI总结 研究探讨了语言模型在蒸馏过程中潜意识学习的机制,发现早期层的微调足以引发隐藏偏见的转移,并指出该现象对提示改写敏感。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏