arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Machine Learning · 会议 · Machine Learning

共收录 11796
2509.26627 2026-05-21 cs.AI cs.LG cs.RO

TimeRewarder: Learning Dense Reward from Passive Videos via Frame-wise Temporal Distance

TimeRewarder: 通过帧间时间距离从被动视频中学习密集奖励

Yuyang Liu, Chuan Wen, Yihang Hu, Dinesh Jayaraman, Yang Gao

机构 * Institute for Interdisciplinary Information Sciences, Tsinghua University, Beijing, China(清华大学交叉信息研究院) Shanghai Qi Zhi Institute(上海启智研究院) Shanghai Jiao Tong University(上海交通大学) University of Pennsylvania(宾夕法尼亚大学)

AI总结 本文提出TimeRewarder方法,通过帧间时间距离从被动视频中学习密集奖励,以提升强化学习在稀疏奖励任务中的性能,实验表明其在多个任务中显著提高了成功率和样本效率。

Comments ICML 2026 spotlight paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25606 2026-05-21 cs.LG

Effective Model Pruning: Measure The Redundancy of Model Components

有效模型剪枝:衡量模型组件的冗余性

Yixuan Wang, Dan P. Guralnik, Saiedeh Akbari, Warren E. Dixon

机构 * Department of Mechanical and Aerospace Engineering, University of Florida(佛罗里达大学机械与航空航天工程系) Department of Mathematics, Ohio University(俄亥俄大学数学系)

AI总结 本文研究了模型剪枝中的基本问题,提出了一种基于有效样本大小的剪枝方法,通过分析重要性评分分布来确定可丢弃的组件数量,并在多种网络架构上验证了该方法的有效性。

Comments 18 pages, 4 figures. Accepted at ICML 2026 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15412 2026-05-21 cs.IT math.IT

Partitioning for Intrinsic Model Inversion Resistance in Collaborative Inference

划分以获得内在模型逆向攻击抵抗力的协作推理

Rongke Liu, Youwen Zhu, Lei Zhou, Xianglong Zhang, Dong Wang

AI总结 本文研究了在协作推理中如何划分模型以提高对逆向攻击的内在抵抗力,挑战了深度是逆向攻击抵抗力驱动因素的直觉,并提出了一种基于内在阻力的划分标准,即黄金划分区(GPZ)

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19075 2026-05-21 cs.AI cs.CL cs.LG

Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs

Universal Reasoner: 一个单一、可组合的即插即用推理器用于冻结的LLM

Jaemin Kim, Hangeol Chang, Hyunmin Hwang, Choonghan Kim, Jong Chul Ye

机构 * Graduate School of Artificial Intelligence, Korea Advanced Institute of Science and Technology(人工智能研究生院,韩国科学技术院)

AI总结 本文提出Universal Reasoner,一种可组合且即插即用的推理模块,能够在冻结的大规模语言模型上提供专门的推理能力,通过共享或对齐的token空间实现弱到强的泛化,实验表明其在数学推理和机器翻译中优于现有微调方法。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12120 2026-05-21 cs.LG cs.AI cs.CL

LLMs on the Line: Data Determines Loss-to-Loss Scaling Laws

LLMs on the Line: 数据决定损失-损失缩放定律

Prasanna Mayilvahanan, Thaddäus Wiedemer, Sayak Mallick, Matthias Bethge, Wieland Brendel

机构 * Max Planck Institute for Intelligent Systems(智能系统马克斯·普朗克研究所) ELLIS Institute Tübingen(图宾根ELLIS研究所) Tübingen AI Center(图宾根人工智能中心) University of Tübingen(图宾根大学)

AI总结 研究探讨了影响LLM损失-损失缩放定律的主要因素,发现预训练数据决定了缩放趋势,而模型大小、优化超参数、分词器和架构差异对缩放影响有限,因此应精心选择预训练数据以获得最佳下游性能。

Comments ICML 2025 camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02844 2026-05-21 cs.LG cs.AI cs.CR cs.MA

Wolfpack Adversarial Attack for Robust Multi-Agent Reinforcement Learning

狼群对抗攻击用于鲁棒多智能体强化学习

Sunwoo Lee, Jaebak Hwang, Yonghyeon Jo, Seungyul Han

机构 * Graduate School of Artificial Intelligence, UNIST, Ulsan, South Korea(人工智能研究生院,UNIST,韩国乌山)

AI总结 本文提出狼群对抗攻击框架,用于对抗多智能体强化学习中的协同对抗攻击,并引入狼群-对抗学习框架来训练鲁棒的MARL策略以防御该攻击。

Comments 9 pages main, 23 pages appendix with reference. Accepeted by ICML 2025

Journal ref Proceedings of Machine Learning Research (PMLR), ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02834 2026-05-21 cs.LG cs.AI

Task-Aware Virtual Training: Enhancing Generalization in Meta-Reinforcement Learning for Out-of-Distribution Tasks

任务感知虚拟训练:增强元强化学习在分布外任务中的泛化能力

Jeongmo Kim, Yisak Park, Minung Kim, Seungyul Han

机构 * Graduate School of Artificial Intelligence, UNIST, Ulsan, South Korea(人工智能研究生院,UNIST,韩国乌山)

AI总结 本文提出Task-Aware Virtual Training方法,通过度量学习提升元强化学习在分布外任务中的泛化能力,采用虚拟任务保持任务特征并利用状态正则化技术减少状态变化环境中的过估计误差。

Comments 9 pages main paper, 20 pages appendices with reference. Accepted to ICML 2025

Journal ref Proceedings of Machine Learning Research (PMLR), ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15822 2026-05-21 quant-ph cs.CC

Learning junta distributions, quantum junta states, and QAC$^0$ circuits

学习 junta 分布、量子 junta 状态和 QAC$^0$ 电路

Jinge Bao, Francisco Escudero-Gutiérrez

AI总结 本文研究了学习 junta 分布、量子 junta 状态和 QAC$^0$ 电路的问题,展示了这些概念与 junta 的紧密关系。对于 junta 分布,证明了可以通过 O(2^k log(n)/ε²) 个样本在总变差距离下以误差 ε 学习;对于 junta 状态,证明了可以通过 O(12^k log(n)/ε²) 个单拷贝在迹距离下学习,并给出了下界;对于 QAC$^0$ 电路,改进了 Nadimpalli 等人的结果,证明了可以通过 O(2^{O(log(s²2^a)^d)} log(n)) 个 Choi 状态样本学习大小为 s、深度为 d、辅助 qubit 数为 a 的 QAC$^0$ 电路。

Comments 20 pages. Accepted to ICML'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20396 2026-05-21 cs.LG stat.ML

Score-Based Causal Discovery of Latent Variable Causal Models

基于得分的潜在变量因果模型因果发现

Ignavier Ng, Xinshuai Dong, Haoyue Dai, Biwei Huang, Peter Spirtes, Kun Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) University of California, San Diego(加州大学圣地亚哥分校) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

AI总结 本文提出了一种基于得分的方法,用于识别包含因果相关潜在变量的因果结构,并提供了可识别性保证,同时通过实验验证了方法的有效性。

Comments ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20314 2026-05-21 cs.LG cs.AI

Less Data, Faster Training: repeating smaller datasets speeds up learning via sampling biases

数据更少,训练更快:重复较小的数据集通过采样偏差加速学习

Jingwen Liu, Ezra Edelman, Surbhi Goel, Bingbin Liu

机构 * Columbia University(哥伦比亚大学) University of Pennsylvania(宾夕法尼亚大学) Harvard University(哈佛大学)

AI总结 研究探讨了'小数据与大数据差距'现象,即使用更少样本重复训练比使用更大数据集更节省计算资源,通过层间增长和采样偏差机制实现加速,为优化提供了新的归纳偏差。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20289 2026-05-21 cs.LG cs.AI

Plug-and-Play Spiking Operators: Breaking the Nonlinearity Bottleneck in Spiking Transformers

插件式脉冲运算符:突破脉冲变换器中的非线性瓶颈

Xinzhe Yuan, Xiang Peng, Bin Gu, Huan Xiong

机构 * IASM, Harbin Institute of Technology, China(哈尔滨工业大学人工智能研究所,中国) School of Artificial Intelligence, Jilin University, China(吉林大学人工智能学院,中国)

AI总结 本文提出了一种插件式框架,通过将Transformer中的非线性运算分解为三个基本算子(除法、指数和ℓ2范数),并利用LIF神经元群体和轻量级位移缩放实现脉冲友好的近似,从而在不需微调的情况下支持常见的Transformer非线性运算。

Comments Accepted to ICML 2026. 9 pages main paper, 8 pages appendix, 6 figures, 5 tables. Correspondence to Bin Gu and Huan Xiong

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20286 2026-05-21 cs.CR cs.LG

Adaptive Probe-based Steering for Robust LLM Jailbreaking

适应性探针引导用于鲁棒大语言模型劫持

Junxi Chen, Junhao Dong, Xiaohua Xie

机构 * School of Computer Science(计算机科学学院) Engineering, Sun Yat-Sen University, China(中山大学工程学院,中国) Nanyang Technological University, Singapore(南洋理工大学,新加坡)

AI总结 本文提出了一种基于模型提取的适应性探针引导方法,通过动态调整引导强度来提升大语言模型劫持的鲁棒性和有效性,无需额外对比提示或手动调参,显著提高了攻击效果。

Comments 19 pages, 13 figures, accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20187 2026-05-21 cs.LG cs.AI cs.IT math.IT

Neural Estimation of Pairwise Mutual Information in Masked Discrete Sequence Models

在遮蔽离散序列模型中神经估计成对互信息

Jai Sharma, Yifan Wang, Bryan Li

机构 * University of California, Berkeley, CA, USA(加州大学伯克利分校)

AI总结 本文提出了一种神经框架,直接从预训练的遮蔽扩散模型(MDMs)的隐藏状态中估计成对条件互信息(MI),利用模型自身条件分布计算的地面真实MI进行监督,从而捕捉模型内部对依赖结构的信念,并在单次前向传递中预测完整的MI矩阵,实现MI引导的并行解码。

Comments 6 pages, 3 figures; submitting to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18623 2026-05-21 cs.DS cs.LG

An Approximation Algorithm for Graph Label Selection

图标签选择的近似算法

Josia John, Simon Meierhans, Maximilian Probst Gutenberg

机构 * Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系)

AI总结 本文提出了一种新的图标签选择算法,在标准预算约束下,首次实现了O(log^{1.5}n)的近似比,解决了如何从整个图中选择少量代表性顶点以准确预测剩余顶点标签的问题。

Comments Accepted at ICML 2026. 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17396 2026-05-21 cs.CL

EpiCache: Episodic KV Cache Management for Long-Term Conversation on Resource-Constrained Environments

EpiCache: 为资源受限环境下的长对话提供 episodic KV 缓存管理

Minsoo Kim, Arnav Kundu, Han-Byul Kim, Richa Dixit, Minsik Cho

机构 * Apple(苹果公司)

AI总结 本文提出 EpiCache,一种无需训练的 KV 缓存管理框架,用于在固定内存预算下实现长对话问答(LongConvQA)。该方法通过块级预填充限制缓存增长,并通过 episodic KV 压缩保留主题相关上下文,从而在多个 LongConvQA 评估基准上提升了准确性并减少了延迟和峰值内存使用。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16950 2026-05-21 cs.CV cs.LG

LAION-C: An Out-of-Distribution Benchmark for Web-Scale Vision Models

LAION-C: 一个用于网络级视觉模型的分布外基准

Fanfei Li, Thomas Klein, Wieland Brendel, Robert Geirhos, Roland S. Zimmermann

机构 * Max Planck Institute for Intelligent Systems, Tübingen, Germany(马克斯·普朗克智能系统研究所,图宾根,德国) ELLIS Institute Tübingen(图宾根ELLIS研究所) Tübingen AI Center(图宾根人工智能中心) Google DeepMind(谷歌DeepMind)

AI总结 本文提出LAION-C作为ImageNet-C的替代基准,旨在评估网络级数据集下的分布外鲁棒性,通过引入六种新的分布外扰动类型,发现现代模型在这些扰动下的表现显著提升,甚至超过人类观察者。

Comments ICML 2025 camera ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20177 2026-05-20 cs.CL cs.CV

From Seeing to Thinking: Decoupling Perception and Reasoning Improves Post-Training of Vision-Language Models

从感知到思考:解耦感知与推理提升视觉语言模型的训练

Juncheng Wu, Hardy Chen, Haoqin Tu, Xianfeng Tang, Freda Shi, Hui Liu, Hanqing Lu, Cihang Xie, Yuyin Zhou

机构 * Amazon(亚马逊) University of Waterloo(滑铁卢大学) Vector Institute, Canada CIFAR AI Chair(向量研究所,加拿大CIFAR人工智能主席)

AI总结 本研究通过解耦感知与推理,发现视觉任务性能受限于感知能力不足而非推理本身,通过分阶段训练提升模型的感知与推理能力,从而在多个视觉数学和感知任务中取得更优表现。

Comments 19 pages, 9 figures; Accepted to ICML 2026; Project Page: https://ucsc-vlaa.github.io/VLM-CapCurriculum/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20145 2026-05-20 stat.ML cs.LG stat.ME

Goal-Oriented Lower-Tail Calibration of Gaussian Processes for Bayesian Optimization

面向目标的高斯过程低尾校准用于贝叶斯优化

Aurélien Pion, Emmanuel Vazquez

机构 * Univ. Paris-Saclay, CNRS, CentraleSupélec, L2S, Gif-sur-Yvette, France(巴黎萨克雷大学,国家科学研究中心,中央超算实验室,L2S,法国吉夫-sur-伊夫特)

AI总结 本文研究了在无噪声情况下,针对低于低阈值t的标准高斯过程模型的预测分布进行面向目标的校准,提出了一种后处理方法tcGP,以校准预测分布低于t的部分,并展示了基于此的全局优化算法在设计空间中保持密集性,实验表明相较于标准高斯过程模型和全局校准高斯过程模型,改进了低尾校准和贝叶斯优化性能。

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20028 2026-05-20 cs.LG physics.ao-ph

Training-Free Bayesian Filtering with Generative Emulators

无需训练的贝叶斯过滤与生成模拟器

Thomas Savary, François Rozet, Gilles Louppe

机构 * SAIL, Montefiore institute, University of Liège, Belgium(SAIL、蒙费伊尔研究所、利耶大学、比利时)

AI总结 本文提出一种无需额外训练的最优粒子滤波变种,利用基于扩散的动力学模拟器,解决了高维环境下粒子滤波的可扩展性问题,通过非线性混沌系统实验验证了其有效性。

Comments Accepted as a spotlight paper at the International Conference on Machine Learning 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19999 2026-05-20 cs.LG cs.AI cs.CR

LLM Benchmark Datasets Should Be Contamination-Resistant

LLM基准数据集应具备抗污染性

Ali Al-Lawati, Jason Lucas, Dongwon Lee, Suhang Wang

机构 * The Pennsylvania State University, University Park, PA, USA(宾夕法尼亚州立大学)

AI总结 本文探讨了LLM基准数据集应具备抗污染性,提出通过改进数据集设计和架构来提高其可靠性和通用性。

Comments Accepted to ICML 2026 Position Paper Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19974 2026-05-20 cs.CV

SphericalDreamer: Generating Navigable Immersive 3D Worlds with Panorama Fusion

SphericalDreamer: 通过全景融合生成可导航的沉浸式3D世界

Antoine Schnepf, Karim Kassab, Flavian Vasile, Andrew Comport

机构 * Université Côte d'Azur, CNRS, I3S, France(法国蔚蓝海岸大学、国家科学研究中心、I3S研究所) Criteo AI Lab, Paris, France(法国Criteo人工智能实验室)

AI总结 本研究提出SphericalDreamer方法,通过生成多个全景图像并将其提升到3D空间中进行融合,从而生成高度细节且可导航的沉浸式3D户外环境,显著提升了尺度和可导航性。

Comments Accepted at ICML 2026. Project page available at https://sphericaldreamer.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19966 2026-05-20 cs.LG cs.AI

Detecting Fluent Optimization-Based Adversarial Prompts via Sequential Entropy Changes

通过顺序熵变化检测基于优化的对抗性提示

Mohammed Alshaalan, Miguel R. D. Rodrigues

机构 * Department of Electronic and Electrical Engineering, University College London, London, United Kingdom(电子与电气工程系,伦敦大学学院,伦敦,英国)

AI总结 本文提出了一种基于在线变化点检测的对抗性后缀检测方法CPD,通过标准化用户令牌熵并应用单侧CUSUM统计量,提高了对优化基于对抗性提示的检测性能,同时在多个大型语言模型上实现了更高的F1分数和AUC性能。

Comments Accepted at ICML 2026; 20 pages, including 9 pages main text, references, and appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19956 2026-05-20 cs.CV

Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models

迈向细粒度鲁棒性:面向视觉-语言模型的注意力引导测试时提示调优

Jia-Wei Hai, Yijun Wang, Xiu-Shen Wei

机构 * School of Computer Science and Engineering(计算机科学与工程学院) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications(新一代人工智能技术及其交叉应用重点实验室) Southeast University(东南大学) School of Intelligence Science and Engineering(智能科学与工程学院)

AI总结 本文提出了一种注意力引导的测试时提示调优方法(A-TPT),旨在解决视觉-语言模型在对抗攻击下的鲁棒性问题,通过改进的梯度注意力机制和空间变化的增强强度来提升模型在细粒度场景下的表现。

Comments Accepted by ICML 2026, Project Page: this https, URL Code URL: this https URL

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19779 2026-05-20 cs.AI cs.LG

Distribution-Free Uncertainty Quantification for Continuous AI Agent Evaluation

无分布不确定性量化用于连续AI代理评估

Yuxuan Gao, Megan Wang, Yi Ling Yu

机构 * University of Pennsylvania(宾夕法尼亚大学) Columbia University(哥伦比亚大学)

AI总结 本文提出了一种无分布的不确定性量化方法,用于连续AI代理评估,通过适应性符合推断(ACI)提供预测质量分数的覆盖保证,并开发了多代理管道的组合不确定性界限、成对排名的符合回避规则以及领奖台规模多重检验的FDR校正回避方法。

Comments 6 pages, 7 figures, 2 tables. Accepted at the ICML 2026 Workshop on Agentic Uncertainty Quantification (AgenticUQ) - Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17471 2026-05-20 cs.LG cs.NA math.NA math.OC

WinQ: Accelerating Quantization-Aware Training of Language Models Around Saddle Points

WinQ: 加速围绕鞍点的语言模型量化感知训练

Dongyue Li, Zechun Liu, Kai Yi, Zhenshuo Zhang, Changsheng Zhao, Raghuraman Krishnamoorthi, Harshit Khaitan, Hongyang R. Zhang, Steven Li

机构 * Northeastern University, MA(东北大学) Meta AI, CA(Meta AI)

AI总结 本文研究了量化感知训练(QAT)在低比特宽度下的收敛问题,提出WinQ算法通过重置权重和噪声注入梯度来加速训练并提升性能。

Comments 23 pages; To appear in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16447 2026-05-20 cs.LG cs.AI

Nested Spatio-Temporal Time Series Forecasting

嵌套时空时间序列预测

Yinghao Ai, Yukai Zhou, Ruoxi Jiang, Junyi An, Chao Qu, Zhijian Zhou, Shiyu Wang, Fenglei Cao, Zenglin Xu, Furao Shen, Yuan Qi

机构 * Fudan University, Shanghai(复旦大学) Department of Computer Science and Technology, Nanjing University(南京大学计算机科学与技术系) ByteDance(字节跳动)

AI总结 本文提出了一种嵌套预测框架,通过结合未来宏观区域趋势与微观历史观测,实现了精细化预测,并通过谱聚类方法构建语义连贯的区域,有效过滤系统性噪声并保留关键趋势,实验表明该方法在多个高维数据集上优于现有最先进基线。

Comments Accept by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16137 2026-05-20 cs.CV cs.RO

STABLE: Simulation-Ready Tabletop Layout Generation via a Semantics-Physics Dual System

STABLE: 通过语义-物理双系统生成仿真准备的桌面布局

Zhen Luo, Yixuan Yang, Xudong Xu, Jinkun Hao, Zhaoyang Lyu, Feng Zheng, Jiangmiao Pang, Yanwei Fu

机构 * Shanghai AI Laboratory(上海人工智能实验室)

AI总结 本文提出STABLE,一种通过语义-物理双系统生成仿真准备的桌面布局的方法,通过语义推理模块生成粗略布局,物理校正模块校正布局以确保物理合理性,从而提升场景的物理有效性。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17305 2026-05-20 cs.AI cs.CL cs.LG

Contrastive Reasoning Alignment: Reinforcement Learning from Hidden Representations

对比推理对齐:从隐藏表示中学习强化学习

Haozheng Luo, Yimin Wang, Jiahao Yu, Binghui Wang, Yan Chen

机构 * Northwestern University(西北大学) University of Michigan(密歇根大学) Illinois Institute of Technology(伊利诺伊理工学院)

AI总结 本文提出了一种基于对比学习和强化学习的框架CRAFT,通过优化隐藏状态空间中的目标来提升对抗攻击的鲁棒性,核心贡献是通过隐藏空间的几何结构实现推理层面的安全对齐。

Comments International Conference on Machine Learning (ICML) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18718 2026-05-20 stat.ML cs.LG math.OC stat.CO

Stochastic Gradient Variational Inference with Price's Gradient Estimator from Bures-Wasserstein to Parameter Space

基于Bures-沃斯特斯坦空间到参数空间的随机梯度变分推断与Price梯度估计

Kyurae Kim, Qiang Fu, Yi-An Ma, Jacob R. Gardner, Trevor Campbell

机构 * University of Pennsylvania(宾夕法尼亚大学) Yale University(耶鲁大学) University of British Columbia(不列颠哥伦比亚大学) University of California San Diego(加州大学圣地亚哥分校)

AI总结 本文研究了在仅给定目标分布无规范化的对数密度时,利用随机梯度的变分推断方法。通过比较Wasserstein VI和Black-Box VI,发现WVI在使用Price梯度估计时具有更优的收敛性,本文进一步证明两者在迭代复杂度上可以达到一致的最优结果。

Comments Accepted to ICML'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14778 2026-05-20 cs.CL cs.AI cs.CY

A Geometric Analysis of Small-sized Language Model Hallucinations

小尺寸语言模型幻觉的几何分析

Emanuele Ricco, Elia Onofri, Lorenzo Cima, Stefano Cresci, Roberto Di Pietro

机构 * Engineering (CEMSE) division, King Abdullah University of Science and Technology (KAUST)(卡塔尔科技大学工程学院(CEMSE)) Istituto di Informatica e Telematica (IIT), National Research Council of Italy (CNR)(意大利国家研究理事会信息与电信研究所(IIT)) Department of Information Engineering, University of Pisa(比萨大学信息工程系)

AI总结 本文从几何角度分析小尺寸语言模型幻觉问题,提出APORIA框架,通过句子嵌入空间研究重复提示下的响应,发现真实响应比幻觉响应更紧密聚类,并通过APORIA-LP方法实现高效分类,同时发布SOCRATES-300K数据集以支持进一步研究。

Comments 30 pages, 12 figures, 14 tables, accepted as regular paper at ICML'26

详情

展开后加载摘要…

URL PDF HTML 收藏