arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

EPFL(洛桑联邦理工学院)

2026-06-23 至 2026-06-23 共收录 7
2605.25859 2026-06-23 math.ST cs.LG stat.TH 版本更新

Minimax Limits of k-Fold Cross-Validation via Majority

k折交叉验证的极小极大极限:多数投票算法

Ido Nachum, Rüdiger Urbanke, Thomas Weinberger

机构 * University of Haifa(海法大学) EPFL(苏黎世联邦理工学院)

AI总结 本文通过分析二元分类中多数投票算法的交叉验证均方误差,揭示了k折交叉验证的极小极大极限,证明当折数k随样本数n增长时,任何经验风险最小化算法的均方误差下界为Ω(√k/n)。

Comments arXiv admin note: substantial text overlap with arXiv:2511.03554

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11248 2026-06-23 cs.NE cs.AI cs.MA 版本更新

Evolving Many Worlds: Towards Open-Ended Discovery in Petri Dish NCA via Population-Based Training

演化多重世界:通过基于种群的训练在 Petri 培养皿 NCA 中实现开放式发现

Uljad Berdica, Jakob Foerster, Frank Hutter, Arber Zela

机构 * FLAIR, University of Oxford(奥克斯大学FLAIR实验室) ELLIS Institute Tübingen(图宾根ELLIS研究所) University of Freiburg(弗赖堡大学) Prior Labs(Prior实验室) EPFL(瑞士联邦理工学院洛桑分校)

AI总结 提出 PBT-NCA 元进化算法,通过复合目标(历史行为新颖性与当代视觉多样性)演化 Petri 培养皿神经细胞自动机种群,自发产生持续涌现的生命现象,实现开放式演化。

Comments 10 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17655 2026-06-23 cs.CL 版本更新

What Language is This? Ask Your Tokenizer

这是什么语言?问你的分词器

Clara Meister, Ahmetcan Yavuz, Pietro Lesci, Tiago Pimentel

机构 * EPFL(苏黎世联邦理工学院) University of Cambridge(剑桥大学)

AI总结 提出基于UnigramLM分词算法的UniLID方法,通过比较字符串在各语言单字分布下的似然进行语言识别,在低资源和细粒度方言场景下显著提升样本效率。

Comments In Proceedings of ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19756 2026-06-23 cs.LG stat.ML 版本更新

Provable Learning of Random Hierarchy Models and Hierarchical Shallow-to-Deep Chaining

随机层次模型与层次化浅到深链的可证明学习

Yunwei Ren, Yatin Dandi, Florent Krzakala, Jason D. Lee

机构 * Princeton University(普林斯顿大学) École Polytechnique Fédérale de Lausanne(瑞士联邦理工学院洛桑分校) University of California, Berkeley(加州大学伯克利分校)

AI总结 针对深度网络能否高效利用层次结构的问题,证明在温和条件下深度卷积网络可高效学习随机层次模型,并提出逐层训练策略。

Comments COLT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00918 2026-06-23 cs.AI 版本更新

Sparse Neuron Ablation Triggers Catastrophic Collapse of the Language Core in Large Vision-Language Models

稀疏神经元消融引发大型视觉-语言模型中语言核心的灾难性崩溃

Cen Lu, Yung-Chen Tang, Andrea Cavallaro

机构 * École Polytechnique Fédérale de Lausanne (EPFL)(瑞士洛桑联邦理工学院) Idiap Research Institute(日内瓦研究所)

AI总结 提出渐进式神经元消融方法CAN,发现消融极少量(如LLaVA-1.5-7b中仅4个)位于语言模型下投影层的神经元即可导致LVLM灾难性崩溃,揭示功能依赖语言骨干中的稀疏神经元子集。

Comments Accepted to ICML 2026 Mechanistic Interpretability Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10178 2026-06-23 cs.LG cs.AI cs.IT math.IT 版本更新

From Markov to Laplace: How Mamba In-Context Learns Markov Chains

从马尔可夫到拉普拉斯:Mamba如何通过上下文学习马尔可夫链

Marco Bondaschi, Nived Rajaraman, Xiuying Wei, Kannan Ramchandran, Razvan Pascanu, Caglar Gulcehre, Michael Gastpar, Ashok Vardhan Makkuva

机构 * EPFL(苏黎世联邦理工学院) UC Berkeley(加州大学伯克利分校) Google DeepMind(谷歌DeepMind) Télécom Paris(巴黎电信学院)

AI总结 本文研究Mamba在马尔可夫链上的上下文学习能力,发现单层Mamba能高效学习最优的拉普拉斯平滑估计器,并理论上揭示了卷积在其中的关键作用。

Comments Oral presentation at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08086 2026-06-23 cs.AI cs.SC 版本更新

A Neural Operator-Based Approach to Symbolic Discovery of PDEs

基于神经算子的偏微分方程符号发现方法

Sergei Garmaev, Olga Fink

机构 * Intelligent Maintenance and Operations Systems Laboratory, EPFL(智能维护与操作系统实验室,瑞士联邦理工学院)

AI总结 提出NOMTO框架,通过将预训练神经算子作为符号网络节点,扩展了Equation Learner架构,能够从数据中发现包含非局部算子、辅助场耦合或记忆效应的偏微分方程。

详情

展开后加载摘要…

URL PDF HTML 收藏