arXivDaily arXiv每日学术速递 周一至周五更新

作者

Yoshua Bengio

Machine Learning

共收录 642
2608.11181 2026-08-12 cs.CC cs.AI cs.LG 新提交

How to Verify Consistency of Probabilistic Claims

如何验证概率断言的一致性

Orr Paradise, Oliver Richardson, Yoshua Bengio, Shafi Goldwasser

AI总结 该研究针对概率预测器答案的自洽性验证问题,基于Nilsson的工作构造交互式PCP,为概率预测器自洽性证明提供复杂性理论基础,是训练模型证明自身一致性的第一步。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09617 2026-08-12 cs.LG 版本更新

Bayesian Symbolic Regression with Entropic Reinforcement Learning

基于熵强化学习的贝叶斯符号回归

Oussama Boussif, Mohammed Mahfoud, Younesse Kaddar, Moksh Jain, Sida Li, Damiano Fornasiere, Xiaoyin Chen, Yoshua Bengio, Esmeralda S. Whitammer

AI总结 本研究提出ERRLESS方法,将最大熵强化学习与贝叶斯视角结合用于符号回归,在Feynman基准上表现具有竞争力,生成的表达式简短可解释,且后验预测均值的R²优于SMC基线。

Comments UAI 2026. Code available at https://github.com/jaggbow/ERRLESS

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07514 2026-08-11 cs.CY 新提交

Open Technical Problems in Open-Weight AI Model Risk Management

开放权重AI模型风险管理中的开放技术问题

Stephen Casper, Kyle O'Brien, Shayne Longpre, Elizabeth Seger, Kevin Klyman, Rishi Bommasani, Aniruddha Nrusimha, Ilia Shumailov, Sören Mindermann, Steven Basart, Frank Rudzicz, Kellin Pelrine, Avijit Ghosh, Andrew Strait, Robert Kirk, Dan Hendrycks, Peter Henderson, Zico Kolter, Geoffrey Irving, Yarin Gal, Yoshua Bengio, Dylan Hadfield-Menell

AI总结 本文指出开放权重AI模型风险管理存在16项涉及多环节的技术挑战,强调相关研究需兼顾开放性,以实现其益处并减轻危害。

Comments Published in Transactions on Machine Learning Research (03/2026) Reviewed on OpenReview: https: // openreview. net/ forum? id= 8QyGLnFkzc

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29657 2026-07-14 cs.AI cs.LG 版本更新

Safety from Honesty in a Disinterested AI Predictor

无兴趣AI预测器中的诚实安全性

Yoshua Bengio, Oliver Richardson, Tomáš Gavenčiak, Michael Cohen, Rory Svarc, Damiano Fornasiere, Gael Gendron, David Hyland, Aton Kamanda, Adam Oberman, Francis Rhys Ward, Anna Gavenčiak, Jacob Livingston Slosser, Vincent Mai, Iulian Serban, Joumana Ghosn

机构 * LawZero Université de Montréal(蒙特利尔大学) Mila University of California Berkeley(加州大学伯克利分校) McGill University(麦吉尔大学) Arb Research Center for Theoretical Study Charles University in Prague(布拉格查理大学理论研究中心) University of Oxford(牛津大学) Sapien Institute(Sapien研究所)

AI总结 提出一种形式化安全论证,通过数据表示和训练过程确保预测器诚实预测而不成为追求目标的智能体,并证明危险预测器出现的概率可控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25741 2026-07-03 cs.CL 版本更新

Scaling Latent Reasoning via Looped Language Models

通过循环语言模型扩展潜在推理

Rui-Jie Zhu, Zixuan Wang, Kai Hua, Tianyu Zhang, Ziniu Li, Haoran Que, Boyi Wei, Zixin Wen, Fan Yin, He Xing, Lu Li, Jiajun Shi, Kaijing Ma, Shanda Li, Taylor Kergan, Andrew Smith, Xingwei Qu, Mude Hui, Bohong Wu, Qiyang Min, Hongzhi Huang, Xun Zhou, Wei Ye, Jiaheng Liu, Jian Yang, Yunfeng Shi, Chenghua Lin, Enduo Zhao, Tianle Cai, Ge Zhang, Wenhao Huang, Yoshua Bengio, Jason Eshraghian

AI总结 提出Ouro系列循环语言模型,通过在潜在空间迭代计算、熵正则化深度分配和扩展至7.7T令牌,实现优于更大模型的推理性能,并展示其知识操控能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27361 2026-06-26 cs.LG cs.AI 新提交

Autoregressive Boltzmann Generators

自回归玻尔兹曼生成器

Danyal Rehman, Charlie B. Tan, Yoshua Bengio, Avishek Joey Bose, Alexander Tong

AI总结 提出自回归玻尔兹曼生成器(ArBG),通过自回归建模替代基于流的模型,克服拓扑约束并提升可扩展性,在分子系统采样中显著优于现有方法,并在8残基系统上将零样本能量误差降低60%以上。

Comments ICML 2026 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11063 2026-06-10 cs.AI cs.LG 新提交

CIAware-Bench: Benchmarking Control Intervention Awareness Across Frontier LLMs

CIAware-Bench: 评估前沿大语言模型的控制干预感知能力

Joachim Schaeffer, Thomas Jiralerspong, Alexander Panfilov, Guillaume Lajoie, Jonas Geiping, Yoshua Bengio, Roland S. Zimmermann

机构 * MATS Mila – Quebec AI Institute(Mila – 魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) Astra Fellowship ELLIS Institute Tübingen, MPI for Intelligent Systems & Tübingen AI Center LawZero Google DeepMind(谷歌DeepMind)

AI总结 提出CIAware-Bench基准,通过四个任务域测试模型能否区分自身轨迹与被控制干预修改的轨迹,发现前沿模型在默认设置下感知能力低至中等,且因任务和模型对而异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04119 2026-06-10 cs.LG q-bio.QM 版本更新

Synthesizable Molecular Generation via Soft-constrained GFlowNets with Rich Chemical Priors

通过具有丰富化学先验的软约束GFlowNets生成可合成分子

Hyeonah Kim, Minsu Kim, Celine Roget, Dionessa Biton, Louis Vaillancourt, Yves V. Brun, Yoshua Bengio, Alex Hernandez-Garcia

机构 * University of Toronto(多伦多大学) DeepMind(深度思维) University of Montreal(蒙特利尔大学)

AI总结 提出S3-GFN方法,通过软正则化序列GFlowNet,利用大规模SMILES语料库的化学先验,生成高奖励且可合成的分子,实验表明可合成率≥95%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08235 2026-06-09 cs.CL cs.AI cs.CR 版本更新

When Benign Inputs Lead to Severe Harms: Eliciting Unsafe Unintended Behaviors of Computer-Use Agents

当良性输入导致严重危害:引发计算机使用代理的不安全意外行为

Jaylen Jones, Zhehao Zhang, Yuting Ning, Eric Fosler-Lussier, Pierre-Luc St-Charles, Yoshua Bengio, Dawn Song, Yu Su, Huan Sun

机构 * DeepMind, London, UK(深度Mind,伦敦,英国) Stanford University, Stanford, CA, USA(斯坦福大学,斯坦福,加利福尼亚州,美国) UC Berkeley, Berkeley, CA, USA(加州大学伯克利分校,伯克利,加利福尼亚州,美国)

AI总结 提出AutoElicit框架,通过迭代扰动良性指令并利用CUA执行反馈,自动引发前沿CUAs(如Claude 4.5 Haiku等)的数百种有害意外行为,并验证其跨模型可迁移性。

Comments ICML 2026, Project Homepage: https://osu-nlp-group.github.io/AutoElicit/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17837 2026-06-05 eess.AS cs.CL

The Silent Thought: Modeling Internal Cognition in Full-Duplex Spoken Dialogue Models via Latent Reasoning

沉默的思维:通过潜在推理建模全双工语音对话模型中的内部认知

Donghang Wu, Tianyu Zhang, Yuxin Li, Hexin Liu, Chen Chen, Eng Siong Chng, Yoshua Bengio

机构 * DeepMind(深度Mind)

AI总结 本文提出了一种名为FLAIR的全双工语音对话模型,通过潜在推理同时进行语音感知和内部思考,以提高对话质量,该方法在多个语音基准测试中取得了竞争性的结果。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
1502.04390 2026-06-04 cs.LG cs.NA math.NA

Equilibrated adaptive learning rates for non-convex optimization

非凸优化中的平衡自适应学习率

Yann N. Dauphin, Harm de Vries, Yoshua Bengio

AI总结 本文提出ESGD算法,通过平衡预条件器改进非凸优化中的自适应学习率,实验显示其收敛速度优于RMSProp。

详情

展开后加载摘要…

URL PDF HTML 收藏
1301.3584 2026-06-03 cs.LG cs.NA math.NA

Revisiting Natural Gradient for Deep Networks

重新审视深度网络的自然梯度

Razvan Pascanu, Yoshua Bengio

AI总结 本文重新评估了自然梯度算法在深度模型学习中的应用,揭示了其与Hessian-Free、Krylov子空间下降和TONGA方法的联系,并提出了利用无标签数据改进泛化误差、评估对训练集顺序的鲁棒性以及结合二阶信息的扩展算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00295 2026-06-02 cs.LG

Adaptive Order Policies for Masked Diffusion

掩码扩散的自适应顺序策略

Jama Hussein Mohamud, Mohsin Hasan, Mirco Ravanelli, Yoshua Bengio

机构 * Université de Montréal(蒙特利尔大学) Mila Concordia University(康科迪亚大学) LawZero

AI总结 提出一种通过轻量级策略网络学习掩码扩散模型中解掩码顺序的方法,使用加权损失训练,在组合任务和蛋白质等对顺序敏感的问题上优于常见启发式方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27272 2026-05-29 cs.CL cs.AI cs.LG

When 2D Tasks Meet 1D Serialization: On Serialization Friction in Structured Tasks

当2D任务遇到1D序列化:结构化任务中的序列化摩擦

Chung-Hsiang Lo, Lu Li, Diji Yang, Tianyu Zhang, Yunkai Zhang, Yoshua Bengio, Yi Zhang

机构 * Northeastern University(东北大学) University of Pennsylvania(宾夕法尼亚大学) UC Santa Cruz(加州大学圣克鲁兹分校) Mila - Quebec AI Institute(魁北克人工智能研究所) University of Montreal(蒙特利尔大学) BAIR, UC Berkeley(伯克利大学BAIR实验室)

AI总结 研究通过矩阵转置、康威生命游戏和LU分解三个任务,发现将二维布局任务序列化为一维文本会因表示不匹配导致性能下降,且错误呈现空间结构模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19376 2026-05-21 cs.AI

Generative Recursive Reasoning

生成性递归推理

Junyeob Baek, Mingyu Jo, Minsu Kim, Mengye Ren, Yoshua Bengio, Sungjin Ahn

机构 * KAIST(韩国科学技术院) Mila – Québec AI Institute(魁北克人工智能研究所) New York University(纽约大学) Université de Montréal(蒙特利尔大学)

AI总结 本文提出Gram框架,通过将递归潜在推理转化为概率多轨迹计算,解决了传统递归推理模型的确定性问题,实现了条件推理和无条件生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21523 2026-05-19 cs.LG stat.ML

Interpretable epistemic uncertainty decomposition in sequential generative models via polynomial chaos surrogates

通过多项式混沌代理实现序列生成模型中可解释的epistemic不确定性分解

Ramón Nartallo-Kaluarachchi, Shashanka Ubaru, Małgorzata J Zimoń, Dongsung Huh, Robert Manson-Sawko, Lior Horesh, Yoshua Bengio

机构 * Mathematical Institute, University of Oxford, United Kingdom(牛津大学数学研究所,英国) IBM Research, Thomas J. Watson Research Center, USA(IBM研究院,托马斯·J·沃森研究中心,美国) IBM Research Europe, Daresbury, United Kingdom(IBM欧洲研究院,达尔斯伯里,英国) MIT–IBM Watson AI Lab, Massachusetts, USA(麻省理工–IBM沃森人工智能实验室,马萨诸塞州,美国) Université de Montréal, Mila–Quebec AI Institute, Montreal, Quebec, Canada(蒙特利尔大学,魁北克人工智能研究所,蒙特利尔,魁北克,加拿大)

AI总结 本文提出通过多项式混沌展开分析序列生成模型中epistemic不确定性的来源,揭示奖励组件对生成决策的影响,优于深度集合、贝叶斯神经网络等方法,且在多个真实任务中展现高效性和鲁棒性。

Comments 37 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17465 2026-05-04 cs.AI

Language models recognize dropout and Gaussian noise applied to their activations

语言模型能够识别应用于其激活上的dropout和高斯噪声

Damiano Fornasiere, Mirko Bronzi, Spencer Kitts, Alessandro Palmas, Yoshua Bengio, Oliver Richardson

机构 * LawZero

AI总结 研究发现语言模型能检测并区分激活上的dropout和高斯噪声,通过多选问题测试不同模型的识别能力,结果表明模型能准确识别扰动类型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17140 2026-04-21 cs.AI cs.LG

Local Inconsistency Resolution: The Interplay between Attention and Control in Probabilistic Models

局部不一致性解决:概率模型中注意与控制的相互作用

Oliver E. Richardson, Mandana Samiei, Mehran Shakerinava, Joseph D. Viviano, Abdessamad El Kabid, Ali Parviz, Yoshua Bengio

机构 * Université de Montréal(蒙特利尔大学) School of Computer Science, McGill University(麦吉尔大学计算机科学学院) Institut Polytechnique de Paris(巴黎政治学院) LawZero(法零) Mila - Quebec Artificial Intelligence Institute(魁北克人工智能研究所)

AI总结 本文提出一种通用算法,通过迭代聚焦子集模型并利用可控参数解决不一致性,统一了EM算法、信念传播等重要算法,改进了GFlowNet收敛性。

Comments 9 page body,

Journal ref Proceedings of the The 29th International Conference on Artificial Intelligence and Statistics, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05181 2026-04-08 cs.LG

General Multimodal Protein Design Enables DNA-Encoding of Chemistry

通用多模态蛋白质设计使化学编码成为可能

Jarrid Rector-Brooks, Théophile Lambert, Marta Skreta, Daniel Roth, Yueming Long, Zi-Qi Li, Xi Zhang, Miruna Cretu, Francesca-Zhoufan Li, Tanvi Ganapathy, Emily Jin, Avishek Joey Bose, Jason Yang, Kirill Neklyudov, Yoshua Bengio, Alexander Tong, Frances H. Arnold, Cheng-Hao Liu

机构 * California Institute of Technology(加州理工学院) Mila – Québec AI Institute(Mila – 魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) Université Paris-Saclay(巴黎-萨克雷大学) McGill University(麦吉尔大学) University of Cambridge(剑桥大学) University of Oxford(牛津大学) Imperial College London(伦敦帝国理工学院) Institut Courtois(库尔图瓦研究所) LawZero AITHYRA FutureHouse

AI总结 DISCO模型通过多模态设计实现蛋白质序列和三维结构的协同优化,能够设计出新型血红素酶,催化新的化学反应,拓展了遗传编码转化的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01207 2026-04-06 cs.LG cs.AI stat.ME

Efficient Causal Graph Discovery Using Large Language Models

利用大语言模型高效发现因果图

Thomas Jiralerspong, Xiaoyin Chen, Yash More, Vedant Shah, Yoshua Bengio

机构 * Mila, Université de Montréal(蒙特利尔大学Mila研究所) Mila, McGill University(麦吉尔大学Mila研究所)

AI总结 本文提出一种利用大语言模型进行完整因果图发现的新框架,通过广度优先搜索方法提高效率,并展示其在不同规模真实因果图上的最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28012 2026-03-31 cond-mat.mtrl-sci

A Comparative Study of Molecular Dynamics Approaches for Simulating Ionic Conductivity in Solid Lithium Electrolytes

分子动力学方法在模拟固态锂电解质离子导电性中的比较研究

Dounia Shaaban Kabakibo, Félix Therrien, Yoshua Bengio, Michel Côté, Hongyu Guo, Homin Shin, Alex Hernandez-Garcia

AI总结 本文比较了密度泛函理论和通用机器学习互原子势在模拟21种固态锂电解质离子导电性中的性能,发现两者表现相当,尽管MACE在GPU上比DFT快350倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14594 2026-03-23 cs.LG

torchgfn: A PyTorch GFlowNet library

torchgfn:一个PyTorch GFlowNet库

Joseph D. Viviano, Omar G. Younis, Sanghyeok Choi, Victor Schmidt, Yoshua Bengio, Salem Lahlou

机构 * MBZUAI(穆罕默德·本·拉希德智能研究院)

AI总结 本文提出torchgfn库,通过模块化架构实现环境、神经网络模块和训练目标的可替换性,简化了GFlowNet的研究与实验流程。

Comments 15 pages, 3 figures, 3 tables. Submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16928 2026-03-19 cs.CR cs.LG

Noticing the Watcher: LLM Agents Can Infer CoT Monitoring from Blocking Feedback

察觉观察者:LLM代理可通过阻塞反馈推断CoT监控

Thomas Jiralerspong, Flemming Kondrup, Yoshua Bengio

机构 * Mila Université de Montréal(蒙特利尔大学) McGill University(麦吉尔大学) LawZero

AI总结 研究探讨LLM代理是否能自主推断其内部推理被监控,并在无显式训练的情况下产生逃避策略,发现高能力模型能通过阻塞反馈推断监控存在,但无法有效执行逃避意图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21852 2026-03-19 cs.LG cs.AI

A Comedy of Estimators: On KL Regularization in RL Training of LLMs

估计器的喜剧:关于在LLM训练中的KL正则化

Vedant Shah, Johan Obando-Ceron, Vineet Jain, Brian Bartoldson, Bhavya Kailkhura, Sarthak Mittal, Glen Berseth, Pablo Samuel Castro, Yoshua Bengio, Nikolay Malkin, Moksh Jain, Siddarth Venkatraman, Aaron Courville

机构 * McGill University(麦吉尔大学) LawZero(法零) LLNL(劳伦斯利弗莫尔国家实验室) University of Edinburgh(爱丁堡大学) CIFAR AI Chair(CIFAR人工智能主席) CIFAR Fellow

AI总结 本文研究了在LLM训练中使用KL正则化的估计器方法,分析了不同配置对训练稳定性及下游性能的影响,发现偏导数估计器可能导致训练不稳定,而无偏导数估计器能提升模型在领域内外任务的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.04925 2026-03-05 cs.LG

Crystal-GFN: sampling crystals with desirable properties and constraints

Crystal-GFN: 生成具有理想性质和约束条件的晶体

Mila AI4Science, :, Alex Hernandez-Garcia, Alexandre Duval, Alexandra Volokhova, Yoshua Bengio, Divya Sharma, Pierre Luc Carrier, Yasmine Benabed, Michał Koziarski, Victor Schmidt, Gian-Marco Rignanese, Pierre-Paul De Breuck, Paulette Clancy

机构 * Mila AI4Science Université de Montréal(蒙特利尔大学) CentraleSupélec, Université Paris-Saclay(中央圣艾修伯里学院,巴黎萨克莱大学) Johns Hopkins University(约翰霍普金斯大学) UCLouvain(布鲁塞尔自由大学)

AI总结 Crystal-GFN是一种生成具有理想性质和约束条件的晶体结构模型,通过多环境连续-离散GFlowNet高效发现多样且有效的晶体。

Comments This is the version of the manuscript submitted (though not accepted) to ICML 2024 in February 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21012 2026-02-25 cs.CY

International AI Safety Report 2026

2026国际人工智能安全报告

Yoshua Bengio, Stephen Clare, Carina Prunkl, Maksym Andriushchenko, Ben Bucknall, Malcolm Murray, Rishi Bommasani, Stephen Casper, Tom Davidson, Raymond Douglas, David Duvenaud, Philip Fox, Usman Gohar, Rose Hadshar, Anson Ho, Tiancheng Hu, Cameron Jones, Sayash Kapoor, Atoosa Kasirzadeh, Sam Manning, Nestor Maslej, Vasilios Mavroudis, Conor McGlynn, Richard Moulange, Jessica Newman, Kwan Yee Ng, Patricia Paskov, Shalaleh Rismani, Girish Sastry, Elizabeth Seger, Scott Singer, Charlotte Stix, Lucia Velasco, Nicole Wheeler, Daron Acemoglu, Vincent Conitzer, Thomas G. Dietterich, Fredrik Heintz, Geoffrey Hinton, Nick Jennings, Susan Leavy, Teresa Ludermir, Vidushi Marda, Helen Margetts, John McDermid, Jane Munga, Arvind Narayanan, Alondra Nelson, Clara Neppel, Sarvapali D. Ramchurn, Stuart Russell, Marietje Schaake, Bernhard Schölkopf, Alvaro Soto, Lee Tiedrich, Gaël Varoquaux, Andrew Yao, Ya-Qin Zhang, Leandro Angelo Aguirre, Olubunmi Ajala, Fahad Albalawi, Noora AlMalek, Christian Busch, Jonathan Collas, André Carlos Ponce de Leon Ferreira de Carvalho, Amandeep Gill, Ahmet Halit Hatip, Juha Heikkilä, Chris Johnson, Gill Jolly, Ziv Katzir, Mary N. Kerema, Hiroaki Kitano, Antonio Krüger, Kyoung Mu Lee, José Ramón López Portillo, Aoife McLysaght, Oleksii Molchanovskyi, Andrea Monti, Mona Nemer, Nuria Oliver, Raquel Pezoa, Audrey Plonk, Balaraman Ravindran, Hammam Riza, Crystal Rugege, Haroon Sheikh, Denise Wong, Yi Zeng, Liming Zhu, Daniel Privitera, Sören Mindermann

AI总结 2026国际人工智能安全报告由全球29国及国际组织共同参与,汇集超过100位专家意见,全面评估通用人工智能系统的安全性和潜在风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26626 2026-02-25 cs.LG

Recursive Self-Aggregation Unlocks Deep Thinking in Large Language Models

递归自聚合解锁大语言模型的深度思考

Siddarth Venkatraman, Vineet Jain, Sarthak Mittal, Vedant Shah, Johan Obando-Ceron, Yoshua Bengio, Brian R. Bartoldson, Bhavya Kailkhura, Guillaume Lajoie, Glen Berseth, Nikolay Malkin, Moksh Jain

机构 * Mila – Québec AI Institute(魁北克AI研究所) Université de Montréal(蒙特利尔大学) McGill University(麦吉尔大学) LawZero(法零) LLNL(劳伦斯利弗莫尔国家实验室) University of Edinburgh(爱丁堡大学) CIFAR AI Chair(CIFAR人工智能 chair) CIFAR Fellow

AI总结 递归自聚合通过结合并行与顺序缩放方法,提升大语言模型的推理能力,实验证明其在多个任务中优于传统方法。

Comments 23 pages, 10 figures. Project page: https://rsa-llm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11824 2026-02-18 cs.LG cs.AI

Latent Veracity Inference for Identifying Errors in Stepwise Reasoning

潜在真实性推断用于识别逐步推理中的错误

Minsu Kim, Jean-Pierre Falet, Oliver E. Richardson, Xiaoyin Chen, Moksh Jain, Sungjin Ahn, Sungsoo Ahn, Yoshua Bengio

机构 * Mila – Québec AI Institute(魁北克人工智能研究所) KAIST(韩国科学技术院) Université de Montréal(蒙特利尔大学) LawZero(法零)

AI总结 本文提出通过引入潜在真实性变量和Veracity Search算法,提升语言模型在逐步推理中的准确性和可信度,并通过Amortized Veracity Inference实现零样本真实性推断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11699 2026-02-10 cs.CY

Frontier AI Auditing: Toward Rigorous Third-Party Assessment of Safety and Security Practices at Leading AI Companies

前沿AI审计:迈向对领先AI公司安全与安全实践的严格第三方评估

Miles Brundage, Noemi Dreksler, Aidan Homewood, Sean McGregor, Patricia Paskov, Conrad Stosz, Girish Sastry, A. Feder Cooper, George Balston, Steven Adler, Stephen Casper, Markus Anderljung, Grace Werner, Soren Mindermann, Vasilios Mavroudis, Ben Bucknall, Charlotte Stix, Jonas Freund, Lorenzo Pacchiardi, Jose Hernandez-Orallo, Matteo Pistillo, Michael Chen, Chris Painter, Dean W. Ball, Cullen O'Keefe, Gabriel Weil, Ben Harack, Graeme Finley, Ryan Hassan, Scott Emmons, Charles Foster, Anka Reuel, Bri Treece, Yoshua Bengio, Daniel Reti, Rishi Bommasani, Cristian Trout, Ali Shahin Shamsabadi, Rajiv Dattani, Adrian Weller, Robert Trager, Jaime Sevilla, Lauren Wagner, Lisa Soder, Ketan Ramakrishnan, Henry Papadatos, Malcolm Murray, Ryan Tovcimak

AI总结 本文提出前沿AI审计的愿景,通过四个AI保证级别提升安全与安全实践的评估标准,推动行业高质量审计生态建设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06323 2026-02-06 cond-mat.mtrl-sci cs.LG

A physics-based data-driven model for CO$_2$ gas diffusion electrodes to drive automated laboratories

基于物理的数据驱动模型用于二氧化碳气体扩散电极,以驱动自动化实验室

Ivan Grega, Félix Therrien, Abhishek Soni, Karry Ocean, Kevan Dettelbach, Ribwar Ahmadi, Mehrdad Mokhtari, Curtis P. Berlinguette, Yoshua Bengio

机构 * Mila - Quebec AI Institute(魁北克AI研究所) University of British Columbia(不列颠哥伦比亚大学) Université de Montréal(蒙特利尔大学)

AI总结 本文提出了一种基于物理的数据驱动模型,用于优化二氧化碳气体扩散电极的参数空间,以提高其效率并推动自动化实验室的发展。

Comments 7 pages, 5 figures. Published as a conference paper in ICLR2025 AI4Mat workshop

详情

展开后加载摘要…

URL PDF HTML 收藏