arXivDaily arXiv每日学术速递 周一至周五更新

作者

Yoshua Bengio

Machine Learning

2026-06-10 至 2026-06-10 共收录 2
2606.11063 2026-06-10 cs.AI cs.LG 新提交

CIAware-Bench: Benchmarking Control Intervention Awareness Across Frontier LLMs

CIAware-Bench: 评估前沿大语言模型的控制干预感知能力

Joachim Schaeffer, Thomas Jiralerspong, Alexander Panfilov, Guillaume Lajoie, Jonas Geiping, Yoshua Bengio, Roland S. Zimmermann

机构 * MATS Mila – Quebec AI Institute(Mila – 魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) Astra Fellowship ELLIS Institute Tübingen, MPI for Intelligent Systems & Tübingen AI Center LawZero Google DeepMind(谷歌DeepMind)

AI总结 提出CIAware-Bench基准,通过四个任务域测试模型能否区分自身轨迹与被控制干预修改的轨迹,发现前沿模型在默认设置下感知能力低至中等,且因任务和模型对而异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04119 2026-06-10 cs.LG q-bio.QM 版本更新

Synthesizable Molecular Generation via Soft-constrained GFlowNets with Rich Chemical Priors

通过具有丰富化学先验的软约束GFlowNets生成可合成分子

Hyeonah Kim, Minsu Kim, Celine Roget, Dionessa Biton, Louis Vaillancourt, Yves V. Brun, Yoshua Bengio, Alex Hernandez-Garcia

机构 * University of Toronto(多伦多大学) DeepMind(深度思维) University of Montreal(蒙特利尔大学)

AI总结 提出S3-GFN方法,通过软正则化序列GFlowNet,利用大规模SMILES语料库的化学先验,生成高奖励且可合成的分子,实验表明可合成率≥95%。

详情

展开后加载摘要…

URL PDF HTML 收藏