Safety from Honesty in a Disinterested AI Predictor
无兴趣AI预测器中的诚实安全性
Yoshua Bengio, Oliver Richardson, Tomáš Gavenčiak, Michael Cohen, Rory Svarc, Damiano Fornasiere, Gael Gendron, David Hyland, Aton Kamanda, Adam Oberman, Francis Rhys Ward, Anna Gavenčiak, Jacob Livingston Slosser, Vincent Mai, Iulian Serban, Joumana Ghosn
机构
*
LawZero
;
Université de Montréal(蒙特利尔大学)
;
Mila
;
University of California Berkeley(加州大学伯克利分校)
;
McGill University(麦吉尔大学)
;
Arb Research
;
Center for Theoretical Study Charles University in Prague(布拉格查理大学理论研究中心)
;
University of Oxford(牛津大学)
;
Sapien Institute(Sapien研究所)
Selective Safety Steering via Value-Filtered Decoding
基于价值过滤解码的选择性安全引导
Bat-Sheva Einbinder, Hen Davidov, Yee Whye Teh, Yarin Gal, Yaniv Romano
机构
*
Department of Electrical and Computer Engineering, Technion IIT(技术学院电气与计算机工程系)
;
Department of Statistics, University of Oxford(牛津大学统计系)
;
OATML, Department of Computer Science, University of Oxford(牛津大学计算机科学系)
;
Department of Computer Science, Technion IIT(技术学院计算机科学系)
From Cross-Validation to SURE: Asymptotic Risk of Tuned Regularized Estimators
从交叉验证到SURE:调节估计器的渐近风险
Karun Adusumilli, Maximilian Kasy, Ashia Wilson
机构
*
Department of Economics, University of Pennsylvania(宾夕法尼亚大学经济学系)
;
Department of Economics, University of Oxford(牛津大学经济学系)
;
Department of Electrical Engineering and Computer Science, MIT(麻省理工学院电气工程与计算机科学系)
ZeroBench: An Impossible Visual Benchmark for Contemporary Large Multimodal Models
ZeroBench:当代大型多模态模型的一个不可能的视觉基准测试
Jonathan Roberts, Mohammad Reza Taesiri, Ansh Sharma, Akash Gupta, Samuel Roberts, Ioana Croitoru, Simion-Vlad Bogolin, Jialu Tang, Florian Langer, Vyas Raina, Vatsal Raina, Hanyi Xiong, Vishaal Udandarao, Jingyi Lu, Shiyang Chen, Sam Purkis, Tianshuo Yan, Wenye Lin, Gyungin Shin, Qiaochu Yang, Anh Totti Nguyen, David I. Atkinson, Aaditya Baranwal, Alexandru Coca, Mikah Dang, Sebastian Dziadzio, Jakob D. Kunz, Kaiqu Liang, Alexander Lo, Brian Pulfer, Steven Walton, Charig Yang, Kai Han, Samuel Albanie
机构
*
University of Cambridge(剑桥大学)
;
University of Alberta(阿尔伯塔大学)
;
The University of Hong Kong(香港大学)
;
University of Oxford(牛津大学)
;
Northeastern University(东北大学)
;
Astadeus
;
College of Southern Maryland(马里兰州南部学院)
;
University of Geneva(日内瓦大学)
;
University of Oregon(俄勒冈大学)
机构
*
Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)
;
Technion, NVIDIA(技术学院与NVIDIA)
;
University of Oxford(牛津大学)
;
School of Electronics Engineering(电子工程学院)
;
Computer Science, Peking University(计算机科学,北京大学)
Lorenz Hufe, Niclas Griesshaber, Gavin Greif, Sebastian Oliver Eck, Philip Torr
机构
*
Torr Vision Group, Department of Engineering Science, University of Oxford(牛津大学工程科学系托尔视觉组)
;
Oxford Centre for Economic and Social History, University of Oxford(牛津大学牛津经济与社会史中心)
;
Faculty of Music, University of Oxford(牛津大学音乐学院)
;
Fraunhofer HHI(弗劳恩霍夫海因里希·赫兹研究所)
TreeLoc++: Robust 6-DoF LiDAR Localization in Forests with a Compact Digital Forest Inventory
TreeLoc++:利用紧凑数字森林清单在森林中进行稳健的6自由度激光雷达定位
Minwoo Jung, Dongjae Lee, Nived Chebrolu, Haedam Oh, Maurice Fallon, Ayoung Kim
机构
*
Department of Mechanical Engineering, Seoul National University, Seoul, South Korea(首尔国立大学机械工程系,韩国首尔)
;
Department of Computer Science and Engineering, Indian Institute of Technology Bombay, India(印度班加罗尔印度理工学院计算机科学与工程系)
;
Oxford Robotics Institute, Department of Engineering Science, University of Oxford, Oxford, UK(牛津大学奥克斯福德机器人研究所,英国牛津)
CommentsPreprint. Accepted at NeurIPS 2025 Workshops on SPACE in Vision, Language, and Embodied AI (SpaVLE) as Oral, Embodied World Models for Decision Making (EWM), Aligning Reinforcement Learning Experimentalists and Theorists (ARLET), and Scaling Environments for Agents (SEA)
CoDoL: Conditional Domain Prompt Learning for Out-of-Distribution Generalization
CoDoL:用于分布外泛化的条件域提示学习
Min Zhang, Yuyin Wang, Zhongxiang Dai, Zhikang Chen, Jie Zhou, Miao Liu, Sen Cui
机构
*
East China Normal University(东华师范大学)
;
Xidian University(西安电子科技大学)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
The University of Oxford(牛津大学)
;
Tsinghua University(清华大学)
机构
*
Nuffield Department of Clinical Neurosciences, University of Oxford(临床神经科学系,Nuffield大学,牛津大学)
;
Max Planck Institute of Biological Cybernetics(生物信息学研究所)
;
Oxford Gait Laboratory, University of Oxford(牛津大学步态实验室)
;
Harvard Medical School(哈佛医学院)
;
Massachusetts General Hospital(麻省总医院)
;
Institute of Biomedical Engineering, University of Oxford(生物医学工程研究所,牛津大学)
;
Mayo Clinic(梅奥诊所)
Use What You Know: Causal Foundation Models with Partial Graphs
利用已知信息:带有部分图结构的因果基础模型
Arik Reuter, Anish Dhir, Cristiana Diaconu, Jake Robertson, Ole Ossen, Frank Hutter, Adrian Weller, Mark van der Wilk, Bernhard Schölkopf
机构
*
University of Cambridge(剑桥大学)
;
Gatsby Computational Neuroscience Unit(加布特计算神经科学单位)
;
Prior Labs(Prior实验室)
;
University of Freiburg(弗赖堡大学)
;
The Alan Turing Institute(艾伦·图灵研究所)
;
University of Oxford(牛津大学)
BioMedArena: An Open-source Toolkit for Building and Evaluating Biomedical Deep Research Agents
BioMedArena:构建和评估生物医学深度研究代理的开源工具包
Jinge Wu, Hongjian Zhou, Mingde Zeng, Jiayuan Zhu, Junde Wu, Jiazhen Pan, Ayush Noori, Sean Wu, Honghan Wu, Fenglin Liu, David A. Clifton
机构
*
University of Oxford(牛津大学)
;
University College London(伦敦大学学院)
;
Technical University of Munich(慕尼黑技术大学)
;
Oxford-Suzhou Centre for Advanced Research, China(牛津-苏州先进研究中心)
Ayush Noori, Aaron E. Boussina, Hai Ho Bich, James Anibal, Julia Maslinski, Manuel Burger, Martin Faltys, Adam Rodman, Alan Karthikesalingam, Alessandro Blasimme, Annelia Itwaru, Ben Kaplan, Bilal A. Mateen, Christopher A. Longhurst, Daniel Yang, Dave deBronkart, Effy Vayena, Fedor Sergeev, Gauden Galea, Ha Thi Hai Duong, Harold F. Wolf, Jacob Waxman, Joerg C. Schefold, Joshua C. Mandel, Juliana Rotich, Kenneth D. Mandl, Lily Poursoltan, Maryam Mustafa, Melissa Miles, Nigam H. Shah, Noa Dagan, Pavan Bodanki, Peter Lee, Philipp Koralus, Prathamesh Parchure, Prem Timsina, Ran D. Balicer, Robert Korom, Scott Mahoney, Seth Hain, Tien Yin Wong, Trevor Mundel, Vivek Natarajan, Ankit Sakhuja, Benjamin Glicksberg, C. Louise Thwaites, Gunnar Rätsch, Karandeep Singh, David A. Clifton, Isaac S. Kohane, Marinka Zitnik
机构
*
Harvard Medical School(哈佛医学院)
;
University of Oxford(牛津大学)
;
Institute for Ethics in AI(人工智能伦理研究所)
;
Cosmos Institute(宇宙研究所)
;
Harvard Medical School and Clalit Research Institute(哈佛医学院和Clalit研究机构)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
Joan and Irwin Jacobs Center for Health Innovation(乔安和伊万·雅各布健康创新中心)
;
Oxford University Clinical Research Unit(牛津大学临床研究中心)
;
Icahn School of Medicine at Mount Sinai(辛格纳医学中心)
;
The Hasso Plattner Institute for Digital Health at Mount Sinai(辛格纳医学中心数字健康研究所)
;
ETH Zurich(苏黎世联邦理工学院)
;
University Hospital, University of Bern(伯恩大学医院)
;
Beth Israel Deaconess Medical Center(贝斯以色列医疗中心)
;
Google DeepMind(谷歌DeepMind)
;
The Mount Sinai AI Assurance Lab(辛格纳医学中心人工智能保证实验室)
;
University of Birmingham(伯明翰大学)
;
PATH(PATH组织)
;
Seattle Children’s Hospital(西雅图儿童医院)
;
Department of Pediatrics, University of California, San Diego(加州大学圣地亚哥分校儿科部)
;
Kaiser Foundation Health and Hospitals(凯撒基金会健康与医院)
;
e-Patient Dave, LLC(e-Patient Dave公司)
;
Regional Office for Europe, World Health Organization(世界卫生组织欧洲地区办公室)
;
University of Malta(马耳他大学)
;
Centre for Tropical Medicine and Global Health, University of Oxford(牛津大学热带医学与全球健康中心)
;
Healthcare Information and Management Systems Society(医疗信息与管理系统协会)
;
Clalit Research Institute, Innovation Division, Clalit Health Services(Clalit研究机构创新部门,Clalit健康服务)
;
Microsoft Research(微软研究院)
;
Gates Foundation(比尔及梅琳达·盖茨基金会)
;
Computational Health Informatics Program, Boston Children’s Hospital(波士顿儿童医院计算健康信息学项目)