RCTs for Frontier AI Governance: Methodological Challenges and Solutions for Human Uplift Studies
随机对照试验与人类提升研究:前沿AI评估的方法论挑战与实践解决方案
Patricia Paskov, Kevin Wei, Shen Zhou Hong, Dan Bateyko, Xavier Roberts-Gaal, Carson Ezell, Gailius Praninskas, Valerie Chen, Umang Bhatt, Ella Guest
机构
*
RAND
;
Johns Hopkins University(约翰霍普金斯大学)
;
Cornell University(康奈尔大学)
;
Harvard University(哈佛大学)
;
University of Cambridge(剑桥大学)
;
London School of Economics(伦敦经济学院)
Eduardo Sebastián, Nicolas Pfitzer, Ajay Shankar, Amanda Prorok
机构
*
Department of Computer Science and Technology, University of Cambridge(剑桥大学计算机科学与技术系)
;
Department of Mechanical and Process Engineering, ETH Zurich(苏黎世联邦理工学院机械与过程工程系)
CommentsThis paper has been accepted for publication at IEEE Robotics and Automation Letters. Please, when citing the paper, refer to the official version
Use What You Know: Causal Foundation Models with Partial Graphs
利用已知信息:带有部分图结构的因果基础模型
Arik Reuter, Anish Dhir, Cristiana Diaconu, Jake Robertson, Ole Ossen, Frank Hutter, Adrian Weller, Mark van der Wilk, Bernhard Schölkopf
机构
*
University of Cambridge(剑桥大学)
;
Gatsby Computational Neuroscience Unit(加布特计算神经科学单位)
;
Prior Labs(Prior实验室)
;
University of Freiburg(弗赖堡大学)
;
The Alan Turing Institute(艾伦·图灵研究所)
;
University of Oxford(牛津大学)
MyoInteract: A Framework for Fast Prototyping of Biomechanical HCI Tasks using Reinforcement Learning
MyoInteract:一种使用强化学习快速原型设计生物力学人机交互任务的框架
Ankit Bhattarai, Hannah Selder, Florian Fischer, Arthur Fleig, Per Ola Kristensson
机构
*
University of Cambridge(剑桥大学)
;
Center for Scalable Data Analytics and Artificial Intelligence (ScaDS.AI) Dresden/Leipzig, Leipzig University(可扩展数据与人工智能分析中心(ScaDS.AI)德累斯顿/莱比锡,莱比锡大学)
Policy Gradient with Self-Attention for Model-Free Distributed Nonlinear Multi-Agent Games
基于自注意力的策略梯度用于无模型分布式非线性多智能体博弈
Eduardo Sebastián, Maitrayee Keskar, Eeman Iqbal, Eduardo Montijano, Carlos Sagüés, Nikolay Atanasov
机构
*
Department of Computer Science and Technology, University of Cambridge(计算机科学与技术系,剑桥大学)
;
Department of Electrical and Computer Engineering, University of California San Diego(电气与计算机工程系,加州大学圣地亚哥分校)
;
RoPeRt group, at DIIS - I3A, Universidad de Zaragoza(RoPeRt组,DIIS - I3A,阿拉贡大学)
Societal Alignment Frameworks Can Improve LLM Alignment
社会对齐框架可以改进大语言模型对齐
Karolina Stańczak, Nicholas Meade, Mehar Bhatia, Hattie Zhou, Konstantin Böttinger, Jeremy Barnes, Jason Stanley, Jessica Montgomery, Richard Zemel, Nicolas Papernot, Nicolas Chapados, Denis Therien, Timothy P. Lillicrap, Ana Marasović, Sylvie Delacroix, Gillian K. Hadfield, Siva Reddy
机构
*
ETH Zurich(苏黎世联邦理工学院)
;
Mila, McGill University(麦吉尔大学米尔人工智能实验室)
;
University of Cambridge(剑桥大学)
;
Columbia University(哥伦比亚大学)
;
University of Toronto, Google DeepMind(多伦多大学与DeepMind)
;
McGill University, ServiceNow(麦吉尔大学与ServiceNow)
;
Google DeepMind(谷歌DeepMind)
;
University of Utah(犹他大学)
;
King's College London(伦敦国王学院)
;
Johns Hopkins University(约翰霍普金斯大学)
;
Mila, McGill University, ServiceNow(麦吉尔大学米尔人工智能实验室与ServiceNow)
Embedding-Based Federated Learning with Runtime Governance for Iron Deficiency Prediction
基于运行时治理的嵌入式联邦学习用于缺铁预测
Fan Zhang, Simon Deltadahl, Majid Lotfian Delouee, Daniel Kreuter, Joseph Taylor, Allerdien Visser, BloodCounts Consortium, James H. F. Rudd, Nicholas S. Gleadall, Suthesh Sivapalaratnam, Folkert Asselbergs, Martijn C. Schut, Michael Roberts
机构
*
Theoretical Physics University of Cambridge Cambridge, UK
;
Translational AI Laboratory, Dept. of Laboratory Medicine Amsterdam UMC Amsterdam, The Netherlands
;
Precision Health University Research Institute Queen Mary Univ. of London London, UK
;
Department of Medicine University of Cambridge Cambridge Biomedical Campus Cambridge, UK
;
Transplant Cambridge Biomedical Campus Cambridge, UK
;
Dept. of Cardiology Amsterdam Cardiovascular Sciences Amsterdam UMC Amsterdam, The Netherlands
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
The Hong Kong University of Science(香港科学大学)
;
Southern University of Science(南方科技大学)
;
University of Cambridge(剑桥大学)
AgentMisalignment: Measuring the Propensity for Misaligned Behaviour in LLM-Based Agents
AgentMisalignment:衡量基于LLM的代理中失调行为的倾向性
Akshat Naik, Emma Gouné, Patrick Quinn, Guillermo Bosch, Francisco Javier Campos Zabala, Jason Ross Brown, Edward James Young
机构
*
Department of Computer Science(计算机科学系)
;
University of Oxford(牛津大学)
;
Institute of Intelligent Systems and Robotics(智能系统与机器人研究所)
;
Sorbonne Université(索邦大学)
;
The Leverhulme Centre for the Future of Intelligence(未来智能中心)
;
University of Cambridge(剑桥大学)
;
Independent Researcher(独立研究者)
;
Department of Computer Science and Technology(计算机科学与技术系)
;
Department of Engineering(工程系)
Learning Patient-Specific Disease Dynamics with Latent Flow Matching for Longitudinal Imaging Generation
学习患者特异性疾病动态:基于潜在流匹配的纵向影像生成
Hao Chen, Rui Yin, Yifan Chen, Qi Chen, Chao Li
机构
*
University of Cambridge(剑桥大学)
;
Nanjing First Hospital(南京第一医院)
;
Nanjing Medical University(南京医科大学)
;
Johns Hopkins University(约翰霍普金斯大学)
;
University of Dundee(邓迪大学)
Large Language Models for Agentic NetOps and AIOps: Architectures, Evaluation, and Safety
用于代理网络运维和AI运维的大型语言模型:架构、评估与安全
Muhammad Bilal, Jon Crowcroft, Ruizhi Wang, Xiaolong Xu, Schahram Dustdar
机构
*
School of Computing and Communications(计算与通信学院)
;
University of Cambridge(剑桥大学)
;
School of Software(软件学院)
;
Nanjing University of Information Science and Technology(南京信息科技大學)
;
TU Wien(维也纳技术大学)
;
ICREA
Agentic World Modeling: Foundations, Capabilities, Laws, and Beyond
代理世界建模:基础、能力、定律及更远
Meng Chu, Xuan Billy Zhang, Kevin Qinghong Lin, Lingdong Kong, Jize Zhang, Teng Tu, Weijian Ma, Ziqi Huang, Senqiao Yang, Wei Huang, Yeying Jin, Zhefan Rao, Jinhui Ye, Xinyu Lin, Xichen Zhang, Qisheng Hu, Shuai Yang, Leyang Shen, Wei Chow, Yifei Dong, Fengyi Wu, Quanyu Long, Bin Xia, Shaozuo Yu, Mingkang Zhu, Wenhu Zhang, Jiehui Huang, Haokun Gui, Runyi Li, Chenyu Tang, Dong Huang, Xuhang Chen, Rui Liu, Chengzu Li, Shiyi Du, Xu Huang, Haoxuan Che, Long Chen, Qifeng Chen, Wenya Wang, Wenxuan Zhang, Xiaojuan Qi, Yang Deng, Yanwei Li, Mike Zheng Shou, Zhi-Qi Cheng, See-Kiong Ng, Ziwei Liu, Philip Torr, Jiaya Jia
机构
*
Hong Kong University of Science and Technology(香港科学与技术大学)
;
National University of Singapore(新加坡国立大学)
;
University of Oxford(牛津大学)
;
Nanyang Technological University(南洋理工大学)
;
Chinese University of Hong Kong(香港中文大学)
;
University of Hong Kong(香港大学)
;
University of Washington(华盛顿大学)
;
University of Tokyo(东京大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of Cambridge(剑桥大学)
;
Singapore University of Technology and Design(新加坡科技设计大学)
;
Singapore Management University(新加坡管理学院)
;
XGEN Labs(XGEN实验室)