Prioritizing High-Consequence Biological Capabilities in Evaluations of Artificial Intelligence Models
在评估人工智能模型时优先考虑高后果生物能力
Jaspreet Pannu, Doni Bloomfield, Alex Zhu, Robert MacKnight, Gabe Gomes, Anita Cicero, Thomas V. Inglesby
机构
*
Center for Health Security, Bloomberg School of Public Health, Johns Hopkins University(健康安全中心,公共卫生学院,约翰霍普金斯大学)
;
Department of Health Policy, Stanford School of Medicine, Stanford University(健康政策系,斯坦福医学院,斯坦福大学)
;
Department of Chemical Engineering, Carnegie Mellon University(化学工程系,卡内基梅隆大学)
;
Department of Chemistry, Carnegie Mellon University(化学系,卡内基梅隆大学)
;
Wilton E. Scott Institute for Energy Innovation, Carnegie Mellon University(威尔顿·E·斯科特能源创新研究所,卡内基梅隆大学)
机构
*
University of Texas Austin(德克萨斯大学奥斯汀分校)
;
California Institute of Technology(加州理工学院)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Stanford University(斯坦福大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Microsoft Research(微软研究院)
;
Northwestern University(西北大学)
;
University of Cambridge(剑桥大学)
机构
*
Georgia Institute of Technology(佐治亚理工学院)
;
Columbia University(哥伦比亚大学)
;
California State University(加州州立大学)
;
University of Montreal(蒙特利尔大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Rensselaer Polytechnic Institute(莱斯利理工学院)
;
The University of Manchester(曼彻斯特大学)
;
Harvard University(哈佛大学)
Diamond Maps: Efficient Reward Alignment via Stochastic Flow Maps
钻石映射:通过随机流映射实现高效的奖励对齐
Peter Holderrieth, Douglas Chen, Luca Eyring, Ishin Shah, Giri Anantharaman, Yutong He, Zeynep Akata, Tommi Jaakkola, Nicholas Matthew Boffi, Max Simchowitz
机构
*
MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)
;
Carnegie Mellon University(卡内基梅隆大学)
Beyond Policy Optimization: A Data Curation Flywheel for Sparse-Reward Long-Horizon Planning
超越策略优化:一种数据整理飞轮用于稀疏奖励长周期规划
Yutong Wang, Pengliang Ji, Kaixin Li, Baolong Bi, Tao Feng, Guillaume Sartoretti
机构
*
Department of Mechanical Engineering, National University of Singapore(新加坡国立大学机械工程系)
;
Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)
;
School of Computing, National University of Singapore(新加坡国立大学计算机科学学院)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)
Unlearning Isn't Deletion: Investigating Reversibility of Machine Unlearning in LLMs
反学习不是删除:调查机器反学习在大语言模型中的可逆性
Xiaoyu Xu, Xiang Yue, Yang Liu, Qingqing Ye, Huadi Zheng, Peizhao Hu, Minxin Du, Haibo Hu
机构
*
The Hong Kong Polytechnic University(香港理工大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
University of California, Santa Cruz(加州大学圣克ruz分校)
;
Huawei Technologies(华为技术有限公司)
;
Research Centre for Privacy and Security Technologies in Future Smart Systems, PolyU(未来智能系统中的隐私与安全技术研究中心,PolyU)
机构
*
Department of Computer Science, Rice University(计算机科学系,里士大学)
;
Department of Computer Science, University of Minnesota(计算机科学系,明尼苏达大学)
;
Department of Psychology, University of Minnesota(心理学系,明尼苏达大学)
;
Neuroscience Institute, Carnegie Mellon University(神经科学研究所,卡内基梅隆大学)
Ada-Diffuser: Latent-Aware Adaptive Diffusion for Decision-Making
Ada-Diffuser: 面向决策制定的潜在意识自适应扩散模型
Fan Feng, Selena Ge, Minghao Fu, Zijian Li, Yujia Zheng, Zeyu Tang, Yingyao Hu, Biwei Huang, Kun Zhang
机构
*
University of California San Diego(加州大学圣地亚哥分校)
;
Carnegie Mellon University(卡内基梅隆大学)
;
MBZUAI
;
Stanford University(斯坦福大学)
;
Johns Hopkins University(约翰霍普金斯大学)