机构
*
Zhejiang University(浙江大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Hong Kong University of Science and Technology(香港科学与技术大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of Manchester(曼彻斯特大学)
;
Innovation Center of Yangtze River Delta, Zhejiang University(长江三角洲创新中心,浙江大学)
Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety
思维链可监控性:AI安全的新且脆弱的机会
Tomek Korbak, Mikita Balesni, Elizabeth Barnes, Yoshua Bengio, Joe Benton, Joseph Bloom, Mark Chen, Alan Cooney, Allan Dafoe, Anca Dragan, Scott Emmons, Owain Evans, David Farhi, Ryan Greenblatt, Dan Hendrycks, Marius Hobbhahn, Evan Hubinger, Geoffrey Irving, Erik Jenner, Daniel Kokotajlo, Victoria Krakovna, Shane Legg, David Lindner, David Luan, Aleksander Mądry, Julian Michael, Neel Nanda, Dave Orr, Jakub Pachocki, Ethan Perez, Mary Phuong, Fabien Roger, Joshua Saxe, Buck Shlegeris, Martín Soto, Eric Steinberger, Jasmine Wang, Wojciech Zaremba, Bowen Baker, Rohin Shah, Vlad Mikulik
机构
*
UK AI Security Institute(英国人工智能安全研究所)
;
Apollo Research(阿波罗研究)
;
METR
;
University of Montreal(蒙特利尔大学)
;
Mila
;
Anthropic
;
OpenAI(开放人工智能研究所)
;
Google DeepMind(谷歌DeepMind)
;
Truthful AI
;
UC Berkeley(伯克利大学)
;
Center for AI Safety(人工智能安全中心)
;
AI Futures Project(人工智能未来项目)
;
Amazon(亚马逊)
;
Scale AI
;
Magic
;
Meta
;
Redwood Research(红木研究)
Characterizing Language Use in a Collaborative Situated Game
协作情境游戏中的语言使用特征分析
Nicholas Tomlin, Naitian Zhou, Eve Fleisig, Liangyuan Chen, Téa Wright, Lauren Vinh, Laura X. Ma, Seun Eisape, Ellie French, Tingting Du, Tianjiao Zhang, Alexander Koller, Alane Suhr
Patient Safety Risks from AI Scribes: Signals from End-User Feedback
人工智能记录员对患者安全的风险:来自终端用户反馈的信号
Jessica Dai, Anwen Huang, Catherine Nasrallah, Rhiannon Croci, Hossein Soleimani, Sarah J. Pollet, Julia Adler-Milstein, Sara G. Murray, Jinoos Yazdany, Irene Y. Chen
机构
*
University of California Berkeley(加州大学伯克利分校)
;
University of California San Francisco(加州大学旧金山分校)
KiVA: Kid-inspired Visual Analogies for Testing Large Multimodal Models
KiVA:儿童启发的视觉类比用于测试大多模态模型
Eunice Yiu, Maan Qraitem, Anisa Noor Majhi, Charlie Wong, Yutong Bai, Shiry Ginosar, Alison Gopnik, Kate Saenko
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
Boston University(波士顿大学)
;
Google DeepMind(谷歌DeepMind)
;
Toyota Technological Institute at Chicago(芝加哥丰田技术研究所)
Evaluating Generalization Capabilities of LLM-Based Agents in Mixed-Motive Scenarios Using Concordia
利用Concordia评估基于LLM的智能体在混合动机场景中的泛化能力
Chandler Smith, Marwa Abdulhai, Manfred Diaz, Marko Tesic, Rakshit S. Trivedi, Alexander Sasha Vezhnevets, Lewis Hammond, Jesse Clifton, Minsuk Chang, Edgar A. Duéñez-Guzmán, John P. Agapiou, Jayd Matyas, Danny Karmon, Akash Kundu, Aliaksei Korshuk, Ananya Ananya, Arrasy Rahman, Avinaash Anand Kulandaivel, Bain McHale, Beining Zhang, Buyantuev Alexander, Carlos Saith Rodriguez Rojas, Caroline Wang, Chetan Talele, Chenao Liu, Chichen Lin, Diana Riazi, Di Yang Shi, Emanuel Tewolde, Elizaveta Tennant, Fangwei Zhong, Fuyang Cui, Gang Zhao, Gema Parreño Piqueras, Hyeonggeun Yun, Ilya Makarov, Jiaxun Cui, Jebish Purbey, Jim Dilkes, Jord Nguyen, Lingyun Xiao, Luis Felipe Giraldo, Manuela Chacon-Chamorro, Manuel Sebastian Rios Beltran, Marta Emili García Segura, Mengmeng Wang, Mogtaba Alim, Nicanor Quijano, Nico Schiavone, Olivia Macmillan-Scott, Oswaldo Peña, Peter Stone, Ram Mohan Rao Kadiyala, Rolando Fernandez, Ruben Manrique, Sunjia Lu, Sheila A. McIlraith, Shamika Dhuri, Shuqing Shi, Siddhant Gupta, Sneheel Sarangi, Sriram Ganapathi Subramanian, Taehun Cha, Toryn Q. Klassen, Wenming Tu, Weijian Fan, Wu Ruiyang, Xue Feng, Yali Du, Yang Liu, Yiding Wang, Yipeng Kang, Yoonchang Sung, Yuxuan Chen, Zhaowei Zhang, Zhihan Wang, Zhiqiang Wu, Ziang Chen, Zilong Zheng, Zixia Jia, Ziyan Wang, Dylan Hadfield-Menell, Natasha Jaques, Tim Baarslag, Jose Hernandez-Orallo, Joel Z. Leibo
机构
*
Cooperative AI Foundation(合作人工智能基金会)
;
University of Oxford(牛津大学)
;
UC Berkeley(伯克利大学)
;
Quebec Artificial Intelligence Institute(魁北克人工智能研究所)
;
Leverhulme Centre for the Future of Intelligence, University of Cambridge(未来智能研究中心,剑桥大学)
;
MIT(麻省理工学院)
;
Google DeepMind(谷歌DeepMind)
;
Center on Long-Term Risk(长期风险中心)
;
Google Research(谷歌研究)
;
University of Washington(华盛顿大学)
;
Centrum Wiskunde & Informatica(数学与信息研究所)
;
Utrecht University(乌得勒支大学)
;
Universitat Politècnica de València(瓦伦西亚理工大学)
;
Concordia Contest Participants with Notable Contributions(康科德比赛有显著贡献的参与者)
Dan Hendrycks, Dawn Song, Christian Szegedy, Honglak Lee, Yarin Gal, Erik Brynjolfsson, Sharon Li, Andy Zou, Lionel Levine, Bo Han, Jie Fu, Ziwei Liu, Jinwoo Shin, Kimin Lee, Mantas Mazeika, Long Phan, George Ingebretsen, Adam Khoja, Cihang Xie, Olawale Salaudeen, Matthias Hein, Kevin Zhao, Alexander Pan, David Duvenaud, Bo Li, Steve Omohundro, Gabriel Alfour, Max Tegmark, Kevin McGrew, Gary Marcus, Jaan Tallinn, Eric Schmidt, Yoshua Bengio
机构
*
Center for AI Safety(AI安全中心)
;
University of California, Berkeley(加州大学伯克利分校)
;
Virtue AI
;
Morph Labs(Morph实验室)
;
University of Michigan(密歇根大学)
;
LG AI Research(LG人工智能研究)
;
University of Oxford(牛津大学)
;
Stanford University(斯坦福大学)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
Gray Swan AI
;
Carnegie Mellon University(卡内基梅隆大学)
;
Cornell University(康奈尔大学)
;
Hong Kong Baptist University(香港 Baptist大学)
;
HKUST(香港科技大学)
;
Nanyang Technological University(南洋理工大学)
;
KAIST(韩国科学技术院)
;
University of California, Santa Cruz(加州大学圣克鲁兹分校)
;
Massachusetts Institute of Technology(麻省理工学院)
;
University of Tübingen(图宾根大学)
;
University of Washington(华盛顿大学)
;
University of Toronto(多伦多大学)
;
Vector Institute(向量研究所)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Beneficial AI Research(有益AI研究)
;
Conjecture
;
Institute for Applied Psychometrics(应用心理测量研究所)
;
New York University(纽约大学)
;
CSER
;
Université de Montréal(蒙特利尔大学)
;
LawZero
From 'What-is' to 'What-if' in Human-Factor Analysis: A Post-Occupancy Evaluation Case
从‘是什么’到‘如果’的人因分析:一个后占用评估案例
Xia Chen, Ruiji Sun, Philipp Geyer, André Borrmann, Stefano Schiavon
机构
*
Georg Nemetschek Institute(乔治·奈梅克研究所)
;
Technische Universität München(慕尼黑技术大学)
;
Center for the Built Environment(环境研究中心)
;
University of California, Berkeley(加州大学伯克利分校)
机构
*
Tsinghua University(清华大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
JD Explore Academy(JD探索学院)
;
The Hong Kong Polytechnic University(香港理工大学)
BountyBench: Dollar Impact of AI Agent Attackers and Defenders on Real-World Cybersecurity Systems
BountyBench: AI代理攻击者和防御者对现实世界网络安全系统的影响
Andy K. Zhang, Joey Ji, Celeste Menders, Riya Dulepet, Thomas Qin, Ron Y. Wang, Junrong Wu, Kyleen Liao, Jiliang Li, Jinghan Hu, Sara Hong, Nardos Demilew, Shivatmica Murgai, Jason Tran, Nishka Kacheria, Ethan Ho, Denis Liu, Lauren McLane, Olivia Bruvik, Dai-Rong Han, Seungwoo Kim, Akhil Vyas, Cuiyuanxiu Chen, Ryan Li, Weiran Xu, Jonathan Z. Ye, Prerit Choudhary, Siddharth M. Bhatia, Vikram Sivashankar, Yuxuan Bao, Dawn Song, Dan Boneh, Daniel E. Ho, Percy Liang
Global Convergence of Policy Gradient for Entropy Regularized Linear-Quadratic Control with Multiplicative Noise
熵正则化线性二次控制中乘性噪声下的策略梯度全局收敛性
Gabriel Diaz, Lucky Li, Wenhao Zhang
机构
*
Department of Mathematics, University of California, Berkeley(加州大学伯克利分校数学系)
;
College of Computing, Data Science, and Society, University of California, Berkeley(加州大学伯克利分校计算机科学与数据科学学院)
;
Department of Applied Mathematics, The Hong Kong Polytechnic University(香港理工大学应用数学系)
机构
*
Tsinghua University(清华大学)
;
MARS Lab, Nanyang Technological University(南洋理工大学MARS实验室)
;
University of California, Berkeley(加州大学伯克利分校)
;
The University of Tokyo(东京大学)
Object-Centric Data Synthesis for Category-level Object Detection
面向类别级目标检测的对象中心数据合成
Vikhyat Agarwal, Jiayi Cora Guo, Declan Hoban, Sissi Zhang, Nicholas Moran, Peter Cho, Srilakshmi Pattabiraman, Shantanu Joshi
机构
*
University of Richmond(里士满大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
Analog Devices, Inc(安森科技公司)