Pluralis v0.1: Towards a Multicultural, Multimodal, Multilingual Benchmark for AI Risk and Reliability
Pluralis v0.1:迈向用于人工智能风险与可靠性的多元文化、多模态、多语言基准测试
Alicia Parrish, Rajat Shinde, Sanket Badhe, Xinyi Bai, Sree Bhargavi Balija, Hua-Rong Chu, Emilio Ferrara, Armstrong Foundjem, Rajat Ghosh, Aakash Gupta, Xuanli He, Ong Chen Hui, Minji Jung, Madhangi Karimanal, Faiza Khan Khattak, Boryoung Kim, Eugenia Kim, Liliya Lavitas, Seok Min Lim, Victor Lu, Jim Moirangthem, Dhivya Nagasubramanian, Deepak Pandita, Sita Rajagopal, Geetha Raju, Evgeniia Razumovskaia, Aravind Reddy, Federico Ricciuti, Nobin Sarwar, Sungpil Shin, Sunayana Sitaram, Snehal Thorat, Tharindu Cyril Weerasooriya, Jasmijn Bastings, Joachim Baumann, Kongtao Chen, Murali Emani, Mariya Hendriksen, Jiho Jin, Jun Seong Kim, Younghoon Ko, Alicja Kwasniewska, Minjae Lee, Tom Wei-cyuan Lin Kashyap Ramanandula Manjusha, Junho Myung, Junyeong Park, Roma Patel, Shyam Ratan, Sudarsun Santhiappan, Priyanka Suresh, Tuesday, Ksheeraj Sai Vepuri Laura Amortegui-Ordonez, Claire Dennis, Minsuk Kahng, Chris Knotz, Alice Oh, Balaraman Ravindran, Soojung Ryu William Bartholomew, Hiwot Tesfaye, Lora Aroyo
机构
*
Google DeepMind(谷歌DeepMind)
;
University of Alabama in Huntsville(阿拉巴马大学亨茨维尔分校)
;
Google(谷歌)
;
University of Missouri Columbia(密苏里大学哥伦比亚分校)
;
Chunghwa Telecom Laboratories(春木电信实验室)
;
University of Southern California(南加州大学)
;
Polytechnique Montreal(蒙特利尔理工学院)
;
Nutanix
;
ThinkEvolve Labs(ThinkEvolve实验室)
;
UCL(伦敦大学学院)
;
Infocomm Media Development Authority(信息通信媒体发展局)
;
Monark Health(Monark健康)
;
Seoul National University(首尔国立大学)
;
Microsoft(微软)
;
Centre for Responsible AI (CeRAI), Wadhwani School of Data Science and AI (WSAI), Indian Institute of Technology Madras(负责任人工智能中心(CeRAI)、瓦达威人工智能学校(WSAI)、印度理工学院马德拉斯分校)
;
University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)
;
Microsoft Research India(微软印度研究院)
;
Stanford University(斯坦福大学)
;
Argonne National Laboratory(阿贡国家实验室)
;
University of Oxford(牛津大学)
;
KAIST(韩国科学技术院)
;
Yonsei University(延世大学)
;
Amazon(亚马逊)
;
UIUC(伊利诺伊大学香槟分校)
;
Rochester Institute of Technology(罗切斯特理工学院)
;
Xenoscube Inc.(Xenoscube公司)
;
Korea AI Safety Institute (K-AISI)(韩国人工智能安全研究所(K-AISI))
;
MLCommons
;
CommonGround
;
Artifex Labs(Artifex实验室)
PolicyShiftGuard: Benchmarking and Improving Policy-Adaptive Image Guardrails
PolicyShiftGuard:基准测试与改进策略自适应图像护栏
Mingyang Song, Luxin Xu, Haoyu Sun, Minzhou Pan, Yu Cheng, Bo Li
机构
*
Fudan University(复旦大学)
;
Tongji University(同济大学)
;
Virtue AI(美德人工智能公司)
;
The Chinese University of Hong Kong(香港中文大学)
;
University of Chicago(芝加哥大学)
;
University of Illinois, Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
When Can You Poison Rewards? A Tight Characterization of Reward Poisoning in Linear MDPs
在什么情况下可以污染奖励?线性MDP中奖励污染攻击的紧致刻画
Jose Efraim Aguilar Escamilla, Haoyang Hong, Jiawei Li, Haoyu Zhao, Xuezhou Zhang, Sanghyun Hong, Huazheng Wang
机构
*
School of Electrical Engineering and Computer Science, Oregon State University, Corvallis, Oregon, USA(电子工程与计算机科学学院,俄勒冈州立大学,俄勒冈州科瓦利斯)
;
Department of Electrical and Computer Engineering, University of Illinois Urbana-Champaign, Urbana, Illinois, USA(电气与计算机工程系,伊利诺伊大学厄巴纳-香槟分校,伊利诺伊州厄巴纳)
;
Princeton University, Princeton, New Jersey, USA(普林斯顿大学,新泽西州普林斯顿)
;
Faculty of Computing and Data Sciences, Boston University, Boston, Massachusetts, USA(计算与数据科学学院,波士顿大学,马萨诸塞州波士顿)
TAMA: A Human-AI Collaborative Thematic Analysis Framework Using Multi-Agent LLMs for Clinical Interviews
TAMA:一种使用多智能体大语言模型进行临床访谈的人机协作主题分析框架
Huimin Xu, Seungjun Yi, Terence Lim, Jiawei Xu, Andrew Well, Carlos Mery, Aidong Zhang, Yuji Zhang, Heng Ji, Keshav Pingali, Yan Leng, Ying Ding
机构
*
School of Information, University of Texas at Austin(信息学院,德克萨斯大学奥斯汀分校)
;
Department of Biomedical Engineering, University of Texas at Austin(生物医学工程系,德克萨斯大学奥斯汀分校)
;
College of Natural Sciences, University of Texas at Austin(自然科学院,德克萨斯大学奥斯汀分校)
;
Graphen, Inc.(Graphen公司)
;
Department of Cardiac Surgery, Division of Pediatric Cardiac Surgery, Vanderbilt University School of Medicine(心脏外科系,范德比尔特大学医学中心)
;
Pediatric Heart Institute, Monroe Carell Jr. Children’s Hospital at Vanderbilt(儿童心脏研究所,范德比尔特儿童医院)
;
Department of Computer Science, University of Virginia(计算机科学系,弗吉尼亚大学)
;
Department of Computer Science, University of Illinois at Urbana-Champaign(计算机科学系,伊利诺伊大学厄巴纳-香槟分校)
;
Department of Computer Science, University of Texas at Austin(计算机科学系,德克萨斯大学奥斯汀分校)
;
McCombs School of Business, University of Texas at Austin(麦克阿瑟商学院,德克萨斯大学奥斯汀分校)
;
Dell Medical School, University of Texas at Austin(德克萨斯大学奥斯汀分校德莱尔医学院)
机构
*
University of California, Los Angeles(加州大学洛杉矶分校)
;
University of Southern California(南加州大学)
;
DeerLab LLC(DeerLab有限责任公司)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Clemson University(克莱姆森大学)
;
Google(谷歌)
;
San Jose State University(圣何塞州立大学)
;
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)