Fred Zhangzhi Peng, Zachary Bezemek, Sawan Patel, Jarrid Rector-Brooks, Sherwood Yao, Avishek Joey Bose, Alexander Tong, Pranam Chatterjee
机构
*
Duke University(杜克大学)
;
Atom Bioworks(Atom生物工坊)
;
Mila – Québec AI Institute(魁北克AI研究院)
;
Université de Montréal(蒙特利尔大学)
;
The University of Oxford(牛津大学)
;
Aithyra(Aithyra公司)
;
University of Pennsylvania(宾夕法尼亚大学)
机构
*
Department of Data Science and Artificial Intelligence, The Hong Kong Polytechnic University, Hong Kong SAR, China(数据科学与人工智能系,香港理工大学,香港特别行政区,中国)
;
Department of Applied Mathematics, The Hong Kong Polytechnic University, Hong Kong SAR, China(应用数学系,香港理工大学,香港特别行政区,中国)
MCP-SafetyBench: A Benchmark for Safety Evaluation of Large Language Models with Real-World MCP Servers
MCP-SafetyBench:一种用于评估大型语言模型在真实MCP服务器安全性的大规模基准
Xuanjun Zong, Zhiqi Shen, Lei Wang, Yunshi Lan, Chao Yang
机构
*
East China Normal University(东华师范大学)
;
Salesforce AI Research(Salesforce人工智能研究)
;
Singapore Management University(新加坡国立大学)
;
Shanghai AI Laboratory(上海人工智能实验室)