MCP-SafetyBench: A Benchmark for Safety Evaluation of Large Language Models with Real-World MCP Servers
MCP-SafetyBench:一种用于评估大型语言模型在真实MCP服务器安全性的大规模基准
机构 * East China Normal University(东华师范大学) ; Salesforce AI Research(Salesforce人工智能研究) ; Singapore Management University(新加坡国立大学) ; Shanghai AI Laboratory(上海人工智能实验室)
专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI
AI总结 MCP-SafetyBench通过真实MCP服务器评估大型语言模型的安全性,揭示了模型在面对MCP攻击时的脆弱性及安全与实用性的权衡问题。
Comments Our benchmark is available at https://github.com/xjzzzzzzzz/MCPSafety