XL-SafetyBench: A Country-Grounded Cross-Cultural Benchmark for LLM Safety and Cultural Sensitivity
XL-SafetyBench: 一个基于国家的跨文化安全基准,用于LLM安全性和文化敏感性
机构 * AIM Intelligence(AIM智能研究院) ; Microsoft(微软公司) ; Korea AISI(韩国人工智能研究所) ; KT Corporation(KT公司) ; BMW Group(宝马集团) ; Coinbase(Coinbase公司) ; Technical University of Munich(慕尼黑技术大学) ; Ankara University(安卡拉大学) ; Cyril Amarchand Mangaldas(Cyril Amarchand Mangaldas法律事务所) ; Seoul National University(首尔国立大学)
专题命中 安全评测 :safety(title,abstract);jailbreak(abstract,abstract_cn);alignment(abstract);分类 cs.CL、cs.AI
AI总结 XL-SafetyBench通过5500个跨10个国家语言对的测试案例,评估LLM在文化敏感性和安全性的表现,揭示了前沿模型的安全性与文化意识无耦合关系,以及本地模型在安全与文化敏感性间的线性权衡。