ThaiSafetyBench: Assessing Language Model Safety in Thai Cultural Contexts
ThaiSafetyBench: 评估泰语文化背景下语言模型的安全性
机构 * SCB DataX(SCB数据X) ; Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) ; SCBX R&D(SCBX研发部) ; SCB 10X
专题命中 评测与基准 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL
AI总结 本研究提出ThaiSafetyBench,通过泰语文化背景下的恶意提示评估语言模型安全性,发现闭源模型安全性更强,同时揭示了文化特定攻击的高风险。
Comments ICLR 2026 Workshop on Principled Design for Trustworthy AI