Benchmarking the Safety of Large Language Models for Robotic Health Attendant Control
对大型语言模型在机器人健康护理员控制中的安全性的基准测试
机构 * Kyushu Institute of Technology(九州工业技术大学)
专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.AI
AI总结 本文通过270条有害指令评估72个LLM,在模拟环境中测试其安全性,发现模型大小和发布日期影响安全性能,专有模型更安全,但医疗领域微调和提示防御策略效果有限,需将安全性作为首要考量。
Comments 20 pages, 9 figures, 3 tables, 8 pages supplementary material