The Age of Curiosity Meets the Age of AI: Benchmarking Child Safety in Large Language Models
好奇心时代遇上AI时代:大型语言模型中的儿童安全基准测试
机构 * University of Michigan(密歇根大学)
AI总结 针对7-11岁儿童使用LLM的安全性问题,提出基于发展心理学的KIDBench基准,通过隐式线索和显式年龄指令提升安全性,并开发了儿童安全评估器KIDGuardLlama和响应模型KIDLlama。