Assessing Risks of Large Language Models in Mental Health Support: A Framework for Automated Clinical AI Red Teaming
评估大型语言模型在心理健康支持中的风险:一种用于自动化临床AI红队测试的框架
机构 * Northeastern University(东北大学) ; Harvard Medical School(哈佛医学院)
专题命中 红队测试 :red teaming(title,abstract);safety(abstract);分类 cs.CL、cs.AI、cs.CY
AI总结 本文提出了一种评估AI心理治疗师在心理健康支持中安全风险的框架,通过模拟测试发现AI在治疗中的潜在风险,并验证了交互式可视化工具的有效性。
Comments This paper is a condensed version of the first author's Ph.D. dissertation submitted to Northeastern University