Ask Before You Diagnose: Safe-Psych, a Sequential Evaluation Benchmark for LLMs in Psychiatry
诊断前先询问:Safe-Psych,一种用于精神病学领域大语言模型的顺序评估基准
Oriana Presacan, Andreea Grama, Larisa Irimină, Alireza Nik, Jaya Ojha, Vajira Thambawita, Ciprian I. Băcilă, Bogdan Ionescu, Michael A. Riegler
机构
*
National University of Science and Technology Politehnica Bucharest(布加勒斯特理工大学国立科技大学)
;
Psychiatric Hospital Doctor Gheorghe Preda(格奥尔基·普雷达医生精神病医院)
;
Oslo Metropolitan University(奥斯陆都市大学)
;
Kristiania University of Applied Sciences(克里斯蒂亚尼亚应用科学大学)
;
SimulaMet(SimulaMet公司)
;
Lucian Blaga University of Sibiu(锡比乌卢西安·布拉加大学)
专题命中
评测与基准
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)
CommentsThis technical contribution supports the MITRE white paper titled: Evaluating LLMs for Impact-Faithful Translation of Adversary Behavior Across Operating Systems