Judge-dependent safety gains and model-specific helpfulness costs of evidence-sufficiency prompting in clinical LLMs
临床大语言模型中证据充分性提示的依赖判断的安全增益和特定模型的有用性成本
专题命中 幻觉与事实性 :safety(title,abstract);分类 cs.AI
AI总结 研究临床大语言模型中证据充分性提示的安全增益及有用性成本,通过在公共数据基准中让四个模型用标准提示和包装器回答问题,发现安全增益有方向和幅度差异且依赖评判者,同时存在模型特定的有用性成本。
Comments https://github.com/KAVentures/clinical-evidence-sufficiency-llm