HelpBench: Assessing the Ability of LLMs to Provide Privacy, Safety, and Security Advice
HelpBench:评估LLM提供隐私、安全和安全建议的能力
专题命中 隐私与版权 :safety(title,abstract);trustworthy(abstract)
AI总结 提出HelpBench基准,通过450个真实用户问题评估18个LLM的隐私、安全建议准确性,发现平均得分82%但10%回答低于65%存在有害建议。