A Systematic Study of Training-Free Methods for Trustworthy Large Language Models
对可信大语言模型无训练方法的系统研究
机构 * CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全研究中心)
专题命中 安全评测 :trustworthy(title,abstract);alignment(abstract);分类 cs.CL
AI总结 本文系统评估了无训练方法在不同可信设置下的有效性,分析了其对效用、鲁棒性和计算开销的影响,并提出平衡可信性、效用和鲁棒性的实用建议。