Evaluating Human-AI Safety: A Framework for Measuring Harmful Capability Uplift
评估人机安全:衡量有害能力提升的框架
机构 * Massachusetts Institute of Technology(麻省理工学院)
专题命中 安全评测 :safety(title,abstract);AI safety(title,abstract);分类 cs.AI、cs.CY
AI总结 本文提出通过测量前沿模型带来的有害能力提升,推动人中心的AI安全评估,提供系统性测量方法和行动步骤。