Epistemic Norms for AI Safety and Alignment Research
人工智能安全与对齐研究的认知规范
专题命中 安全训练 :alignment(title,abstract);safety(title,abstract);AI safety(title,abstract);分类 cs.AI
AI总结 探讨人工智能安全与对齐研究和主流人工智能研究的差异,基于结构化综合识别当前对齐研究的差距维度,提出包含多项内容的{\sc ECAISA},以约束安全相关研究声明的记录、检查和依赖方式,目标是可审计性。
Comments 36 pages