Full-Stack Alignment: Co-Aligning AI and Institutions with Thick Models of Value
全栈对齐:通过厚价值模型对齐人工智能与机构
机构 * Meaning Alignment Institute(意义对齐研究所) ; Massachusetts Institute of Technology(麻省理工学院) ; University College London(伦敦大学学院) ; University of Oxford(牛津大学) ; Western University(西方大学) ; University of Toronto(多伦多大学) ; McGill University(麦吉尔大学) ; Stanford University(斯坦福大学) ; Potsdam Institute for Climate Impact Research(波茨坦气候影响研究所) ; Yale University(耶鲁大学) ; Carnegie Mellon University(卡内基梅隆大学) ; UT Austin(德克萨斯大学奥斯汀分校) ; New York University(纽约大学) ; Harvard University(哈佛大学) ; Midjourney Core contributor(Midjourney核心贡献者)
专题命中 偏好对齐 :alignment(title,abstract);分类 cs.LG
AI总结 本文提出通过厚价值模型实现全栈对齐,以解决AI与机构目标不一致导致的不良后果,涵盖价值表示、规范推理和集体利益建模。