Societal Alignment Frameworks Can Improve LLM Alignment
社会对齐框架可以改进大语言模型对齐
Karolina Stańczak, Nicholas Meade, Mehar Bhatia, Hattie Zhou, Konstantin Böttinger, Jeremy Barnes, Jason Stanley, Jessica Montgomery, Richard Zemel, Nicolas Papernot, Nicolas Chapados, Denis Therien, Timothy P. Lillicrap, Ana Marasović, Sylvie Delacroix, Gillian K. Hadfield, Siva Reddy
机构
*
ETH Zurich(苏黎世联邦理工学院)
;
Mila, McGill University(麦吉尔大学米尔人工智能实验室)
;
University of Cambridge(剑桥大学)
;
Columbia University(哥伦比亚大学)
;
University of Toronto, Google DeepMind(多伦多大学与DeepMind)
;
McGill University, ServiceNow(麦吉尔大学与ServiceNow)
;
Google DeepMind(谷歌DeepMind)
;
University of Utah(犹他大学)
;
King's College London(伦敦国王学院)
;
Johns Hopkins University(约翰霍普金斯大学)
;
Mila, McGill University, ServiceNow(麦吉尔大学米尔人工智能实验室与ServiceNow)