Positive Alignment: Artificial Intelligence for Human Flourishing
积极对齐:人工智能促进人类繁荣
Ruben Laukkonen, Seb Krier, Chloé Bakalar, Shamil Chandaria, Morten Kringelbach, Adam Elwood, Daniel Ford, Fernando Rosas, Maty Bohacek, Matija Franklin, Nenad Tomašev, Stephanie Chan, Verena Rieser, Roma Patel, Michael Levin, Arun Rao
机构
*
Department of Psychiatry, University of Oxford(牛津大学精神病学系)
;
Flourishing Intelligence Program, Centre for Eudaimonia and Human Flourishing, Linacre College, University of Oxford(牛津大学幸福智能计划、幸福与人类繁荣中心、林acre学院)
;
Google DeepMind(谷歌DeepMind)
;
LIFE
;
OpenAI
;
Anthropic
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Aily Labs(Aily实验室)
;
Stanford University(斯坦福大学)
;
Tufts University(塔夫茨大学)
;
Positive AI Labs(积极AI实验室)
;
Department of Informatics, University of Sussex(Sussex大学信息学系)
;
Department of Brain Sciences, Imperial College London(伦敦帝国理工学院脑科学系)
Comments11 pages, 1 figure. v3: substantially revised and reframed as a measurement-methodology paper. Code, data, and an immutable Zenodo archive are available at https://github.com/Nakammura/effective-rank-audit (DOI: 10.5281/zenodo.20341444)
CommentsAccepted to the Adaptive and Learning Agents Workshop (ALA 2026) @ AAMAS 2026. Code is available at github.com/vicgalle/experiential-prompt-optimization-safe
Journal refProc. of the Adaptive and Learning Agents Workshop (ALA 2026) @ AAMAS 2026
A Checklist for Trustworthy, Safe, and User-Friendly Mental Health Chatbots
可信、安全且用户友好的心理健康聊天机器人清单
Shreya Haran, Samiha Thatikonda, Dong Whi Yoo, Koustuv Saha
机构
*
University of Illinois Urbana-Champaign, Urbana, United States(伊利诺伊大学厄巴纳-香槟分校)
;
Indiana University Indianapolis, Indianapolis, United States(印第安纳大学印第安纳波利斯分校)
JT-Safe: Intrinsically Enhancing the Safety and Trustworthiness of LLMs
Junlan Feng, Fanyu Meng, Chong Long, Pengyu Cong, Duqing Wang, Yan Zheng, Yuyao Zhang, Xuanchang Gao, Ye Yuan, Yunfei Ma, Zhijie Ren, Fan Yang, Na Wu, Di Jin, Chao Deng
机构
*
University of Notre Dame(notre dame 大学)
;
University of Washington(华盛顿大学)
;
Johns Hopkins University(约翰霍普金斯大学)
;
Georgia Institute of Technology(佐治亚理工学院)
Scaling behavior of large language models in emotional safety classification across sizes and tasks
Edoardo Pinzuti, Oliver Tüscher, André Ferreira Castro
机构
*
Leibniz Institute for Resilience Research(莱比锡韧性研究所)
;
University Medical Center Halle(哈雷医学院)
;
German Center for Mental Health (DZPG)(德国心理健康中心(DZPG))
;
University Medical Center of the Johannes Gutenberg-University Mainz(美因茨约瑟夫·冯·拉贝大学医学院)