Persuasive and Compliant Tendencies Predict Group Decision-Making in Humans and Language Models
说服倾向与顺从倾向预测人类及语言模型的群体决策
机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)
专题命中 安全评测 :safety(abstract);分类 cs.AI
AI总结 该研究引入DecisionQE框架,以狼人杀为测试平台,发现顺从倾向强的LLM在群体决策中合作优势更稳定,且顺从兼具支持合作与提升对抗角色隐藏能力的双重效应,为LLM安全评估提供了新视角。