Collective Alignment in LLM Multi-Agent Systems: Disentangling Bias from Cooperation via Statistical Physics
大语言模型多智能体系统中的集体对齐:通过统计物理方法分离偏见与合作
机构 * Critiqality
专题命中 AI治理与伦理 :alignment(title,abstract);分类 cs.CL
AI总结 研究通过统计物理方法分析大语言模型多智能体系统在二维正方形晶格中的集体动态,揭示社会从众与内在偏见的分离,计算临界指数并探测多智能体系统的集体行为与可能相变。
Comments 10 pages, 7 figures