Dissociative Identity: Language Model Agents Lack Grounding for Reputation Mechanisms
分离性身份:语言模型代理缺乏声誉机制的基础
机构 * University of Oxford(牛津大学) ; New York University Shanghai(纽约大学上海分校)
专题命中 长上下文与记忆 :language model(title,abstract);foundation model(abstract);分类 cs.AI
AI总结 本文指出语言模型代理因本体上的分离性(模块可替换、身份流动)而无法满足声誉机制所需的身份持续性、行为可预测性和制裁敏感性,从而提出转向基于可观察性、事前、构成性、协议的行为约束。
Comments Accepted by FaccT 2026