Probabilistic Attribution For Large Language Models
基于概率的大型语言模型归因
机构 * Argonne Leadership Computing Facility(阿贡领导计算设施) ; Argonne National Laboratory(阿贡国家实验室) ; Mathematics and Computer Science Division(数学与计算机科学 division) ; Department of Computer Science(计算机科学系)
专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI
AI总结 本文提出了一种模型无关的概率性token归因度量,通过贝叶斯法则反向计算下一个token的对数概率,以捕捉模型对token序列分布的内部表示,从而提高大型语言模型的可解释性。
Comments 29 pages, 13 figures