Perturbation-based Regional Interpretability through Subtraction Mapping (PRISM): naming-error dissociations in language models and post-stroke aphasia
基于减法映射的扰动型区域可解释性方法(PRISM):语言模型与卒中后失语症中的命名错误分离现象
机构 * University of South Carolina(南卡罗来纳大学) ; ALLT.AI, LLC(ALLT.AI有限责任公司) ; USC School of Medicine(南卡罗来纳大学医学院)
专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG
AI总结 本研究开发PRISM方法,将神经成像减法分析适配至Transformer语言模型,对比模型与213名卒中后失语症患者的命名错误模式,验证了音素偏向性分离等结果,为模型功能专业化提供可证伪的空间分辨率测试工具。
Comments 49 pages, 6 figures, 1 table. Supplementary methods, 6 tables and 5 figures included