Algorithmic Fragility and Persona Bias in LLM-Generated Autistic Communication
LLM生成的自闭症交流中的算法脆弱性与人格偏见
机构 * University of California, San Diego(加州大学圣地亚哥分校) ; Georgia Institute of Technology(佐治亚理工学院) ; Cornell University(康奈尔大学) ; Cardiff University(卡迪夫大学)
专题命中 知识编辑与模型理解 :LLM(title,title_cn);large language model(abstract);language model(abstract);prompting(abstract)
AI总结 通过双人格改写范式,发现LLM在生成自闭症人格文本时存在词汇与情感偏离、输出坍塌等系统性失败,且对齐策略而非参数规模主导这些失败,表明当前对齐训练导致深层表征鸿沟。
Comments main paper: 9 pages; total: 19 pages; 2 figures; 5 tables