The Self-Correction Illusion: Role Relabeling Gates Explicit Error Flagging in Large Language Models
自我修正错觉:LLM 纠正他人但不纠正自己
机构 * National Taiwan University(国立台湾大学)
专题命中 长上下文与记忆 :LLM(title_cn,summary_cn);large language model(title);language model(title);instruction tuning(abstract)
AI总结 本文通过保持错误声明字节一致仅改变角色标签,发现 LLM 无法自我修正并非能力缺陷,而是聊天模板角色标签的人为产物,并提出无需训练或模型修改的提示结构干预方法。
Comments 15 pages, 3 figures, 15 tables