Function Induction and Task Generalization: An Interpretability Study with Off-by-One Addition
函数诱导与任务泛化:一项可解释性研究——关于“加一错误”加法
机构 * University of Southern California(南加州大学) ; Salesforce AI Research(Salesforce AI研究院)
AI总结 本研究通过分析“加一错误”加法任务,揭示了语言模型中函数诱导机制如何实现任务泛化,展示了其在多种任务中的复用能力。
Comments ICLR 2026. Code: https://github.com/INK-USC/function-induction