Strengthening Target-Language Features: SAE-Based Steering for Multilingual Inference
强化目标语言特征:基于SAE的多语言推理引导
机构 * Johns Hopkins University(约翰斯·霍普金斯大学)
AI总结 本研究针对多语言大模型性能跨语言差异问题,提出基于SAE的推理时引导方法,通过注入目标语言特征提升模型在XCOPA、XNLI、MGSM等基准上的准确率。
Comments Corrected an author name. No changes to the paper content